02:20官方账号Pika Labs@pika_labsPika Labs 发布了新的 Pika Music 模型。该模型接受文本、歌词、语音参考和音乐参考四种输入模态。这些信号在一个共享的潜在扩散解码器中融合,生成完整的音乐曲目。它不是一系列独立的工作流程。AI产品Pika MusicPika Labs多模态推荐理由:Pika Labs 新出的 Pika Music 模型,能同时用文字、歌词、声音和音乐来生成一首歌,比分开处理更方便。原文稍后读已读值得跟进有用关注 Pika Music
11:40官方账号arXiv cs.LG@Yi Wang该论文提出GPT模型在符号音乐领域表现不佳的原因在于使用了错误的坐标系进行压缩。研究建立了有效性-无损性框架,将标记化定义为构建预测有效且关系无损的坐标系。实验表明,序列压缩本身不能保证预测压缩,保留上下文自由度允许更高层次的音乐组织结构自然涌现。论文GPT-style modelssymbolic musictokenization推荐理由:这篇论文解释了GPT模型在音乐领域的局限性,提出了新的标记化理论框架,对AI音乐生成研究很有启发。原文稍后读已读值得跟进有用关注 GPT-style models
17:14IT之家(博客/媒体)阿里巴巴8月17日发布AI音乐模型HappyShrimp 1.0,中文名“快乐虾米”。该模型能通过自然语言描述,将情绪、故事或记忆生成完整音乐,支持端到端整曲生成。官方称其针对人声机械、词曲错位等痛点做了优化,并理解Lo-fi R&B等专业术语及文化语境。即日起在国内及海外同步上线PC网页端,用户可免费体验。AI模型阿里HappyShrimpAI音乐推荐理由:阿里刚发了AI音乐模型HappyShrimp 1.0,你把情绪或故事用大白话写进去,它就能生成一首完整的歌,比那些只认风格标签的工具更懂人话。原文稍后读已读值得跟进有用关注 阿里
16:43量子位@思邈音潮API限时免费开放,该国产音乐模型直接对标SUNO。音潮宣称能解决AI音乐中的常见通病,但未公布具体技术细节。开发者可免费接入音潮API进行试用,与SUNO的效果差异尚未有公开评测。AI产品音潮SUNOAPI推荐理由:国产音乐模型音潮的API现在免费开放,说是能治AI音乐那些老毛病,想试试跟Suno比划比划的可以白嫖一把。原文稍后读已读值得跟进有用关注 音潮
15:18IT之家(博客/媒体)MiniMax于8月14日推出音乐生成模型MiniMax-Music3,可根据歌词和音乐描述生成最长5分钟的完整歌曲。该模型采用分层自回归架构,Global LLM参数规模为8B,基于Qwen3-8B初始化,负责预测第一个RVQ码本;Local LLM参数规模为0.6B,负责预测其余声学码本。输出为32kHz、16-bit立体声WAV文件,官方称能在长音频中保持音乐主题、节奏、歌声身份和编曲推进。AI模型MiniMaxMiniMax-Music3Qwen3推荐理由:MiniMax发布了Music3音乐模型,给歌词和描述就能生成5分钟完整歌曲,前奏副歌桥段都有,比常见几十秒的音乐生成更完整。原文稍后读已读值得跟进有用关注 MiniMax
15:09小互@imxiaohu78°MiniMax 开源了 Music 3.0 模型。输入歌词和风格描述,一次可生成五分钟完整歌曲,包含前奏、副歌和桥段,输出 32kHz 立体声。模型权重完全开源,单卡 8GB 显存即可运行。官方还提供了 1000 个歌曲模板和一个扩写技能。AI模型MiniMaxMusic 3.0音乐生成推荐理由:MiniMax 把 Music 3.0 开源了,给句歌词和风格就能出五分钟完整歌,8GB 显存就能跑,还送一千个模板。原文稍后读已读值得跟进有用关注 MiniMax
05:42Hailuo AI@Hailuo_AI精选76°MiniMax 正式发布新一代开源权重音乐模型 MiniMax-Music3。该模型定位生产级(production-ready),可用于多种音乐生成场景。官方称其为 SOTA 级开源音乐模型。权重开放,开发者可自行部署和微调。AI模型MiniMaxMusic3开源模型推荐理由:MiniMax 把音乐模型开源了,叫 Music3,号称开源里最强,能直接生成各种风格的音乐,适合想做 AI 音乐应用的人。原文稍后读已读值得跟进有用关注 MiniMax
03:49官方账号Decoder@Matthias BastianSuno Studio 2.0 面向 Premier 会员推出,将 AI 音乐平台扩展为完整制作工具。新增聊天功能可让用户像和乐队伙伴对话一样操作 DAW,用文字生成乐器与插件。MIDI 导入和 32 位导出均无限制。无限制导出与 Suno 此前公布的下载上限相冲突,该上限旨在遏制流媒体上的 AI 音乐垃圾。AI产品SunoStudio 2.0DAW推荐理由:想用 AI 做音乐?Suno 2.0 能让你用打字生成乐器插件,还能随便导出 32 位文件,别错过。原文稍后读已读值得跟进有用关注 Suno
11:32官方账号arXiv cs.AI@Zixun Guo, Simon Dixon人类能识别时移或转调的音乐,但标准音乐Transformer对这类输入会产生不相关表示。研究发现模型规模增大或训练时间更久时,等变性反而下降。为此提出EMT,通过自蒸馏联合优化下一token预测与辅助等变正则化损失。等变损失作为正则化器,同时提升预测能力和表示质量。在客观与主观评估中,EMT均超过数据增强、特征工程和SOTA基线。论文Equivariant Music Transformer音乐生成自蒸馏推荐理由:音乐Transformer换个调就认不出旋律,EMT用自蒸馏让它真正学到结构,生成效果还比SOTA好。原文稍后读已读值得跟进有用关注 Equivariant Music Transformer
23:56techcrunch@Sarah PerezSpotify的AI混音与翻唱付费工具获得独立音乐版权机构Merlin支持,后者代表超过3万家独立厂牌和分销商。此前环球音乐已加入该计划。该工具允许粉丝对参与艺术家的歌曲生成AI翻唱和混音,艺术家需主动选择加入,并获得署名和补偿。AI产品SpotifyMerlinAI翻唱推荐理由:Spotify要出AI翻唱混音工具了,Merlin带着3万多家独立厂牌加入,艺术家能选入并拿钱。原文稍后读已读值得跟进有用关注 Spotify
09:45IT之家(博客/媒体)72°7月29日,谷歌发布Lyria 3.5音乐生成AI模型,在Google Flow Music中推出。相比上一代,Lyria 3.5重点提升旋律编排、歌词生成和人声质量。新模型能生成更复杂的旋律结构,更好遵循用户提示词。人声更贴近真实演唱,情感层次更细腻。此外,Lyria 3.5增强了创作控制,用户可设定歌曲节奏和时长。AI模型Lyria 3.5Google音乐生成2 个信源在谈事件专题推荐理由:谷歌在Flow Music里更新了Lyria 3.5,旋律和歌词都更好,人声也真实了,创作音乐更顺手。原文稍后读已读值得跟进有用关注 Lyria 3.5
02:44官方账号Decoder@Matthias BastianGoogle发布了Lyria 3.5音乐生成模型,并集成到Google Flow Music中。该模型可生成30秒到3分钟长度的音轨。新功能"Selective Section Painting"允许用户编辑音轨中的特定部分,无需从头开始。Google尚未公开训练数据细节。AI模型Lyria 3.5GoogleGoogle Flow Music2 个信源在谈事件专题推荐理由:Google的Lyria 3.5能让你单独改一段音乐,不用整首重做,做音乐省事多了。原文稍后读已读值得跟进有用关注 Lyria 3.5
11:29官方账号arXiv cs.AI@Junyu Dai, Xinyue Fan, Weiqin Li, Xiangang Li, Yunjia Li, Bin Ma, Yukun Ma, Chongjia Ni, Yufei Shi, Haoxu Wang, Menglin Wu, Jianwei Yu, Huaicheng Zhang, Han Zhao, Shengkui Zhao, Haina Zhu本文提出一个统一的全歌曲生成框架,支持从歌词、文本描述和音乐属性生成完整歌曲。该框架包含四个组件:语义感知分词器将音频编码为8码本RVQ令牌,hybird-LM进行层次化自回归音频令牌建模,FullDiT在连续VAE潜空间中执行流匹配渲染,两级旋律模块用于翻唱生成。在人工分析音乐带歌声排行榜上取得竞争性能,并探索了DPO、GRPO和OPD作为后训练策略。实验在多语言自动基准上进行评估。论文hybird-LMFullDiT歌曲生成推荐理由:这篇论文提出了一个能生成完整歌曲的框架,支持歌词生成、纯音乐和翻唱,还在排行榜上验证了效果,音乐生成方向的同学可以看看。原文稍后读已读值得跟进有用关注 hybird-LM
10:25官方一手pandaily@contact@pandaily.com (Pandaily)昆仑万维发布Mureka V9.5,采用O3反思推理技术提升音乐自然度。搭配MuCo创作智能体实现专业化制作。生成的AI音乐在音质和情感表达上接近人类创作,减少机器痕迹。该版本在音色连贯性和旋律流畅性上优于前代V9。AI模型Mureka V9.5昆仑万维O3推荐理由:昆仑万维的Mureka V9.5用O3推理让AI音乐听起来不像机器做的,做歌更自然,值得试试。原文稍后读已读值得跟进有用关注 Mureka V9.5
11:33IT之家(博客/媒体)索尼音乐当地时间7月21日向纽约南区联邦法院起诉音乐生成AI公司Udio,指控其未经许可复制超过3万段录音用于训练模型。此前索尼在2024年6月的首次起诉仅涉及333份录音,新诉讼在法院驳回扩大范围请求后重新提交。索尼强调这3万段只是已识别数十万条录音的子集,并驳斥Udio的“合理使用”辩护,指出付费许可市场已存在。Udio此前已与环球音乐、华纳音乐达成和解,但索尼坚持追究版权侵权责任。行业索尼音乐Udio音乐生成推荐理由:索尼死磕AI音乐公司,这次直接甩出3万段录音证据,看Udio还能不能拿“合理使用”当挡箭牌。原文稍后读已读值得跟进有用关注 索尼音乐
11:17IT之家(博客/媒体)Spotify 在 2023 年下架了超过 7500 万首 AI 生成的歌曲。平台每天接收 10 万首新上传,其中 AI 内容占比持续上升。这些 AI 歌曲存在大规模批量生产和刷量行为,挤压了内容审核与版税分配系统。由于 Suno、Google Lyria 等工具降低生成门槛,AI 辅助创作与纯 AI 生成的界限变得模糊。行业SpotifyAI音乐音乐生成推荐理由:Spotify 一年砍掉 7500 万首 AI 歌,数字太吓人了。平台每天收 10 万首新歌,AI 刷量搞得审核和分钱都乱套了。原文稍后读已读值得跟进有用关注 Spotify
08:03berryxia@berryxia73°阿里巴巴开源了Wan-Dancer-14B模型,这是一个14B参数的模型,可以根据音乐生成与节拍同步的舞蹈视频。该模型支持街舞、踢踏、拉丁、K-Pop、中式古典等多种舞蹈风格,并能实现较长时间连贯输出。用户可在本地运行该模型,不再依赖云端服务,大幅降低了音乐驱动舞蹈生成的门槛。此前类似能力多依赖闭源模型或效果不佳,此次开源权重让本地部署成为现实。AI模型Wan-Dancer-14BAlibaba视频生成推荐理由:阿里开源了Wan-Dancer-14B,能根据音乐生成同步舞蹈视频,支持多种风格,本地就能跑,比闭源模型门槛低得多。原文稍后读已读值得跟进有用关注 Wan-Dancer-14B
16:02IT之家(博客/媒体)米哈游旗下 AI 陪伴互动软件《BSide: Olivia Lin》今日在 Steam 平台开启抢先体验,需绑定米哈游通行证。该应用融合 AI 互动、音乐生成与桌面动态壁纸,用户可上传 MIDI 文件自动生成音乐视频,也可与角色林离进行 AI 写信互动。林离角色于2025年8月在 B 站首秀,今年3月开始发布读信回信内容。开发者计划通过抢先体验收集用户反馈持续优化。AI产品BSide: Olivia Lin米哈游音乐生成推荐理由:米哈游出了个 AI 音乐陪伴软件,能传 MIDI 自动生成视频,还能跟虚拟角色林离写信聊天,挺新鲜的。原文稍后读已读值得跟进有用关注 BSide: Olivia Lin
14:43量子位@Jay字节跳动推出从零预训练的十亿参数AI音乐模型,专门优化华语歌曲生成。该模型显著降低了合成歌声的机械感,音质接近真人演唱。模型训练数据涵盖大量华语流行歌曲,提升了歌词发音准确性和情感表现力。这是字节在AI音乐领域的首次重要布局。AI模型字节跳动AI音乐模型十亿参数2 个信源在谈事件专题推荐理由:字节出的AI音乐模型,专为华语歌训练,十亿参数,听着终于不‘电子味儿’了,可以试试。原文稍后读已读值得跟进有用关注 字节跳动
09:52官方账号arXiv cs.AI@Josef Pavlicek该论文提出一种结合量子启发式候选探索与显式规则优化的混合架构,用于从旋律自动生成和声。系统通过重叠旋律语境实现候选探索,并利用优化层提升结构连贯性、功能一致性和鲁棒性。实验使用可复现指标评估,包括结构连贯性、功能和声一致性、和声相似性和鲁棒性。结果表明,该方法在保持调性结构和终止行为的同时,允许多种有效的和声实现,且无需训练语料库。论文量子启发式音乐生成和声生成推荐理由:想自动生成和声但又怕结果太随意?这篇论文用量子启发式加规则优化,让旋律变和弦既灵活又可控,还不用训练数据。原文稍后读已读值得跟进有用关注 量子启发式
08:48官方账号Stability AI@StabilityAI精选团队 Motif 在 Stable Audio 3.0 上微调,使其识别阿拉伯 maqam 音阶。他们开发了一个 Ableton 插件,实现微音阶风格转移。该作品在 StabilityAI 举办的 Stable Audio 3.0 挑战赛中获胜,并能在本地设备运行。演示视频由 Jad Al Masri 讲解。AI产品Stable Audio 3.0MotifAbleton 插件推荐理由:StabilityAI 挑战赛冠军团队 Motif 把 Stable Audio 3.0 微调后做成了 Ableton 插件,专门处理阿拉伯音乐微音阶,本地就能跑。原文稍后读已读值得跟进有用关注 Stable Audio 3.0
13:55官方账号arXiv cs.AI@Shun Lei, Huaicheng Zhang, Dapeng Wu, Yaoxun Xu, Lishi Zuo, Wei Tan, Hangting Chen, Guangzheng Li, Jianwei Yu, Zhiyong Wu, Dong YuLeVo 2 是一个混合 LLM-Diffusion 框架,用于可控完整歌曲生成。它通过分层建模,先用 LeLM 预测混合 token 进行语义规划,再并行预测声乐和伴奏 token 细化细节,最后用扩散 Music Codec 重建波形。该框架引入美学引导训练,前训练阶段用自动音乐评估为大规模数据标注音乐性层级。渐进后训练依次使用 SFT、大规模离线 DPO 和闭环半在线 DPO 提升生成质量、可控性和音乐性。专家听测和客观评估显示,LeVo 2 在六个主观维度上超越开源基线,并在多项指标接近商业系统。AI模型LeVo 2音乐生成分层建模推荐理由:LeVo 2 发布了一个能生成完整歌曲的模型,通过分层建模和美学引导训练,歌唱质量和可控性都比开源方案强,已经逼近商业系统水平。原文稍后读已读值得跟进有用关注 LeVo 2
22:36小互@imxiaohu字节跳动推出新 AI 音乐模型 SeedMusic 1.0 Preview,用户输入一句话提示词即可在 2-3 分钟内生成一首完整歌曲。该模型支持古风、流行等风格混合,效果流畅且节奏感强。测试提示词为“来一首古风歌曲,但有现代流行节奏感”,输出结果朗朗上口。AI模型SeedMusic字节跳动音乐生成推荐理由:字节跳动新出的 SeedMusic 1.0 Preview 能一句话生成完整歌曲,2-3分钟出活,古风混流行节奏的效果挺不错。原文稍后读已读值得跟进有用关注 SeedMusic
12:14官方账号arXiv cs.LG@Yonghyun Kim, Junwon Lee, Haiwen Xia, Yinghao Ma, Junghyun Koo, Koichi Saito, Yuki Mitsufuji, Chris DonahueTuneJury 是一个面向文本到音乐生成的开放实例级成对奖励模型,基于人类偏好标签(包括竞技场投票、指标对齐偏好、众包成对比较和专家美学评分)训练。它通过简单分数阈值支持数据过滤,在保留测试对和分布外基准上表现良好,并胜过先前的基线。该模型还引入锚定校准方法,以更高的数据效率恢复一致性,并在三种下游应用(推理时最优N采样、DITTO风格潜在优化和专家迭代后训练)中持续提升奖励轴收益。TuneJury 已在 GitHub 发布。论文TuneJury音乐生成多模态推荐理由:如果你在搞音乐生成,想用人类偏好来对齐模型,这个开源的奖励模型 TuneJury 可以让你直接拿来用,还附带了三种应用示例,比重新训一个省事多了。原文稍后读已读值得跟进有用关注 TuneJury
09:11官方账号ElevenLabs@elevenlabsioElevenLabs 推出 Music v2 SDK,开发者可通过文本提示生成音乐,人声、乐器和编曲质量相比 v1 显著提升。新版本支持参考匹配现有音轨,实现风格或结构复制。多语言输出功能增强,支持非英语语言生成更自然的音乐。AI产品ElevenLabsMusic v2音乐生成推荐理由:ElevenLabs 的 Music v2 SDK 让开发者直接用文字生成音乐,还能参考现有曲子做匹配,多语言效果也不错,做音视频应用很实用。原文稍后读已读值得跟进有用关注 ElevenLabs
01:05向阳乔木@vista8Suno音乐生成工具最近上新了几首风格特别的歌曲,包括《Ghostty》《We Flow》《Neon Son》等。这些歌曲通过组合不同风格元素,创造出新的听觉体验。作品展示了Suno在音乐风格融合和创意生成方面的能力。技巧SunoAI音乐音乐生成推荐理由:Suno又整新活了,这几首风格混搭的歌听着挺新鲜,想试试AI音乐创作可以听听看。原文稍后读已读值得跟进有用关注 Suno
00:57官方账号ElevenLabs@elevenlabsio71°ElevenLabs 推出 Music v2,通过 ElevenAPI 供开发者将 AI 音乐生成与编辑嵌入自身产品。新版本在人声、乐器编排和音轨质量上全面升级,支持更多音乐流派及多语言,并实现了此前无法完成的创作功能。API 接口允许实时生成并迭代调整音乐片段。AI产品ElevenLabsMusic v2ElevenAPI推荐理由:ElevenLabs 发了 Music v2,API 直接能集成到你的软件里。人声和编曲比之前好很多,还支持多语种,做音乐工具或游戏音效可以用它。原文稍后读已读值得跟进有用关注 ElevenLabs
11:19官方账号arXiv cs.LG@Kyuil Lee, Dezhi Yu, Yongkang Huang该研究系统比较了三种生成模型在巴赫风格钢琴音乐生成上的表现:带注意力的自回归LSTM、潜变量模型(包括循环VAE和向量量化VAE)以及生成对抗网络。实验表明,带注意力的自回归LSTM生成的音乐连贯性最佳;向量量化有助于缓解后验崩溃问题,生成的结构化输出优于传统循环VAE;对抗方法能捕捉局部音高模式,但训练困难且风格泛化不稳定。研究揭示了不同方法在符号音乐生成中的优势与局限。论文音乐生成自回归模型潜变量模型推荐理由:做音乐AI或生成式模型的研究者,这篇论文直接对比了三大主流方法在巴赫风格音乐上的效果,结论清晰,适合作为技术选型参考。原文稍后读已读值得跟进有用关注 音乐生成
05:21Google AI Developers@googleaidevsGoogle Magenta 项目发布了 Magenta RealTime 2 (MRT2),一个开源的实时音乐生成模型。该模型支持通过 MIDI 键盘、实时文本提示甚至手势进行控制,延迟低于 200 毫秒,可在 MacBook 上原生运行。MRT2 提供了开源权重、开源推理引擎以及配套的应用和插件,让用户像演奏乐器一样与 AI 互动创作音乐。这标志着 AI 音乐生成从离线工具向实时交互乐器的重要转变。AI产品Google MagentaMRT2音乐生成推荐理由:音乐创作者和 AI 爱好者现在可以像弹奏乐器一样实时与模型互动,延迟低至 200ms,直接上手试试开源权重和插件。原文稍后读已读值得跟进有用关注 Google Magenta
10:49官方账号arXiv cs.LG@Yuchen Liang, Ness Shroff, Yingbin Liang精选离散扩散模型在文本和符号领域表现优异,但均匀率模型生成样本时通常需要大量步骤。现有加速方法要么需要额外训练,要么混合速度慢。本文提出Gibbs加速离散扩散(GADD),利用具体分数函数结构直接构建Gibbs后验似然,无需额外训练。GADD实现了O(polylog(ε^{-1}))的采样复杂度,是均匀率离散扩散模型的首个此类理论保证。实验表明,GADD在合成数据、零样本文本生成和条件音乐生成中,显著提升了样本质量和计算效率,优于标准基线方法。论文离散扩散模型Gibbs校正器采样加速推荐理由:离散扩散模型加速一直是个难题,GADD用Gibbs校正器实现了理论最优采样复杂度,做生成模型的研究者可以直接参考其方法。原文稍后读已读值得跟进有用关注 离散扩散模型
08:20berryxia@berryxiaStable Audio 3 官方版发布,支持在本地 Mac 电脑上运行音乐生成模型,利用苹果统一内存架构优势。在 M5 Pro 上可实现 59 倍实时速度,LoRA 微调不到 1 小时完成,提供 Sm 和 Medium 两种模式。通过一行命令即可安装 MLX 优化版,让音乐创作不再依赖云端。官方鼓励社区折腾,适合快速出 demo、训练风格或在离线环境下作曲。AI产品Stable Audio 3音乐生成本地部署推荐理由:音乐创作者和 AI 爱好者终于能在本地 Mac 上跑音乐模型了,LoRA 微调不到 1 小时,适合快速出 demo 或训练个人风格,建议有 Mac 的开发者直接试。原文稍后读已读值得跟进有用关注 Stable Audio 3
12:49向阳乔木@vista8vista8 在 X 上分享了自己的今日待办清单,包括开源 Suno 音乐生成 Skill、研究 MTV 合成、在服务器部署即梦 Docker API、迁移网站首页到 Cloudflare、学习经典 AI 论文,以及回北京途中找钓点测试小物钓鱼竿。这条推文展示了 AI 开发者日常的多任务并行与生活融合,其中开源 Suno Skill 和部署即梦 API 对音乐生成和 AI 应用开发者有直接参考价值。行业Suno音乐生成Docker推荐理由:AI 音乐生成和 Docker 部署的开发者可以看看这位同行的开源计划,Suno Skill 开源后能直接复用。原文稍后读已读值得跟进有用关注 Suno
10:22官方账号arXiv cs.LG@Shinnosuke Taksuka, Hideo Mukai精选该研究提出 Musical Attention 机制,通过将小节号、调号、拍号和速度等元信息融入注意力计算,解决 Transformer 生成音乐时常见的重复和音符冗余问题。每个音符被表示为音高、小节号、起始时间、时长、力度及三个元信息共八个特征,注意力机制据此调整相关性权重。实验表明,该方法在音乐连贯性、多样性和整体质量上优于 Full Attention 和 Strided Attention,显著减少重复并增强和声一致性。这项工作是 AI 音乐生成领域的重要进展,有助于生成更自然、富有表现力的旋律。论文音乐生成Transformer注意力机制推荐理由:做 AI 音乐生成或音频研究的团队可以关注——这个机制直接解决了 Transformer 生成音乐时“重复啰嗦”的痛点,用元信息让旋律更自然,值得在自家模型上试试。原文稍后读已读值得跟进有用关注 音乐生成
12:33官方一手MiniMax: News(资讯)精选MiniMax 发布 Music 2.5+ 版本,新增纯音乐生成能力。该版本在风格多样性上实现突破,支持从古典到电子等多种曲风。用户可直接通过文本描述或旋律参考生成无歌词的纯音乐片段,降低音乐创作门槛。AI产品MiniMaxMusic 2.5+音乐生成推荐理由:MiniMax又把AI音乐升级了,这回能直接做纯音乐原文稍后读已读值得跟进有用关注 MiniMax
12:33官方一手MiniMax: News(资讯)精选MiniMax 推出音乐生成模型 MiniMax Music 2.5 版本。新版本对音乐结构和音质进行了优化。支持更长的音频生成。适用于多种创作场景。AI模型MiniMax音乐生成音频模型推荐理由:国产音乐模型又升级了原文稍后读已读值得跟进有用关注 MiniMax
12:33官方一手MiniMax: News(资讯)精选MiniMax 发布了 Music 1.5 音乐生成模型,这是该系列的最新版本。新模型在生成质量、时长控制和风格多样性上有所提升。Music 1.5 支持更长的音频创作,并优化了高保真度输出。AI模型MiniMaxMusic 1.5音乐生成推荐理由:音乐生成模型更新到1.5版原文稍后读已读值得跟进有用关注 MiniMax
12:33官方一手MiniMax: News(资讯)精选MiniMax推出Music 2.0模型,能生成最长30秒的带人声歌曲。支持中文和英文歌词创作,提供超过10种预设音色和多种音乐风格。用户可自定义歌词、旋律、节奏等参数。模型在歌曲生成基准测试中达到领先水平。AI模型MiniMax Music 2.0MiniMax音乐生成推荐理由:能生成带人声的歌曲原文稍后读已读值得跟进有用关注 MiniMax Music 2.0