8月21日
02:20
02:20官方账号Pika Labs@pika_labs
Pika Labs 发布了新的 Pika Music 模型。该模型接受文本、歌词、语音参考和音乐参考四种输入模态。这些信号在一个共享的潜在扩散解码器中融合,生成完整的音乐曲目。它不是一系列独立的工作流程。
推荐理由:Pika Labs 新出的 Pika Music 模型,能同时用文字、歌词、声音和音乐来生成一首歌,比分开处理更方便。
8月15日
16:43
8月14日
15:09
05:42
05:42Hailuo AI@Hailuo_AI
精选76°
MiniMax 正式发布新一代开源权重音乐模型 MiniMax-Music3。该模型定位生产级(production-ready),可用于多种音乐生成场景。官方称其为 SOTA 级开源音乐模型。权重开放,开发者可自行部署和微调。
推荐理由:MiniMax 把音乐模型开源了,叫 Music3,号称开源里最强,能直接生成各种风格的音乐,适合想做 AI 音乐应用的人。
7月23日
11:29
11:29官方账号arXiv cs.AI@Junyu Dai, Xinyue Fan, Weiqin Li, Xiangang Li, Yunjia Li, Bin Ma, Yukun Ma, Chongjia Ni, Yufei Shi, Haoxu Wang, Menglin Wu, Jianwei Yu, Huaicheng Zhang, Han Zhao, Shengkui Zhao, Haina Zhu
本文提出一个统一的全歌曲生成框架,支持从歌词、文本描述和音乐属性生成完整歌曲。该框架包含四个组件:语义感知分词器将音频编码为8码本RVQ令牌,hybird-LM进行层次化自回归音频令牌建模,FullDiT在连续VAE潜空间中执行流匹配渲染,两级旋律模块用于翻唱生成。在人工分析音乐带歌声排行榜上取得竞争性能,并探索了DPO、GRPO和OPD作为后训练策略。实验在多语言自动基准上进行评估。
推荐理由:这篇论文提出了一个能生成完整歌曲的框架,支持歌词生成、纯音乐和翻唱,还在排行榜上验证了效果,音乐生成方向的同学可以看看。
7月22日
10:25
10:25官方一手pandaily@contact@pandaily.com (Pandaily)
昆仑万维发布Mureka V9.5,采用O3反思推理技术提升音乐自然度。搭配MuCo创作智能体实现专业化制作。生成的AI音乐在音质和情感表达上接近人类创作,减少机器痕迹。该版本在音色连贯性和旋律流畅性上优于前代V9。

推荐理由:昆仑万维的Mureka V9.5用O3推理让AI音乐听起来不像机器做的,做歌更自然,值得试试。
7月4日
08:48
08:48官方账号Stability AI@StabilityAI
精选
团队 Motif 在 Stable Audio 3.0 上微调,使其识别阿拉伯 maqam 音阶。他们开发了一个 Ableton 插件,实现微音阶风格转移。该作品在 StabilityAI 举办的 Stable Audio 3.0 挑战赛中获胜,并能在本地设备运行。演示视频由 Jad Al Masri 讲解。

推荐理由:StabilityAI 挑战赛冠军团队 Motif 把 Stable Audio 3.0 微调后做成了 Ableton 插件,专门处理阿拉伯音乐微音阶,本地就能跑。
6月16日
09:11
09:11官方账号ElevenLabs@elevenlabsio
ElevenLabs 推出 Music v2 SDK,开发者可通过文本提示生成音乐,人声、乐器和编曲质量相比 v1 显著提升。新版本支持参考匹配现有音轨,实现风格或结构复制。多语言输出功能增强,支持非英语语言生成更自然的音乐。

推荐理由:ElevenLabs 的 Music v2 SDK 让开发者直接用文字生成音乐,还能参考现有曲子做匹配,多语言效果也不错,做音视频应用很实用。
00:57
00:57官方账号ElevenLabs@elevenlabsio
71°
ElevenLabs 推出 Music v2,通过 ElevenAPI 供开发者将 AI 音乐生成与编辑嵌入自身产品。新版本在人声、乐器编排和音轨质量上全面升级,支持更多音乐流派及多语言,并实现了此前无法完成的创作功能。API 接口允许实时生成并迭代调整音乐片段。
推荐理由:ElevenLabs 发了 Music v2,API 直接能集成到你的软件里。人声和编曲比之前好很多,还支持多语种,做音乐工具或游戏音效可以用它。
5月21日
5月13日
12:33