主要来源marktechpost
查看原文事件专题 · 官方一手
NVIDIA发布Audex:统一音频-文本LLM,保留骨干文本智能
NVIDIA发布了Nemotron-Labs-Audex-30B-A3B(Audex)模型,这是一个混合专家(MoE)架构,统一了音频理解、语音识别、翻译、文本转语音和音频生成五种能力。该模型以Nemotron-Cascade-2为骨干,仅在音频任务上产生边际的性能回归。Audex在30B总参数中仅有3B活跃参数,高效实现了多模态融合。
当前结论
NVIDIA发了款新模型Audex,能同时搞定音频理解、语音识别、翻译、TTS和音频生成,而且几乎没牺牲原有文本模型的性能。
11 个信源52° AI 热度最后更新 2026/7/8 00:50:26
证据链
相关来源 1NVIDIA AI
查看原文相关来源 2The Rundown AI
查看原文相关来源 3elvis
查看原文相关来源 4LangChain
查看原文相关来源 5Aravind Srinivas
查看原文相关来源 6vLLM
查看原文相关来源 7pandaily
查看原文相关来源 8IT之家
查看原文相关来源 9Decoder
查看原文相关来源 10arXiv cs.LG
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。