AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:多语言/方言×
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
6月2日
09:39
09:39arXiv cs.AI@Sicheng Yang, Shulan Ruan, Shiwei Wu, Yu Liu, Lu Fan, Zhi Li, You He
72°
PolySpeech-100 是一个大规模语音理解基准,覆盖 110 种语言变体,包括 19 种中文方言和 80 多种低资源语言。它采用混合构建流程,结合人工录音和指令驱动合成语音,解决了现有基准偏重高资源语言、仅关注 ASR 而非语义推理、忽视方言的问题。评估 22 个模型(如 Gemini-3、GPT-Audio、Qwen2.5-Omni)后发现:开源端到端模型在重方言上优于级联系统,但低资源语言上性能严重下降;链式思维提示在零样本设置下反而降低大多数模型的语音理解能力。该基准为下一代包容性语音大模型建立了严格标准,数据和代码已开源。
论文语音理解基准测试多语言/方言端到端模型开源/仓库

推荐理由:语音理解基准终于覆盖了方言和低资源语言,做多语言语音模型或方言应用的团队可以直接用这个基准来评估自己的模型,避免只测英语的偏科问题。
原文
精选全部日报登录