19:12IT之家(博客/媒体)智元自研的具身原生全模态大模型WITA-Omni Preview在DailyOmni榜单中以85.21分综合成绩登顶榜首,超过千问、Gemini、豆包、英伟达等模型,并在八项细分指标中的六项取得第一。该模型采用Thinker-Talker-Actor架构,将物理动作和表情提升为一级输出,实现端到端统一驱动感知、决策与表达。训练阶段使用总计千万小时级的开源和自有多模态数据,将视觉底座升级为音画联合推理模型。智元还构建了以人为中心、面向真实交互场景的大规模全模态数据集,保留声音、画面、语言、动作和表情的时序关系。AI模型智元WITA-Omni PreviewDailyOmni推荐理由:智元发了WITA-Omni Preview,85.21分登顶DailyOmni,比Gemini、千问都强,搞具身智能的多模态模型可以看看原文稍后读已读值得跟进有用关注 智元