10:20官方一手pandaily@contact@pandaily.com (Pandaily)AgiBot WITA-Omni 在 DailyOmni 基准上取得 85.21 分,8 项指标中 6 项位列第一。该模型采用 Thinker-Talker-Actor 架构,能够同步处理语音、动作和表情。其性能超越 Google Gemini、字节跳动豆包和阿里巴巴通义千问等竞品。AI模型AgiBotWITA-OmniDailyOmni推荐理由:AgiBot 发了 WITA-Omni 全模态模型,DailyOmni 上碾压 Gemini 和豆包,还能同时管语音和动作,值得关注。原文稍后读已读值得跟进有用关注 AgiBot
02:53官方账号NVIDIA AI@NVIDIAAI78°NVIDIA 宣布推出 Cosmos 3,号称首个面向物理 AI 的全模态模型。该模型能够处理多种输入模态(如文本、图像、视频等),并应用于机器人、自动驾驶等物理世界场景。官方展示了多个令人惊叹的示例,体现了模型在理解与生成物理交互方面的能力。这标志着 AI 从数字世界向物理世界迈出了重要一步。AI模型物理AI全模态模型NVIDIA10 个信源在谈事件专题推荐理由:做机器人或自动驾驶的开发者终于有了一个能统一处理多模态输入的物理 AI 模型,值得看看它能带来哪些新可能。原文稍后读已读值得跟进有用关注 物理AI
16:18向阳乔木@vista8精选网易有道发布子曰4全模态模型,27B参数,在视觉数理方向达到同规模SOTA,纯文本数理难题准确率81.4%。该模型面向中文学习场景,兼顾多模态与纯文本数理推理能力。同时,子曰4全模态模型和TTS引擎同步开源,开放参数权重,支持本地部署和二次训练。TTS模型仅需3秒即可克隆原声,支持14种语言,克隆准确度超97%,音色还原度95%以上。AI模型全模态模型开源/仓库数理推理推荐理由:教育科技团队和AI开发者有了一个27B甜点级参数的全模态开源选择,数理推理和语音克隆能力都很能打,做学习类应用或本地部署的可以直接上手试试。原文稍后读已读值得跟进有用关注 全模态模型