事件专题 · 多源确认

MAI-1 基准成绩逊于 Sonnet 4.6,办公场景存疑

MAI-1 尚未有第三方独立基准,但官方发布的成绩显示其表现不如 Claude Sonnet 4.6。该模型计划作为 Copilot 集成到 Excel 和 Outlook 中,但目前已有较好的 Claude/OpenAI 插件可替代。评论认为 MAI-1 在办公场景下可能难以具备优势。

当前结论

MAI-1 基准不如 Sonnet 4.6,还打算做 Office Copilot?给你省流了。

11 个信源33° AI 热度最后更新 2026/7/8 03:41:47

证据链

相关来源 9Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情