主要来源Browser Use
查看原文事件专题 · 多源确认
Minimax M3 在 BU Bench 测试中表现亮眼,与 Claude 4.6-sonnet 和 Gemini 3.5 flash 同级别
Minimax M3 模型在 BU Bench 基准测试中取得了显著进步,相比之前版本提升了 26%。该测试使用 browsercode 方法评估模型在浏览器自动化任务上的表现。目前 M3 的性能已与 Claude 4.6-sonnet 和 Gemini 3.5 flash 等主流模型持平。这一结果表明 Minimax 在浏览器智能体领域取得了重要突破,为未来进一步优化奠定了基础。
当前结论
做浏览器自动化或智能体开发的团队值得关注——Minimax M3 用 26% 的提升证明自己已跻身第一梯队,可以直接拿来对比测试。
7 个信源58° AI 热度最后更新 2026/6/1 19:32:05
证据链
相关来源 1IT之家
查看原文相关来源 2OpenRouter
查看原文相关来源 3Guillermo Rauch
查看原文相关来源 4Together AI
查看原文相关来源 5歸藏(guizang.ai)
查看原文相关来源 6岚叔
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。