神秘Ox Alpha AI模型限免上架:DeepSWE跑分碾压Claude Fable 5

神秘 Ox Alpha AI 模型限免上架:DeepSWE 跑分碾压 Claude Fable 5,线索指向智谱

精选理由

Ox Alpha模型免费限免,DeepSWE跑分领先,多模态输入,与智谱架构相似,值得一试。

AI 摘要

Ox Alpha AI模型上线限免,DeepSWE跑分达80%,优于Claude Fable 5的65%。模型支持多模态输入,与智谱架构高度吻合。

原文 · IT之家

神秘 Ox Alpha AI 模型限免上架:DeepSWE 跑分碾压 Claude Fable 5,线索指向智谱

IT之家 8 月 22 日消息, 全球最大 AI 聚合平台 OpenRouter 于 8 月 20 日上线匿名 AI 模型 Ox Alpha,免费开放 1 周时间,目前种种线索指向智谱公司。 开发者 Ben Davis 让 Ox Alpha 完成了 DeepSWE(该基准用于衡量 AI 读取真实代码库、识别漏洞并生成有效补丁的能力)的十项测试任务。 这个来历不明的匿名模型得分约为 80%,而 Claude Fable 5 为 65%,GPT-5.6 Sol 为 52%。Davis 本人也表示,鉴于该模型来源不明,这一结果令他困惑不解。IT之家附上相关跑分结果如下: Model Average across 10 DeepSWE tasks Ox Alpha (stealth) 80% Claude Fable 5 (max) 65% GLM-5.3 (max) 62% Grok 4.6 (xhigh) 62% GPT-5.6-sol (max) 52% OpenRouter 的列表确认了以下规格:上下文窗口达 1,048,576 个 token,支持文本、图像和视频的多模态输入,每次响应最大输出 131,072 个 token。该模型在预览期间免费使用。 终端编程智能体 OpenCode 也通过其免费套餐提供该模型,并声称每日可处理 100 万亿个 token。 研究人员通过对 25 个提示词进行分词器指纹分析,发现 Ox Alpha 的 token 数量与 GLM-5.3 几乎完全吻合,仅存在恒定 75 个 token 的包装层偏差。此外,视频编码器的行为模式和 API 响应特征也与智谱的架构高度吻合。

神秘Ox Alpha AI模型限免上架:DeepSWE跑分碾压Claude Fable 5 · AI 热点