16:19IT之家(博客/媒体)Arena平台发布2026年第31周AI大模型排行榜。阿里qwen3.8-max以1496分位列综合榜第5,距榜首claude-fable-5仅差13分。月之暗面kimi-k3-max以1485分排综合榜第13。代码榜中,kimi-k3-max和qwen3.8-max分别以1531分和1530分进入Top10。前端开发榜kimi-k3-max以1676分排第二,字节seedream-5.0-pro进入AI生图榜第6名。AI模型qwen3.8-maxclaude-fable-5kimi-k3-max3 个信源在谈事件专题推荐理由:阿里新模型qwen3.8-max一上榜就冲到综合第五,只比榜首Claude差13分;kimi-k3-max代码也进了前十,国产模型进步挺明显,榜单值得翻翻。原文稍后读已读值得跟进有用关注 qwen3.8-max
09:48IT之家(博客/媒体)Arena平台发布最新周榜(2026年7月6-12日),代码榜榜首由claude-opus-4-7-thinking以ELO 1553分登顶,原榜首claude-fable-5降至第五。综合榜claude-fable-5继续蝉联第一,ELO 1505分,前五名均为Anthropic模型。国产模型最高为qwen3.7-max-preview,综合榜第17名(1475分),代码榜第12名(1526分)。glm-5.1、ernie-5.1等国产模型排名相对稳定。AI模型claude-opus-4-7-thinkingclaude-fable-5Arena10 个信源在谈事件专题推荐理由:想快速了解本周最强AI模型?Arena周榜给出硬核排名:代码能力claude-opus-4-7-thinking超了claude-fable-5,国产qwen3.7也稳在Top20。原文稍后读已读值得跟进有用关注 claude-opus-4-7-thinking
18:35IT之家(博客/媒体)Arena平台公布6月29日~7月5日大模型对战综合榜,Anthropic的claude-fable-5以1509 ELO分蝉联第一,领先第二名claude-opus-4-6-thinking仅5分。前十名全部为美国厂商,gemini-3.5-flash上升2位至第11名,glm-5.1下滑3位至第22名。国产模型中,阿里qwen3.7-max-preview以1475分排名第15,百度ernie-5.1以1468分排第27,小米mimo-v2.5-pro以1466分列第29。代码榜中Anthropic垄断前九,claude-fable-5得1563分居首,国产qwen3.7-max-preview位列第10。数学榜由claude-opus-4-6-thinking以1518分领跑,国产kimi-k2.6排名第13。AI模型claude-fable-5qwen3.7-max-previewernie-5.110 个信源在谈事件专题推荐理由:这期榜单告诉你哪家模型综合最强、代码最好、数学最牛。国产的qwen3.7-max-preview在代码榜进了前十,值得看看。原文稍后读已读值得跟进有用关注 claude-fable-5
10:14官方账号Simon Willison@simonw精选Simon Willison 编写脚本每分钟调用 Anthropic API,监测对 claude-fable-5 模型的访问权限。大约在发推前14分钟,访问被切断。该模型尚未正式公开,此次测试揭示了其临时可用性。AI模型claude-fable-5ClaudeAnthropic10 个信源在谈事件专题推荐理由:Simon实测神秘模型访问时长原文稍后读已读值得跟进有用关注 claude-fable-5