06:16lmarena.ai@lmarena_aiarena.ai 在 X 平台发布新推文,附带了排行榜页面链接。该推文目前浏览量 901,评论、转发、点赞数均为 0。链接路径以 /leaderboard/ag 开头,具体榜单内容需点开查看。AI模型arena.ai模型排行榜Leaderboard推荐理由:arena.ai 发了排行榜链接,点进去能看模型排名。目前没更多解释,但链接直接可用。原文稍后读已读值得跟进有用关注 arena.ai
02:29OpenRouter@OpenRouterAIOpenRouter 发布了全新 Discover 页面,帮助用户更直观地探索 AI 模型。该页面显示 Opus 5 在综合排名中占据整体领先地位,而 GPT 5.6 Sol 在编程任务上表现突出。同时,平台上路由器列表不断增长,为用户提供更多选择。AI产品OpenRouterOpus 5GPT 5.6 Sol10 个信源在谈事件专题推荐理由:OpenRouter 的新 Discover 页面让你一眼看清哪个模型最强——Opus 5 综合第一,GPT 5.6 Sol 编程厉害,还有更多路由器帮你挑。原文稍后读已读值得跟进有用关注 OpenRouter
00:16量子位@听雨Yuxinlu1在Hugging Face模型排行榜上击败多家大厂模型,登顶多个细分榜单。该账号发布的模型综合得分领先于Meta、Google等公司的开源项目。排行榜显示其推理效率与准确率均达到SOTA水平。AI模型yuxinlu1Hugging Face模型排行榜推荐理由:一个个人开发者干翻大厂,看看yuxinlu1到底做了什么模型这么强原文稍后读已读值得跟进有用关注 yuxinlu1
07:33@koltregaskes@koltregaskes72°Gemini 3.5 Pro 发布推迟至7月,多个 Google DeepMind 关键研究人员已跳槽至 Anthropic 等竞争对手。在顶级模型排行榜上,Gemini 目前位列第三,与 Claude 和 ChatGPT/Codex 差距明显。Google 拥有远超对手的资源,但 Gemini 的表现和人才流失反映出内部问题。AI模型GeminiGoogle DeepMindAnthropic10 个信源在谈事件专题推荐理由:谷歌的Gemini 3.5 Pro要拖到7月了,DeepMind的人还在往外跑,Anthropic趁机挖人。现在Gemini在排行榜上被Claude和ChatGPT甩开,看看这个局面多尴尬。原文稍后读已读值得跟进有用关注 Gemini
03:35@koltregaskes@koltregaskesFable 5 在多个模型排行榜上表现突出,相较此前版本实现罕见的大幅提升。该模型在多项基准测试中显著碾压其他对手,但不是在所有任务上都优秀。这一成绩引发对 OpenAI 等竞争者如何应对的讨论。AI模型Fable 5模型排行榜基准测试10 个信源在谈事件专题推荐理由:Fable 5 在排行榜上把其他模型都压下去了,看看它到底强在哪原文稍后读已读值得跟进有用关注 Fable 5