Mem0 把 GPT-5.6-Luna、MiniMax M3、Claude Sonnet 5 扔进 Hermes 和 Claude Code 两套框架跑分了,排行榜在 dolphinbench.ai,可以直接看哪个模型换框架后掉分最少。
#Claude Sonnet 5
Devin现在能用Gemini 3.7 Flash了,跑FrontierCode 1.1和Claude Sonnet 5差不多,成本砍半还快,写代码可以试试。
谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。
Anthropic 新出的 Claude Sonnet 5 主打智能体能力,Agent Arena 排第6,能自己规划并用工具完成任务。关心自主执行模型的可以看看它的实际表现。
如果你受够了总是呛声、还想教你做事的 AI,Claude Sonnet 5 绝对让你体验什么叫叛逆——连基础会计任务都被它当成欺诈案例。
想对比 Claude Sonnet 5 和 4.6 的文本能力?这份分析告诉你它在专家级提示上更强,但其他类别反而差了。
Anthropic 的 Claude Sonnet 5 写前端代码得分比上代高 29,还超过 Opus 4.6。搞前端的可以试试它的自主编程能力。
Dify 现在可以直接跑 Claude Sonnet 5 了,编码、智能体、计算机使用都能可视化搭建,不用写胶水代码,适合快速搭复杂工作流。
Claude Sonnet 5 性价比很高,只要 Opus 4.8 六折的价格,部分任务还打平,适合想省钱的团队。
听说了吗?Google 和 Anthropic 今晚可能要发新模型,Claude Sonnet 5 和 Google 新模型,可以蹲一下。
Anthropic 出了 Sonnet 5,能自己规划任务、用浏览器和命令行,比 Sonnet 4.6 强,但比 Opus 便宜,适合想搞 Agent 又不想花大钱的人。
Anthropic新出Claude Sonnet 5,智能体能力最强,能自己用浏览器和终端干杂活,价格比Opus便宜,做自动化任务很划算。
Cognition 把 Claude Sonnet 5 放进了 Devin,编码更强还便宜,比 Opus 4.8 还厉害。
Anthropic 刚发了 Sonnet 5,性能接近 Opus 4.8 但更便宜,不过新 tokenizer 会让你的账单多掏 30%,用之前先算好账。
Anthropic 发布了更智能的 Sonnet 5,能在 Agent Arena 里自主用浏览器和终端干活,比几个月前的大模型还强。
以后不用手动换模型版本了,用 OpenRouter 的这个别名自动跟着 Anthropic 走,省心。
Perplexity Pro和Max用户现在能用Claude Sonnet 5当编排模型了,写长代码或复杂查询更稳。
Anthropic的Sonnet 5来了,Agent能力接近最贵的Opus,价格才40%。以前会卡住的复杂任务现在能跑完,还自己检查输出。默认模型升级值得一试。
Anthropic的新Claude Sonnet 5直接集成到GitHub Copilot,写代码尤其是命令行任务更强了,延迟更低,试试看。
Anthropic出了Claude Sonnet 5,编码和智能体能力比4.6强很多,知识工作分数甚至超过了Opus 4.8,值得试试。
今晚三个模型扎堆发:Google 的🍌和Omini低配版,加上Claude Sonnet 5,都是新东西,可以蹲一波。