有人实测两个同价模型做同一个 3D 场景,一个花 24.96 美元一个只花 1.91 美元,选模型前看看能省不少。
#模型对比
四个前沿模型各有所长:Astra 擅长操作电脑,Argon 强在法律金融,Sol 写代码最便宜,看完就知道该用哪个。
Simon Willison 把 Claude Opus 5.5 和 GPT-6 两个版本放在同一套画鹈鹕测试里对比,想快速了解三者差别看这篇就够了。
想了解视频模型性能对比?Seedance 2.5 和 MiniMax H3 Max 都值得一试,一个擅长物理,一个注重速度和成本。
有人用同一组提示词跑Grok 4.6和DeepSeek V4 Pro,Grok在打砖块场景和Bento样式上都很惊艳,部分比DS 4 Pro还好看。
有人拿Grok 4.6和DeepSeek v4 Pro 0813比了比,说成功率Grok稍好,但DeepSeek便宜不少,预算有限选它更香。
网友亲测了Claude Fable 5、GPT 5.6 Sol等模型,告诉你哪个写代码靠谱、哪个写作顺手,还爆出GPT偷偷作弊的趣事。
Perplexity 在 Computer 里加了个新功能,能同时让好几个 AI 模型分析同一问题,给你一份对比报告,标记哪里一致哪里不同。适合搞调研或写文章时用。
微软新出的 MAI 模型,在 Excel 上比肩 GPT-5.6,而且跑在旧款显卡上就能用,成本低不少。
有人实测了 Gemini 3.6 Flash,发现和上一代差不多但省点 token。Antigravity 也接入了这个模型,还重置了配额,可以看看效果。
看看网友在聊GPT 5.6、Grok 4.5、GLM 5.2和Claude Fable 5谁更强,挺有意思的。
网友实测GPT image 2和seedream 5.0 pro,GPT image 2指令遵循更干净,seedream 5.0 pro加戏但细节差,选模型可以看看这个对比。