想看开发者真金白银在用哪些模型?OpenRouter 这份月度 Token 消耗 Top 10 比跑分更诚实,点开对对你自己的选型。
#模型排名
共 16 条 · 7 天 1 条 · 30 天 2 条
信息流里打上「模型排名」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月6日
OpenRouter 月度 Token 消耗量 Top 10 模型提供商出炉
9月13日
Code Arena WebDev榜单更新:OpenAI GPT-6 Astra领跑,Claude Fable 5.1紧随其后
朋友推荐:Code Arena这个榜单挺有意思,OpenAI的GPT-6 Astra现在分数最高,Claude的Fable 5.1也还不错,看看哪个更适合做前端开发。
8月25日
8月20日
8月17日
Arena周榜:Anthropic多款新模型入榜,kimi-k3-max居国产第一
这周Arena盲测榜变化大,Anthropic新Claude扎堆屠榜,国产kimi-k3-max在代码和前端都紧咬前排,看看具体分数吧。
8月11日
MAI-Image-2.6 升至文生图模型第二名,超越 Nano Banana、Meta 和 Grok
微软新出的文生图模型冲到了全球第二,只比 GPT Image 2 差一点,还超过了 Grok 和 Meta,下周就能用 API 了。
8月7日
7月28日
Kimi K3 (Max) 登顶 Frontend Code Arena,开放权重和整体均第一
Kimi K3 (Max) 在代码和智能体测试中双料夺冠,连 GLM-5.2 都比它低一截,开发者和研究者可以关注这个新标杆。
7月18日
7月9日
6月9日
Grok Build 0.1 和 Grok 4.3 在 Agent Arena 排名第15、17
xAI 的模型在 Agent Arena 中取得不错排名,做智能体开发和自动化任务的团队可以看看 Grok Build 0.1 在 bash 能力上的改进,值得关注其实际任务完成率提升。
6月3日
5月22日