模型多源确认

Next.js 新一期评测:GPT-6 Sol 与 Opus 5.5 同达 97%

We ran fresh Next.js evals. The tally: ① Opus 5.5 [𝟿𝟽%] ② GPT 6 Sol [𝟿𝟽%] ③ Fable 5.1 [...

精选理由

Vercel 又更新 Next.js 评测了,GPT-6 Sol 首秀就并列第一,Grok 4.7 便宜一半到七倍,选模型前可以看看这份榜单。

Vercel 发布新一期 Next.js 评测榜单,GPT-6 Sol 首次上榜即拿下 97% 成功率,与 Claude Opus 5.5、Claude Fable 5.1 并列第一。Grok 4.7 以 94% 排在第四,但价格便宜 2 到 7 倍。在三个 97% 模型中,Opus 5.5 的平均成本最低。完整榜单可在 nextjs.org/evals 查看。

原文 · Guillermo Rauch

We ran fresh Next.js evals. The tally: ① Opus 5.5 [𝟿𝟽%] ② GPT 6 Sol [𝟿𝟽%] ③ Fable 5.1 [...

We ran fresh Next.js evals. The tally: ① Opus 5.5 [𝟿𝟽%] ② GPT 6 Sol [𝟿𝟽%] ③ Fable 5.1 [𝟿𝟽%] ④ Grok 4.7 [𝟿𝟺%] Notably, Grok is 2x-7x cheaper Next.js @nextjs GPT-6 Sol debuts at 97% on Next.js evals, tying the highest success rate. Claude Opus 5.5 also reached 97%, joining Claude Fable 5.1. Opus ranks first among the three on average cost. View the leaderboard ↓ nextjs.org/evals 🔗 View Quoted Tweet 💬 25 🔄 1 ❤️ 104 👀 108083 📊 25 ⚡