OpenAI 一次出了 GPT-6 Sol 和 Luna 两个模型,价格砍半还带新缓存,跑业务任务比 Claude Opus 5 便宜九成,做 API 应用的可以看看。
#推理模型
Anthropic 的新 Opus 5.5 比上一代便宜四成、快三成,写代码和文字水平赶上 Fable 5.1,挑模型时可以对比看看。
小米把 MiMo-V2.6 整套开源了,Pro 在智能体基准上打平 Claude Opus 5,本地跑前沿模型的门槛又降了。
OpenRouter 上新了个隐身模型 Space Bunny Alpha,100 万 token 上下文,能吃视频输入,推理速度还能调,快去试试是什么底子。
Claude Opus 5.5 在 FrontierCode 编程基准上,思考档位调到 med 和 max 成绩差不多,还比 high 高,省钱党可以看下再选档位。
Anthropic 的 Claude Opus 5.5 出来了,编程测试跑赢 Fable 5.1,API 价格还不到对方一半,付费用户限额也变宽了。
Alibaba 在 Apsara 2026 透露 Qwen4 正在训练,后续 Qwen4.5、Qwen5 要做到 5–10T 参数,用 Qwen 的可以关注下节奏。
Claude Opus 5.5 刚出就成了 AINews 的默认模型,OpenAI 的 GPT6 反而被抢了风头,各家还集体降价 40-50%,降价后入手正合适。
OpenAI 把 GPT-6 Astra 的能力塞进了两个更快更便宜的模型,API 价格直接砍半,Genspark 上已经能用了。
一个只会做选择题的模型,100 万次判断才 42 美元,Agent 里几十个判断步骤全靠它省钱省时间,Vercel 上线一天就 13% 付费团队接入了。
一天之内 Opus 5.5、GPT-6 Sol/Luna、Grok 4.7、Mimo v2.6 全来了,Opus 5.5 还降了 40% 成本,这篇帮你梳理各家提升方向和 benchmark。
有人在比 GPT-6-Luna 和 DeepSeek-V4.1-Flash 的实际成本,短上下文选 Luna,272K 以上大输入选 DeepSeek,做 agent 的可以看看怎么省钱。
量化到 2-bit 后模型做数学题会发疯循环?这篇论文用 on-policy 蒸馏把 MATH-500 保留率从 35% 拉到 70%,做端侧部署的可以看看。
OpenAI 一口气发了 GPT-6 Sol 和 Luna 两款新模型,API 价格砍半,Sol 在基准测试里能跟 Claude 旗舰打平,性价比党可以直接上手试试。
Anthropic 出了 Claude Opus 5.5,能力对标 Fable 5.1,价格还降了 40%,写代码的用户可以直接换上试试。
这篇论文挺反常识的:不用任何权重、靠 Mandelbrot 分形坐标做语言决策,延迟只有 7ms 还能跑在单片机上,可以看看它怎么绕开 LLM 的。
GPT 6 Sol 和 Luna 直接砍半价,Benchmark 上比 Opus 5 便宜 10 倍,同天 Claude 也降价了,这波价格战值得看看对比数据。
xAI 的 Grok 4.7 (xHigh) 悄悄上线了,WebDev 排行榜冲到第10,比上一版涨了16分,价格速度还不变,写前端的朋友可以试试。
GPT-6 两个新模型已经在 LMArena 可以测了,评分还没出,想抢先体验可以现在去投票。有人还拿它和 GPT-5.6 同条件跑了对比,token 用量和速度都测了。
OpenAI 把 GPT-6 Astra 的能力下放到了 Sol 和 Luna 两个便宜模型上,API 价格直接砍半,跑批量任务的成本党可以看看。
OpenAI 的 GPT-6 Sol 和 Luna 已悄悄上线 LMArena,现在能免费对比测试,还能开 Agent Mode 玩玩,趁匿名期去投你的票。
OpenAI 把 GPT-6 Astra 的能力下放到了 Sol 和 Luna 两个便宜一半的新模型上,还能在 Agent Arena 里亲手测试投票。
OpenAI 又出新款了,GPT-6 Sol 和 Luna 是 Astra 的省钱版,API 价格直接比 GPT-5.6 便宜一半,跑批量任务的可以看看。
OpenAI 出了个便宜档的 GPT-6 Luna,跑分追平 Claude Opus 5,但只要零头的价格,看重成本的可以去 OpenRouter 试试。
OpenAI 新出的 GPT-6 Sol 和 Luna 上 OpenRouter 了,价格砍半,Sol 输入 2 美元、Luna 只要 0.1 美元每百万 token,跑分还比上一代强。
OpenAI 把 GPT-6 Astra 的能力塞进了 Sol 和 Luna 两个更便宜的型号,API 价格比 GPT-5.6 还砍了一半,跑批量任务的可以看看。
OpenAI 把 GPT-6 Astra 的能力下放到 Sol 和 Luna 两个便宜版本,API 直接砍半价,跑批量任务的成本党可以看看。
Anthropic 新旗舰 Opus 5.5 来了,价格降了 20%,跑得还快 30%,编码能力直接对标 Fable 5.1,写代码的可以试试。
OpenAI 今天一口气发了 GPT-6 Sol 和 Luna 两个模型,付费用户直接在 ChatGPT 和 Codex 里就能用,免费用户也能在桌面端试 Luna。
Anthropic 的新 Opus 5.5 又快又便宜,修 20 万行代码库从 20 小时缩到 3 小时,Agent 用户可以直接换上试试。