OpenAI 一次发了两个 GPT-6 模型,价格还砍半,做应用的可以看看 Sol 和 Luna 怎么选
#推理模型
OpenAI 一次发了 GPT-6 Sol 和 Luna 两款新模型,官方说比之前便宜、出错更少,用 Astra 的技术路线做的。
OpenAI 把 GPT-6 Astra 的能力做成了 Sol 和 Luna 两个便宜版,API 价格直接砍半,跑批量任务的可以看看。
OpenAI 放出了 GPT-6 的 Sol 和 Luna 两个版本,对齐能力比 GPT-5.6 更强,想追最新模型动态的可以看看这条。
Anthropic 出了 Opus 5.5,能力追平 Fable 5.1,价格还便宜四成,用 Opus 的可以看看换不换。
Anthropic 把 Opus 5.5 的价格砍了 40%,缓存读取还便宜 60%,跑分追平 Fable 5.1,用 Claude 写代码的可以看看降价幅度。
Cognition 自家的 FrontierCode 榜更新了,Claude Opus 5.5 拿 65.3% 超过 Fable 5,成本还更低,写代码的可以看看。
Anthropic 的新旗舰 Opus 5.5 来了,性能对齐 Fable 5.1,跑起来比 Opus 5 便宜四成,用 Claude 写代码的可以关注下
Anthropic 新发的 Opus 5.5 性能追平 Fable 5.1,还比上代便宜 40%,跑大规模任务的可以看看成本账。
Claude Opus 5.5 上 OpenRouter 了,编程和电脑操作能力超过 Opus 5,1M 上下文还降价 20%,可以试试。
Opus 5.5 来了:比 Opus 5 便宜 40%,输出还快 30%,跑活多的可以留意一下换模型能省多少。
Claude Opus 5.5 发布了,跑分对标 Fable 5.1 还便宜 40%,额度多了 5 小时,写作风格据说改得更自然,可以用起来试试。
Anthropic 的新 Opus 5.5 性能追平 Fable 5.1,还便宜 40%,写文风也终于不再一股 Claude 味了,做应用的可以看看价格。
朋友,有个新模型叫 GraphSkillEvo,它用图结构来优化大语言模型的技能,效果比之前的 SkillOpt 好一些,在 GPT-5.4-nano 上提升了 4.01%。
Yann LeCun(深度学习领域权威)重申观点,说当前 LLM 无法实现人类水平 AI,理由很具体,比如推理能力在 token 空间中实现是有限的,自改进方法只适用于特定领域,跨模态能力通常用单独训练的编码器,还有家用机器人或 L4/L5 自动驾驶汽车这些例子,和现在的情况对比很清晰。
朋友,有个叫 Jev 的模型很厉害,能同时玩 50 局《地铁跑酷》,成本还不到 1 美分,它和大模型不同,是专门负责高速执行,和 Astra、Fable 互补。
TypeSafe AI 新出的 Jev 模型,推理速度比同类 LLM 快 200 倍,成本也低很多,对做代理循环的应该有用。
Bolt 上开源模型首周,开发者选最快 DeepSeek V4.1 Flash,该版本在 Bolt Forge 中上线,使用量是 DeepSeek V4 Pro 的 10 倍。
谷歌 Deepmind 发表观点,说 AI 模型显示思考过程(比如 Chain-of-Thought)对安全有好处,但现在很多模型(比如 GPT-4)正在减少这种透明度。
朋友,TheUnbiasedCo 的 Pareto 模型被 OpenRouter 识别出来了,你可以在 openrouter.ai/unbiased/pareto 用用看,它推理能力很强。