8月14日
22:35
7月22日
00:05
7月10日
08:55
08:55AI Engineer@aiDotEngineer
精选
OpenAI宣布模型发布周期缩短至6周一次。GPT 5.6在Cerebras硬件上的推理速度达到750 tokens/s,可在10秒内完成大量代码审查。公司称2025年聚焦“token最大化”,2026年转向“价值最大化”。这一策略变化反映了AI部署从追求吞吐量向实际应用价值的转变。
事件专题

推荐理由:OpenAI调整了模型发布节奏,以后每6周就能看到新版本。GPT 5.6在Cerebras上跑出750 tokens/s的推理速度,10秒就能处理一大波PR。2026年的重点从刷速度变成了追求实际价值。
7月7日
16:53
6月25日
02:24
6月9日
5月30日
06:42
06:42rohanpaul_ai@rohanpaul_ai
88°
Anthropic 在宣布 9650 亿美元估值融资的同一天,发布了 Claude Opus 4.8 模型。KogAI 在 8× AMD MI300X GPU 上实现了 3000 tokens/s 的推理速度,在 8× NVIDIA H200 上达到 2100 tokens/s。Datacurve 推出了更严格的编程基准 DeepSWE,用于区分领先模型。OpenAI 与 Thrive 合作构建了准确率高达 97% 的自我改进税务智能体。
事件专题

推荐理由:Anthropic 估值逼近万亿,Claude Opus 4.8 同日发布,关注前沿模型进展的开发者值得一看。KogAI 的推理速度数据对做推理优化的团队有参考价值。