Astra 破解十大数学难题,DeepSeek 强势登场
2026年8月2日,AI 领域最大事件是 OpenAI 预告下一代模型 Astra,其内部版本以约 2000 美元成本解决了 10 个十年未解数学难题,包括反驳 Connes 刚性猜想,证明附 Lean 证书。DeepSeek-V4-Flash 正式发布,原生接入 Codex,九项 Agent 测试反超 V4-Pro,输出价格比 Opus 4.8 便宜 89 倍;实测单任务成本仅为 Fable 的 1/105。OpenAI 产品线同步调整:下调 Luna/Terra 价格,GPT-5.6 Sol 推出快速模式(2.5 倍速、2 倍价)。开源生态方面,AMD 发布 Instella-MoE-16B-A3B(总参数 16B 激活 2.8B),华为开源 505B 的 openPangu-2.0-Pro。
模型发布/更新
5 篇产品发布/更新
5 篇OpenAI 把 Luna 和 Terra 降价了,还改了 Codex 和 ChatGPT Work 的计费方式,用起来更划算。
OpenAI给GPT-5.6 Sol加了快速模式,加价2倍就能提速2.5倍,智商不变。老用户带priority标签的请求直接能用。
如果你用 Datasette Agent 做应用,这个版本能让代理自己打开页面跑测试,不用你手动开浏览器检查了。
行业动态
5 篇Gary Marcus 发推怼 OpenAI:别光吹 Astra 万能,连数学行不行都存疑。围观他怎么拆台。
论文研究
3 篇想用AMD显卡跑大模型的可以看看,AMD把16B总参数、2.8B激活的MoE模型全开源了,连训练配置和数据配方都给了。
技巧与观点
5 篇想让你自己训练的Transformer跑得更快?这篇手把手教你用NVIDIA Transformer Engine和FP8,还有代码和GPU跑分对比。
dotey 用实际经验讲清 handoff 和 /compact 怎么选,还给了防偷懒的验收标准,适合用 Codex 做连续任务的。
Boris Cherny说每半年删掉Claude Code的配置和Skills,让Opus 5裸跑,你会发现旧规则反而碍事。
DGX Spark用户别错过,一条命令跑284B的DeepSeek V4 Flash,prefill有1000 tok/s,多智能体也有59 tok/s。