#OpenAI
一天里 Mistral 放出万亿参数模型,OpenAI 的 Decisions API 快 10 倍,Claude 还能直接嵌进 Google 文档用了,几条都跟开发者钱包有关。
OpenAI 的智能体把 Wikipedia 运维服务打挂了,几十万次请求直接压垮服务器,搞 Agent 开发的人该看看这个教训。
OpenAI 内部 pro 模型干掉了 500 道顶级难题里的 90 道,解 Navier–Stokes 一道要 3 小时,还比 GPT-6 Astra 强,看看细节。
辛顿说模型该像新药一样先过 FDA 式审核才能上市,还提到 OpenAI 因安全问题推迟了 GPT-6.1 Astra,监管思路可以对照看看。
一篇用 SCI 层级理论拆解自动形式化局限的论文,直接指向 OpenAI 的 Navier-Stokes 证明——Lean 验证过了,原文可能还是错的。
Gary Marcus 拆解了 OpenAI 数学成绩背后的门道,说其实靠 Lean 符号验证撑着,顺带回应了关于他的各种争议说法。
Atlassian 把 GPT-6 接进自家的 Rovo,靠 Teamwork Graph 调用公司内部数据,做团队协作的场景可以关注下。
OpenAI 出了个只做判断不做回复的 API,底层是 GPT-6 Luna,比让模型自己写答案快 10 倍,只收输入 token 的钱,做分流、审核这类场景挺实用。
Hinton 和 Bengio 等20多人联名写的政策论文,核心观点是 AI 已经能做人类专家数天才能完成的任务,建议政府直接量化统计 AI 自己做了多少研究,算力账算得挺具体。
Simon Willison 用 GPT-6 Astra 写了个插件,把 OpenAI 新的 Decisions API 接进 llm 命令行,还能对图片做 yes/no 判断,比 Jev 贵但支持图像。
OpenAI 用 AI 生成了 722 个数学证明,还把矩阵乘法的复杂度纪录从 AlphaEvolve 的 n^2.37 压到 n^2.25,附带 Lean 验证,搞数学和算法的可以看看。
Ben Affleck 居然会写 Python、讲得清 CNN 和张量,还靠刷脸进了 Google 和 OpenAI 看视频模型,反差挺大的。
Kevin Weil 在 X 上聊 OpenAI 这次数学方向发布,有人用 GPT 6 Pro 统计近三年数学发现,81% 来自这次放出的 math 仓库,看看吧。
SemiAnalysis 实测了九家 AI 订阅套餐,发现 Claude 在中档模型上价值领先 OpenAI 5 倍,且 OpenAI 刚刚大幅削减了套餐额度。
OpenAI 上线了 Decisions API 公测版,能让应用实时自动选模型和工具,速度比走 Responses API 的 GPT-6 Luna 快 10 倍,做智能路由的可以试试。