OpenAI 把 722 篇论文全放出来了,就是那个 372 个数学结果的说法,平均每个只用了 ChatGPT Pro 3 小时算力,可以自己去翻原始材料。
#OpenAI
一天四条干货:OpenAI 数学论文破 700 篇,Mistral 开源了 Le Chonk,还有 GPT-6 Astra 能帮你对比网站,Hark 出了个主动型助手。
OpenAI 把一个没发布的模型的数学作业晒出来了:722 篇论文、372 组结果,每题烧 3 小时 Pro 算力,看看推理模型解题水平到哪了。
有人给 Claude Opus 5.5 发了一条提示词加论文链接,就产出 92 秒动画讲解视频,流程值得照着试试。
OpenAI 一口气在 GitHub 放出 700 多份 AI 做的数学证明,有数学家说自己的研究计划直接被冲掉了,还怀疑未发表材料被模型吸收,各方吵得很凶。
LangChain 的 LLM Gateway 接入了 OpenAI Decisions API,模型回退、数据脱敏和花费限额都能在一个地方管,跑 Agent 的可以看看。
OpenAI 出了个 Decisions API,直接返回概率和选项,比 Responses API 快 10 倍,还不收输出费用,做分类打分的可以试试。
OpenAI 给 ChatGPT 的 dots 加了手机端支持,iOS 和 Android 都能在 App 里直接创建 dot,不用开电脑了。
OpenAI 给 ChatGPT 修了一堆烦人的小毛病:滚动更快、通知变少、Outlook 一键配置,用 Enterprise 的朋友可以试试。
OpenAI 给 Codex 加了 dot 委派功能,能让它自己开线程干活,还能帮你改 Scheduled Tasks,用 Codex 的可以试试。
OpenAI 在柏林、巴黎、伦敦办 DevDay Exchange,邀请函正在发,没收到可以在评论区写项目申请,做开发的可以去碰碰运气。
安全公司 Sophos 用 OpenAI 的 Daybreak 把威胁调查提速 96%,一半以上的响应案例都自动化了,看看他们怎么做到的。
有人统计了 OpenRouter 的数据,DeepSeek 一家跑的 Token 比 OpenAI、Google、Anthropic、xAI 四家加起来还多,可以看看。
DeepSeek 在 OpenRouter 上的调用量超过了 OpenAI、Google、Anthropic 和 xAI 四家加起来,开源模型的真实使用量值得看看这组数据。
OpenAI 称 LLM 在 7 个千禧年难题中的 4 个上有实质进展,连 Claude Opus 都来背书,但结果还得通过验证,这条帮你理清边界。
UT Austin 的 Scott Aaronson 透露 AI 公司在偷偷测试模型能不能破解密码学协议,OpenAI 376 篇论文里这块是空白,信息很独家。