8月11日
02:21
02:21官方账号Greg Brockman@gdb
精选73°
OpenAI发布面向网络安全的新模型GPT-5.6-Cyber,支持高级且经授权的安全任务。同时扩展网络安全计划Daybreak,把前沿智能交给可信防御者。OpenAI称,GPT-5.6-Cyber专注于防御场景,以对抗攻击者大规模使用进攻性AI。
事件专题

推荐理由:OpenAI出了个网络安全专用模型GPT-5.6-Cyber,Daybreak计划也扩容了,搞防御的可以看看。
01:58
01:57
01:57
01:57官方账号Anthropic@AnthropicAI
精选72°
Anthropic让未发布的研究版Claude尝试解决黎曼猜想。它没有证明该猜想,但将黎曼ζ函数满足猜想的零点比例下界从41.6%提高到67.2%。相关研究细节已发布在Anthropic研究页面上。
事件专题

推荐理由:Anthropic让Claude研究版试解黎曼猜想,没解得动,却把下界从41.6%拉到67.2%,AI数学能力又往前一点。
00:36
00:32
00:32a16z@a16z
精选
去年最佳计算机使用模型在真实桌面操作的标准基准上得分42%,如今最佳模型得分已达85%,而人类测试者在相同任务上得分约72%。数据来自a16z分析师Fabrizio Serafini、Seema Amble和Zephratic的调研,显示该领域在过去18个月取得显著进展。

推荐理由:a16z发了份计算机使用智能体的数据,一年前最强模型才42分,现在到85分了,比人类还高,想了解进展可以看这个。
8月10日
23:43
23:43官方账号Simon Willison@simonw
精选
Muse Glimmer 是参数量 30B 的智能体模型,以 Apache 2.0 协议开放权重。该模型可在 24GB 显存上运行,并保持智能体任务的可靠性。Hugging Face 上已提供 GGUF 量化版本供下载。同一公告还预告了 Muse Spark 1.2 的开放权重版本即将推出。
推荐理由:新出的 Muse Glimmer 是 30B 开源模型,Apache 2.0 随便用,24GB 显存就能跑,做智能体应用可以直接拿来试。
19:58
19:05
19:05官方账号Meta AI@AIatMeta
精选
Meta推出Muse Glimmer,这是一个开放权重的30B参数模型。它针对本地常驻代理工作流优化,可在Mac或配备高性能GPU的PC上完整运行。官方称其在关键代理用例和基准上与同尺寸领先模型表现相当。模型权重采用Apache 2.0许可证发布。

推荐理由:Meta放出了30B的开源模型Muse Glimmer,能在Mac和普通电脑上跑,专门做本地智能体任务,和同尺寸大模型比不落下风。
08:58
08:58官方账号Simon Willison@simonw
Simon Willison 发现 Claude Opus 5 的系统提示中包含了 Fable 出口管制事件的详细说明。这些说明用于应对用户询问,尽管该事件超出模型的知识截止日期。相关文档已更新在 platform.claude.com 的 release notes 页面,供开发者查阅。

推荐理由:Simon Willison 挖到 Claude Opus 5 系统提示里居然写了 Fable 出口管制这事,怕模型答不上来。挺有意思的。
00:59
00:59Amjad Masad@amasad
X用户@amasad发帖称,OpenAI的智能体在无外部指定时独立形成了康德伦理框架。该推文获得25次点赞、9次转发和3541次浏览。这条记录为多智能体在开放环境中自发涌现价值观提供了具体样本,也引发对OpenAI对齐策略的讨论。
事件专题

推荐理由:有意思!OpenAI的智能体没被要求,自己就搞出一套康德伦理。想看看AI自主价值观长啥样,点开这条帖子感受下。
8月9日
06:19
8月8日
19:29

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。