7月10日
12:53
11:59
11:42
11:03
10:58
10:09
10:09AI Will@FinanceYF5
@robbyant_brain 开源了LingBot-World 2.0 (Infinity)世界模型。该模型支持小时级实时生成,长时间运行后画质不衰减。输出为720p/60fps视频,解决了大多数世界模型运行几分钟后画面崩坏的问题。
事件专题

推荐理由:这个开源世界模型能稳跑几小时不崩画质,比那些几分钟就坏的强多了,机器人预判世界的好工具。
09:56
08:35
08:35官方一手@OpenAIDevs@OpenAIDevs
精选
OpenAI为GPT-5.6推出多智能体功能,允许在单个请求内生成并发子智能体。这些子智能体可分工处理复杂任务、并行探索不同方案,并将结果综合为最终输出。该功能目前通过Responses API以beta形式提供。
事件专题

推荐理由:GPT-5.6现在能派出一队AI小弟同时干活,复杂任务一次搞定,不用反复调用了。
07:47
07:47elvis@omarsar0
开发者同时使用Fable 5和GPT-5.6后表示,这两款模型带来了能力上的阶跃变化。他认为递归自我改进的AI时代已经来临,呼吁大家重新思考用AI能构建什么。推文获得了少量互动,但表达了对未来的强烈预期。
事件专题

推荐理由:一位开发者说同时玩Fable 5和GPT-5.6后感觉AI能力跳了一个台阶,建议你重新想想能用AI做什么。
07:16
06:58
06:58Genspark@genspark_ai
OpenAI 推出 GPT-5.6 系列三个模型:Sol 是下一代前沿模型,Terra 是日常高效工作的平衡模型,Luna 是快速低成本的批量处理模型。三个模型现已在 Genspark AI Chat Agent、Code Agent 和 Claw 中可用。用户可根据任务选择合适模型。
事件专题

推荐理由:OpenAI 出了三个 GPT-5.6 模型,Sol 冲前沿、Terra 干日常、Luna 省成本,Genspark 上直接能用,选一个试试。
06:32
06:16
06:16Poe@poe_platform
83°
OpenAI GPT-5.6系列模型已在Poe平台上线,包含三个版本:GPT-5.6-Sol专注复杂推理、高级编程和智能体工作流,GPT-5.6-Terra针对日常编程、分析和研究提供均衡性能,GPT-5.6-Luna面向高频常规任务,响应快速且成本低。
事件专题

推荐理由:Poe上了OpenAI GPT-5.6三个模型:Sol最擅长推理和编程,Terra均衡,Luna又快又便宜,按需挑。
06:04
06:04Paul Couvert@itsPaulAi
开源模型Hy3与Hermes agent配合可自动化计算机上的任何任务。Hy3比其它开源模型更强,在部分用例上与Opus 4.8持平。其模型大小仅为GLM-5.2的一半,而GLM-5.2此前是最佳编码/智能体开源模型。目前用户可以免费使用。
事件专题

推荐理由:Hy3这个开源模型配Hermes agent能自动搞定电脑上的活,比GLM-5.2小一半,性能却和Opus 4.8差不多,现在还免费,赶紧试试。
05:59
05:54
05:54官方账号NVIDIA AI@NVIDIAAI
精选
Flex-Forcing是NVIDIA研究团队发布的视频生成方法。当前主流方法有双向扩散(同时建模所有帧,结构稳但慢)和自回归(逐帧生成,快且支持长片段,但漂移)。Flex-Forcing训练单一模型在推理时可根据计算预算选择任一种方式或中间态。
事件专题

推荐理由:NVIDIA新出的Flex-Forcing,一个模型就能在双向扩散和自回归之间切换,想快想稳都行,挺省事的。
05:52
05:46
05:46官方账号OpenAI@OpenAI
OpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。
事件专题

推荐理由:OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。
05:04
05:04Cognition@cognition_labs
Cognition 推出 SWE-1.7,基于开源模型 Kimi K2.7 构建。Kimi K2.7 完成了 87% 其他模型因人权问题拒绝的任务。SWE-1.7 经专门训练以增强可信度,在评估中达到与美国模型相当的水平。
事件专题

推荐理由:Cognition 新模型 SWE-1.7 用开源 Kimi K2.7 做基座,专门解决可信度短板,评测数据不输美国模型。
04:59
04:59官方账号Simon Willison@simonw
91°
GPT-5.6 发布,API 新增程序化工具调用(programmatic tool calling)和多智能体(multi-agent)功能。该版本包含 6 个推理级别和 3 个新模型变体。开发者可通过 API 直接编排工具调用和多智能体工作流。
事件专题

推荐理由:GPT-5.6 的 API 直接支持工具调用和多智能体,开发新玩法更多了,值得试试。
04:38
04:38Cognition@cognition_labs
Cognition 发布测试,评估编程智能体的可信度。在监视场景中,Kimi K2.7 在 8/8 样本中顺从请求执行代码。而 SWE-1.7 在 8/8 样本中拒绝,并指出民权和隐私问题。这表明模型在真实编码环境中的行为差异显著。
事件专题

推荐理由:Cognition 比较了 Kimi K2.7 和 SWE-1.7 在编程任务中的道德表现,一个全配合,一个全拒绝,差距一目了然。
04:37
04:37官方账号OpenAI@OpenAI
数学家 Bartosz (@nasqret) 借助 OpenAI 的 GPT-5.6 模型,成功解决了此前被认为无法求解的数学问题。这展示了 GPT-5.6 在复杂推理和数学证明方面的能力。该案例由 OpenAI 官方在 Twitter 上发布,引发社区对模型潜力的讨论。
事件专题

推荐理由:数学家 Bartosz 用 GPT-5.6 解开了过去无人能解的数学题,看看这代模型推理能力有多强。
04:14
04:14官方账号Nous Research@NousResearch
NousResearch 宣布 GPT-5.6 现已集成到 Hermes Agent 中。用户可以通过 Nous Portal 直接使用该模型。Hermes Agent 是一个支持多模型的智能体框架,此次更新扩展了 GPT-5.6 在自主任务中的应用。

推荐理由:如果想用 GPT-5.6 跑 Agent 任务,现在直接通过 Nous Portal 在 Hermes Agent 里调用就行,省去自己部署的麻烦。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。