7月14日
07:24
05:15
05:15官方一手AWS Machine Learning Blog@Tanvi Girinath
73°
OpenAI 正式发布 GPT-5.6 系列三个模型 Sol、Terra 和 Luna,并已在 Amazon Bedrock 上全面可用。该系列是 OpenAI 迄今最智能的模型家族,针对高性能、安全性和可靠性优化。Amazon Bedrock 提供下一代推理引擎来运行这些模型。用户无需单独部署即可通过 Bedrock 调用 GPT-5.6 系列。
事件专题

推荐理由:OpenAI 最强模型 GPT-5.6 系列直接上架 AWS,现在在 Bedrock 就能用,省去自己部署的麻烦,三个版本各有特色,性能很强。
02:18
02:18官方账号LangChain@LangChainAI
精选
7月14日,LangChain的@bromann与Andrew Wong联合举办Webinar,演示如何构建会展示工作过程的Agent。该Agent实时输出工具调用和推理步骤,并引用Box的可信上下文。目标是消除黑盒猜测,提供有依据的回答。活动面向开发者,强调透明性和可信度。
推荐理由:想学怎么让AI Agent不瞎猜、敢于展示推理过程?LangChain和Box的这场直播正好手把手教,还能看实时工具调用。
02:17
02:17官方账号vLLM@vllm_project
精选
Novita Labs 训练并开源了 DSpark 投机解码器,用于 Kimi-K2.6 和 Kimi-K2.7-Code 模型。DSpark 是 DeepSeek 提出的投机解码方法,能一次性生成整个 token 块。vLLM 从 v0.25.0 版本起原生支持 DSpark。使用该解码器可加快 Kimi 系列的推理速度。
推荐理由:DeepSeek 的 DSpark 投机解码,能让 Kimi-K2.6 和 K2.7-Code 一次生成整块 token,配合 vLLM 0.25.0 原生支持,解码更快。
7月13日
19:33
16:05
16:05官方一手pandaily@contact@pandaily.com (Pandaily)
精选72°
腾讯发布混元Hy3模型,采用295B MoE架构,参数量达295B。该模型在OpenRouter上排名第8,超越了多个竞品。其Agent性能表现强劲,尤其在任务执行和工具调用方面有显著提升。训练流程经过重新设计,重点优化了数据质量和强化学习环节。

推荐理由:腾讯新出的混元Hy3模型,295B参数,Agent能力很强,OpenRouter上排前8,感兴趣可以看看。
11:17
11:17官方账号Together AI@togethercompute
精选
GLM 5.2 模型在 Together AI 平台部署后,在 Artificial Analysis 评测中输出速度和延迟均获得第一名。该评测覆盖多个主流模型,GLM 5.2 在吞吐量和响应时间指标上表现领先。Together AI 通过优化推理栈使模型达到接近实时的生成速度。

推荐理由:GLM 5.2 在 Together AI 上跑出了最快速度和最低延迟,想用低成本跑推理的话可以去试试这个组合。
7月12日
7月11日
16:25
16:25官方账号Greg Brockman@gdb
Box推出新型推理模型Sol,专为复杂推理与数据分析设计。Sol能分析数百页贷款交易文件,自动协调协议、财务、尽职调查和抵押品等材料中的条款。它会标记潜在风险点,并生成一份附带来源引用的分析报告保存至Box。该模型在文档密集型场景中大幅提升效率。
推荐理由:Box出了个叫Sol的模型,能一次读几百页贷款合同,自动比对条款找出矛盾,还帮你出带引用的报告,搞数据分析爽翻了。
11:02
09:31
09:31官方账号Greg Brockman@gdb
OpenAI推出GPT-5.6,重点面向健康智能领域。GPT-5.6系列在整体性能提升的同时降低了成本。其中GPT-5.6 Luna在最高推理设置下超越GPT-5.5,但成本仅为后者的1/25。该模型使更多用户能够使用先进AI。
事件专题

推荐理由:OpenAI的GPT-5.6健康智能版来了,Luna比上一代强还便宜25倍,这波升级很实在。
05:37
05:37官方账号OpenAI@OpenAI
OpenAI 发布 GPT-5.6,聚焦健康智能领域。其中 GPT-5.6 Luna 在最高推理设置下性能超越 GPT-5.5。同时推理成本降低 25 倍。这些改进旨在提升模型质量并降低使用门槛,让更多人能够用上先进模型。
事件专题

推荐理由:OpenAI 新出的 GPT-5.6 Luna 性能比 GPT-5.5 强,还便宜 25 倍,搞健康智能的可以看看。
04:52
04:52官方账号Greg Brockman@gdb
Ethan Knight宣布GPT-5.6 Sol Ultra在64个子智能体协作下,仅用不到1小时就证明了50年未解的Cycle Double Cover Conjecture。该猜想是图论中的经典问题,此前无人能解。团队公开了提示词和完整证明过程,展示了大规模智能体协同推理的潜力。
推荐理由:Sol Ultra刚发布就搞定了困扰数学界50年的猜想,64个AI一起发力,效率惊人。想看看提示词和证明?直接去翻原文。
04:03
04:03官方账号Simon Willison@simonw
GPT-5.6 提供了多种模型和推理努力等级,用户常困惑如何选择。据测试,Sol medium 在编程任务上优于 5.5 xhigh。更高的推理等级(Sol 系列)能带来更佳性能,但会快速消耗限额。开发者正在改进沟通方式。
推荐理由:如果你用 GPT-5.6 写代码,可以试试 Sol medium,比 5.5 xhigh 更好用,别被复杂的选项吓到。
01:02
7月10日
15:51
15:51官方账号Greg Brockman@gdb
78°
GPT-5.6 with Work IQ 已上线微软 Copilot Chat、Cowork、M365 应用、GitHub 和 Foundry。该模型支持多步骤智能体工作、分析与内容创作,带来更强的推理能力和更高质量的输出,同时保持效率。Satya Nadella 在推特上确认了这一集成。
事件专题

推荐理由:GPT-5.6 来了,带着 Work IQ 直接进微软全家桶,Copilot、GitHub 都能用,推理更强还支持多步智能体任务,赶紧试试。
12:19
12:19官方账号arXiv cs.AI@Xinyan Chen, Ziyu Guo, Renrui Zhang, Dongzhi Jiang, Hongsheng Li
OpenCoF 是一个包含 OpenCoF-17K 数据集和 Wan-CoF 模型的推理框架,覆盖 11 个任务家族。在 4 个视频推理基准上,Wan-CoF 相比 Wan2.2-I2V-A14B 基线取得显著提升。模型引入视觉和文本推理 token,分别捕捉低级视觉线索和高级语义先验。实验通过注意力分析探讨了这些 token 在不同深度、去噪步骤、空间和时间上的贡献。
推荐理由:这篇论文用视频帧序列做推理,比传统的思维链更直观。他们把 Wan2.2 模型微调成 Wan-CoF,在多个基准上分数更高,还开源了数据集和代码。