7月9日
01:46
01:46官方账号LangChain@LangChainAI
精选
NVIDIA与LangChain联合发布NemoClaw Deep Agents蓝图,包含开放权重模型层Nemotron 3 Ultra,支持领域定制。Deep Agents层提供规划、工具调用、记忆和长时任务处理能力。OpenShell Runtime作为开放运行时,允许用户控制、审计和治理。该蓝图旨在简化智能体应用的构建与部署。
事件专题

推荐理由:NVIDIA和LangChain搞的这个蓝图很实在,Nemotron 3 Ultra开放权重随便微调,智能体框架自带规划、工具、记忆,运行时也开源可审计。
01:42
01:42官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA AI 与 LangChain 联合推出基于 Nemotron 3 Ultra 的 Deep Agents 开源智能体框架。该 agent 在评测中取得 0.86 聚合分数,推理成本仅 4.48 美元。而性能最接近的闭源模型成本为 43.48 美元,实现了 10 倍的成本降低。框架完全开放可定制,开发者可直接使用。
事件专题

推荐理由:NVIDIA 和 LangChain 搞了个开源智能体,用 Nemotron 3 Ultra 跑 Deep Agents,性能比肩闭源但成本只要 4 块多,比最接近的对手便宜 10 倍。搞 AI agent 的值得看看。
01:04
01:01
01:01官方账号LangChain@LangChainAI
精选
LangChain调整了NVIDIA Nemotron 3 Ultra模型的推理框架,在基准测试中获得0.86的聚合分数,成本仅4.48美元。与之性能最接近的模型成本为43.48美元,实现了10倍的成本降低。该优化在保持领先性能的同时大幅降低了推理开销。
事件专题

推荐理由:LangChain让Nemotron 3 Ultra跑分0.86,成本只要4.48刀,比对手便宜近10倍,性价比拉满。
00:34
00:34官方账号Greg Brockman@gdb
OpenAI 的 GPT-5.6-Sol 模型经过两个多月在 Next.js 日常开发中的测试,表现出色。它能理解架构权衡、调查复杂 issue 报告,并在修复 bug 时考虑代码库其他部分。仅需简短提示即可指导,甚至独立完成了 Next.js 服务器的大规模重构(包括测试套件、部署测试)。相关 PR 将在 Next.js 16.3 发布后合并。
事件专题

推荐理由:OpenAI 的 GPT-5.6-Sol 不只是聊天,能直接干复杂编程活了,比如自己重构 Next.js 服务器。想看看模型实际生产力有多强?这篇实测值得看。
00:01
7月8日
23:55
23:55berryxia@berryxia
Seedream 5.0 Pro 现已上线字节云平台,该版本支持精准编辑、可视化复杂信息、渲染逼真图像与肖像。相比前代,它融合了香蕉的替换主体与编辑主题能力,以及类似 Image-GPT-2 的分层编辑功能。用户可通过该模型实现多语言创作下的精细化图像修改。
事件专题

推荐理由:字节云上新了Seedream 5.0 Pro,能做分层编辑和精准图像修改,类似Image-GPT-2的玩法,适合做设计或视觉内容的朋友试试。
23:38
23:36
23:36官方一手歸藏(guizang.ai)@op7418
Seedream 5.0 的图像模型上线,作者测试了几张图,包括生成游戏截图、科普图、UI 设计稿和剧情介绍图。模型支持 2K 分辨率,比 GPT-4o 更高,但文字细节方面,多文字时仍存在模糊问题。整体进步明显,比之前的图像模型提升较大。

推荐理由:Seedream 5.0 图像模型刚上线,能生成 2K 分辨率图片,比 GPT-4o 清晰,但文字多时会糊。想试试新模型可以看看这些例子。
22:33
22:25
22:25量子位@思邈
RoboDojo新基准测试发布,人类表现100分,最强AI模型仅获12.8分。该基准包含200个具身智能任务,覆盖抓取、导航、操作等场景。当前模型在长时序任务和细粒度控制上明显落后于人类。测试揭示了机器人在泛化能力和物理交互方面的核心瓶颈。
推荐理由:RoboDojo这个新基准把人类和模型放到同一考场,人类满分100,最强模型才12.8,差距大到离谱,值得看看模型到底在哪栽跟头。
21:27
21:27Paul Couvert@itsPaulAi
腾讯发布开源模型Hy3,采用295B参数的MoE架构,规模仅为GLM-5.2的一半,但性能与GPT-5.5相当,且优于DeepSeek V4 Pro。该模型在同等参数量级中表现最佳,可媲美万亿级旗舰模型。Hy3提供Apache 2.0许可,免费API开放两周,适合智能体应用场景。
推荐理由:腾讯Hy3开源模型295B参数,比GLM-5.2小一半却和GPT-5.5打平,还超过DeepSeek V4 Pro,免费API两周,智能体应用很香。
20:57
19:31
19:31官方账号Decoder@Maximilian Schreiner
71°
Meta旗下Superintelligence Labs推出首个图像生成模型Muse Image。该模型类似OpenAI的GPT Image 2,能通过代码执行和网页搜索等工具自主优化生成结果。其@-mention功能允许用户基于他人公开的Instagram照片生成图像,无需对方同意。这种opt-out模式可能违反GDPR和欧盟AI法案。技术亮点与隐私争议并存。
事件专题

推荐理由:Meta新出的Muse Image能像GPT Image 2一样调用工具自动改图,但争议点在于它能拿你Insta照片生成别人头像,隐私风险很大。
19:27
19:27Geek@geekbb
精选
Google 发布了 Gemma 4 技术报告,介绍其最新开放权重多模态模型 Gemma 4(E2B–31B)。报告详细说明了架构设计、效率优化和负责任的 AI 方法。此外还涉及无编码器的 12B 变体、量化感知训练以及多 token 预测(MTP)起草器。
推荐理由:Google 刚公开 Gemma 4 的技术细节,包括 31B 多模态模型和 12B 无编码器版本,还有量化训练和 MTP 新招,搞开源模型的可以看看。
18:31
18:19
18:19量子位@思邈
精选
智源研究院提出悟界·Orca方法,改变大模型训练顺序,先让模型学习世界动态变化规律。该方法旨在避免AI直接进入任务执行。相关论文入选Hugging Face论文月榜第一。
推荐理由:智源搞了个新训练法Orca,不让AI一上来就干杂活,先学世界怎么变。论文上了Hugging Face月榜第一,值得看看他们的思路。
17:16
17:04
16:07
16:07官方账号Decoder@Matthias Bastian
91°
OpenAI 将于周四推出 GPT-5.6,此前因美国政府要求额外测试而延迟。该模型代号 Sol,在编码基准上以约一半的成本超越 Anthropic 的 Claude Mythos 5。目前尚无模型审批的绑定标准。
事件专题

推荐理由:OpenAI 的 GPT-5.6 来了,代号 Sol,编码能力比 Claude Mythos 5 强,成本还低一半,值得看看。
14:43
14:43IT之家博客/媒体
71°
马斯克确认 SpaceXAI 将于当地时间 7 月 8 日或 9 日向公众开放 Grok 4.5 模型。该模型基于 1.5T 参数的 V9 基础模型,补充训练中加入了 Cursor 数据。声称对标 Anthropic Opus 级别,速度更快、Token 效率更高、成本更低。
事件专题

推荐理由:马斯克说 SpaceXAI 明天就放 Grok 4.5 了,对标 Opus 还更快更省钱,想尝鲜的可以关注。
14:37
14:22
14:22官方一手歸藏(guizang.ai)@op7418
据社交媒体消息,OpenAI 计划于本周四(预计为北京时间周五凌晨)公开发布 GPT-5.6 模型,同时推出的还有 Sol、Terra 和 Luna 等其他模型。目前全球预览访问正在扩大。该消息尚未获得 OpenAI 官方确认。
事件专题

推荐理由:社交账号爆料 GPT-5.6 本周四发布,还带了 Sol、Terra、Luna 几个新名字,想尝鲜的可以留意官方动态。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。