8月11日
22:10
22:10官方账号LangChain@LangChainAI
LangChain 宣布举办一场关于语音智能体评估的网络研讨会。研讨会将涵盖执行、结果和体验三个维度,包括工具使用、任务完成、延迟、中断和对话摩擦等评估指标。活动详情可在 events.langchain.com 查看。

推荐理由:做语音智能体的朋友可以看看,LangChain 这场会讲怎么从执行、结果到体验全面评估,比单看任务完成率更实用。
22:09
22:09LovartAI@lovart_ai
Lovart在X平台展示其与Claude的组合工作流:Claude将产品事实转化为一个主提示词,Lovart据此生成完整电商listing页面。用厨房里3美元的削皮刀做测试,仅凭两张手机照片,无需摄影棚,就生成了能卖30美元的亚马逊商品页。该推文获得27个赞和963次浏览。
推荐理由:做电商的看过来,Claude加Lovart能把手机拍的两张图变成能卖高价的商品页,3美元的东西能包装成30美元,这组合值得试试。
22:04
22:04LlamaIndex@llama_index
精选
LlamaIndex应用研究团队推出ExtractBench,号称最全面的企业复杂文档信息抽取基准。该基准测试了14个系统,包括前沿VLM、编程智能体和抽取API,覆盖370份企业文档、4869页和67种文档类型。评测完全确定性,不使用LLM作为裁判。最大发现是超过50页后,商业VLM的召回率跌破35%,精度虽高但会静默丢失大部分表格行。
事件专题

推荐理由:做文档抽取的团队看过来,LlamaIndex 出了个新基准,测了14个系统在370份企业文档上的表现,发现超过50页商业模型召回率就崩了,赶紧看看你的抽取方案中招没。
22:03
22:03官方账号NVIDIA AI@NVIDIAAI
精选73°
NVIDIA推出Nemotron 3.5 Lightning,一个30B参数的MoE模型,仅激活3B参数。该模型专为常驻智能体设计,可快速完成高并发、专业化任务。其输出速度比同类模型快4倍。模型已开源,适合需要高效推理的场景。
事件专题

推荐理由:NVIDIA出了个30B MoE模型,只激活3B参数,跑得快4倍,适合做常驻智能体,开源可白嫖。
22:02
22:02官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA推出Nemotron 3.5 Lightning,专为长时间运行的智能体工作流优化,覆盖工具调用、结果验证和任务委派等高频执行场景。该模型体积适中,可从DGX Spark到数据中心灵活部署。NVIDIA展示了其在DGX Spark上运行智能体工作流的实例,并提供了技术细节文档。
事件专题

推荐理由:NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。
22:01
22:01官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA发布NeMo Switchyard,一个用于模型路由的开源库。该库允许在智能体工作流中为不同步骤选择不同模型,例如用前沿模型处理复杂推理和规划,用Lightning模型处理高容量、专业化执行。这能优化成本和性能。更多信息见官方链接。
事件专题

推荐理由:NVIDIA出了个新开源库,能让智能体工作流里不同步骤用不同模型,省钱又高效,搞Agent的可以看看。
21:28
20:28
20:28AI产品黄叔@PMbackttfuture
用户发现WorkBuddy疑似内置PPT Skill,授权读取聊天记录和飞书云文档后,快速生成PPT大纲。用户微调后,WorkBuddy输出样式不错的可编辑PPTX文件。全程使用DeepSeek V4 flash模型,积分消耗不到40点。

推荐理由:WorkBuddy能读聊天记录和飞书文档,自动出PPT大纲和成品,全程DeepSeek V4 flash,不到40积分,效率挺高。
20:25
20:25官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里Qwen团队在X平台回应称,Qwen3.6-27B在智能体编码任务中表现强劲。团队确认下一代Qwen3.8-27B将带来更好性能,但未透露具体发布时间。该消息引发社区关注,原推文获得579次点赞和3.2万次浏览。
推荐理由:阿里官方确认Qwen3.8-27B要来了,说会比3.6更强,做智能体编码的可以蹲一波。
20:10
20:10官方账号Decoder@Matthias Bastian
OpenAI为ChatGPT Business客户推出Premium Seats,定价每月125美元,是现有Standard Seats价格的5倍。高级席位提供显著更高的使用容量,并取消五小时使用限制。此举表明AI提供商此前提供的固定费率定价模式难以持续。该消息由The Decoder报道。
事件专题

推荐理由:OpenAI给企业用户加了更贵的套餐,月费125美元,取消时长限制,适合重度用AI的团队看看值不值。
19:29
18:46
18:46官方账号阿里通义 Qwen@Alibaba_Qwen
精选73°
阿里巴巴Qwen团队在X平台确认,Qwen3.8-27B模型的开源权重将于本周发布。该模型属于Qwen3系列,参数规模为27B,采用开放权重形式供开发者使用。团队感谢社区耐心等待,并期待开发者基于该模型进行创新。
推荐理由:阿里这周要放Qwen3.8-27B的开源权重,27B参数,想玩开源模型的可以蹲一下。
17:46
17:46官方账号Decoder@Maximilian Schreiner
72°
Nvidia与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR合作,目标筹集超过5000亿美元用于AI基础设施。为吸引投资者,Nvidia承诺对其自家硬件提供最高25%的残值担保。英国央行已警告,若AI行业受挫可能引发系统性风险。
事件专题

推荐理由:Nvidia为了拉投资,自己给芯片残值兜底25%,联合六大机构搞5000亿美元基建,这操作挺大胆的。
17:32
17:32官方一手歸藏(guizang.ai)@op7418
精选
DeepSeek 注册了名为 Deepseek Harness 的团队公众号,外界猜测其 Agent 产品可能即将发布。该公众号名称中的 Harness 或暗示与智能体开发框架相关。目前官方尚未公布具体产品细节,但此举被视为 DeepSeek 在 Agent 领域布局的信号。

推荐理由:DeepSeek 可能要发 Agent 了,刚注册了 Harness 团队公众号,想抢先看消息的可以关注下。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。