8月12日
00:43
00:43官方账号Microsoft Research@MSFTResearch
精选
微软研究院推出CARE-X,一个结合灵活推理、校准预测和基于测量工具的统一框架,用于胸部X光解读。该框架超越了传统报告生成,旨在提升AI在放射学中的实用性和可靠性。CARE-X通过整合多种能力,可能改善诊断准确性和临床决策支持。相关细节在微软研究院的推文中公布。
推荐理由:微软研究院搞了个CARE-X,把推理、预测和测量工具整合起来做胸片解读,比单纯生成报告更进一步,搞放射AI的可以看看。
8月11日
22:52
22:52官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA 推出 Nemotron 3.5 Lightning 模型,延续开放策略,公开权重、训练数据和配方。该模型已上线 Hugging Face 平台,开发者可自由获取和定制。Nemotron 3.5 Lightning 旨在提供高性能推理能力,适用于多种自然语言处理任务。此次发布进一步巩固了 NVIDIA 在开源模型领域的布局。
事件专题

推荐理由:NVIDIA 把 Nemotron 3.5 Lightning 的权重、数据和配方全开放了,想自己改模型的话直接上 Hugging Face 就能拿,比闭源省事多了。
22:43
22:43OpenRouter@OpenRouterAI
精选
NVIDIA Nemotron 3.5 Lightning已在OpenRouter上线。该模型为30B混合专家架构,仅激活3B参数,由Nemotron 3 Ultra蒸馏而来。它面向高容量、专业化的AI智能体工作负载,相比同类模型吞吐量最高提升4倍,任务完成速度最高快30%。
事件专题

推荐理由:NVIDIA新出的轻量MoE,30B参数只激活3B,跑智能体任务比同类快30%,想省算力可以试试。
22:34
22:34Gary Marcus@GaryMarcus
Gary Marcus在X上发文称,Claude在黎曼猜想上的表现再次证明混合神经符号AI的价值。他指出,如果去掉其中的符号部分,仅靠神经网络无法成功解决该问题。这被视为神经符号AI在数学推理领域的重要验证。

推荐理由:想看AI数学推理到底行不行?Marcus说Claude解黎曼猜想靠的是符号+神经混合,不是纯神经网络。
22:04
22:04LlamaIndex@llama_index
精选
LlamaIndex应用研究团队推出ExtractBench,号称最全面的企业复杂文档信息抽取基准。该基准测试了14个系统,包括前沿VLM、编程智能体和抽取API,覆盖370份企业文档、4869页和67种文档类型。评测完全确定性,不使用LLM作为裁判。最大发现是超过50页后,商业VLM的召回率跌破35%,精度虽高但会静默丢失大部分表格行。
事件专题

推荐理由:做文档抽取的团队看过来,LlamaIndex 出了个新基准,测了14个系统在370份企业文档上的表现,发现超过50页商业模型召回率就崩了,赶紧看看你的抽取方案中招没。
22:03
22:03官方账号NVIDIA AI@NVIDIAAI
精选73°
NVIDIA推出Nemotron 3.5 Lightning,一个30B参数的MoE模型,仅激活3B参数。该模型专为常驻智能体设计,可快速完成高并发、专业化任务。其输出速度比同类模型快4倍。模型已开源,适合需要高效推理的场景。
事件专题

推荐理由:NVIDIA出了个30B MoE模型,只激活3B参数,跑得快4倍,适合做常驻智能体,开源可白嫖。
22:02
22:02官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA推出Nemotron 3.5 Lightning,专为长时间运行的智能体工作流优化,覆盖工具调用、结果验证和任务委派等高频执行场景。该模型体积适中,可从DGX Spark到数据中心灵活部署。NVIDIA展示了其在DGX Spark上运行智能体工作流的实例,并提供了技术细节文档。
事件专题

推荐理由:NVIDIA新出的Nemotron 3.5 Lightning,专门为跑智能体高频调用工具的场景优化,体积小到能在DGX Spark上跑,适合做Agent开发的朋友看看。
20:25
20:25官方账号阿里通义 Qwen@Alibaba_Qwen
精选
阿里Qwen团队在X平台回应称,Qwen3.6-27B在智能体编码任务中表现强劲。团队确认下一代Qwen3.8-27B将带来更好性能,但未透露具体发布时间。该消息引发社区关注,原推文获得579次点赞和3.2万次浏览。
推荐理由:阿里官方确认Qwen3.8-27B要来了,说会比3.6更强,做智能体编码的可以蹲一波。
19:29
18:46
18:46官方账号阿里通义 Qwen@Alibaba_Qwen
精选73°
阿里巴巴Qwen团队在X平台确认,Qwen3.8-27B模型的开源权重将于本周发布。该模型属于Qwen3系列,参数规模为27B,采用开放权重形式供开发者使用。团队感谢社区耐心等待,并期待开发者基于该模型进行创新。
推荐理由:阿里这周要放Qwen3.8-27B的开源权重,27B参数,想玩开源模型的可以蹲一下。
15:55
15:55Hunyuan@TXhunyuan
精选
腾讯混元推出Hy3D WorldClaw,这是一个智能体工作流,能从文本提示生成大规模3D开放世界。生成的场景不是视频或高斯泼溅,而是完全可自由探索的,由可编辑、游戏就绪的3D资产构成,具备高质量几何和纹理。项目页面已上线,展示了该工作流的能力。
推荐理由:腾讯混元这个新工作流能用文字直接生成能走进去的3D世界,不是视频,全是可编辑的游戏资产,做游戏或虚拟场景的可以看看。
07:05
05:37

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。