8月12日
01:11
00:43
00:43官方账号Microsoft Research@MSFTResearch
精选
微软研究院推出CARE-X,一个结合灵活推理、校准预测和基于测量工具的统一框架,用于胸部X光解读。该框架超越了传统报告生成,旨在提升AI在放射学中的实用性和可靠性。CARE-X通过整合多种能力,可能改善诊断准确性和临床决策支持。相关细节在微软研究院的推文中公布。
推荐理由:微软研究院搞了个CARE-X,把推理、预测和测量工具整合起来做胸片解读,比单纯生成报告更进一步,搞放射AI的可以看看。
00:31
00:31techcrunch@Russell Brandom
83°
Anthropic的一个未发布模型在数学领域最著名的未解问题之一——黎曼猜想上取得了进展。该模型在相关基准测试中表现优于现有模型,尽管未能完全解决猜想,但展示了AI在数学推理方面的潜力。这一成果可能对数学研究产生深远影响。
事件专题

推荐理由:Anthropic的新模型在黎曼猜想上取得了进展,虽然没完全解决,但比预期强,值得看看AI在数学上能走多远。
00:26
00:26官方一手AWS Machine Learning Blog@Koyo Hidaka
精选
ONESTRUCTION在AWS Generative AI Innovation Center的技术支持下,构建了专为建筑和BIM工作流设计的基础模型Ishigaki-IDS。该模型通过合成数据、三阶段训练流程和可验证奖励机制,在Amazon EC2上完成训练。案例展示了在数据稀缺领域如何利用AWS工具链构建领域专用模型。
推荐理由:建筑行业缺数据?看ONESTRUCTION怎么用AWS的合成数据和三阶段训练搞出个专用模型,挺有参考价值。
00:25
00:25官方一手AWS Machine Learning Blog@Avinash Ranganath
First Orion是一家品牌通信公司,将基于脚本的UI测试转向使用Amazon Nova Act的AI驱动QA自动化。他们用自然语言描述测试,替代了维护选择器代码,从而缩短了QA周期时间,释放了工程资源,并更早发现回归问题。
推荐理由:想知道怎么用AI做测试?First Orion用Nova Act把测试从写代码变成说人话,周期缩短还省人力,值得看看。
8月11日
23:58
23:58Weaviate@weaviate_io
精选
Weaviate在Search Mode中引入effort参数,允许用户在medium、high、ultrahigh三档间选择,以权衡输出质量与计算成本。ultrahigh档在BRIGHT基准的5个子集上平均nDCG@10达到X,比medium提升Y,比混合搜索提升Z。该功能旨在让开发者根据应用需求灵活调整推理资源。

推荐理由:Weaviate给搜索模式加了effort档位,想省算力就选medium,要质量就上ultrahigh,BRIGHT基准上提升明显,做RAG的可以试试。
23:34
23:34官方账号Decoder@Matthias Bastian
精选
Nvidia发布开源权重模型Nemotron 3.5 Lightning,仅36亿活跃参数,在智能指数上与OpenAI的gpt-oss-120b持平,但体积小四倍。该模型每秒处理近670个token,是对比中速度最快的模型。Nvidia此举表明其更注重效率而非模型规模。
事件专题

推荐理由:Nvidia新出的开源模型,36亿参数跑得比1200亿的还快,速度拉满,适合追求低延迟的开发者。
22:52
22:52官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA 推出 Nemotron 3.5 Lightning 模型,延续开放策略,公开权重、训练数据和配方。该模型已上线 Hugging Face 平台,开发者可自由获取和定制。Nemotron 3.5 Lightning 旨在提供高性能推理能力,适用于多种自然语言处理任务。此次发布进一步巩固了 NVIDIA 在开源模型领域的布局。
事件专题

推荐理由:NVIDIA 把 Nemotron 3.5 Lightning 的权重、数据和配方全开放了,想自己改模型的话直接上 Hugging Face 就能拿,比闭源省事多了。
22:43
22:43OpenRouter@OpenRouterAI
精选
NVIDIA Nemotron 3.5 Lightning已在OpenRouter上线。该模型为30B混合专家架构,仅激活3B参数,由Nemotron 3 Ultra蒸馏而来。它面向高容量、专业化的AI智能体工作负载,相比同类模型吞吐量最高提升4倍,任务完成速度最高快30%。
事件专题

推荐理由:NVIDIA新出的轻量MoE,30B参数只激活3B,跑智能体任务比同类快30%,想省算力可以试试。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。