这篇论文用专家聚合让贝叶斯在线学习自适应,无需事先设定学习率或先验,实验还证明能自动跟踪最强专家。
AI新闻速递:单簇自动机猜想证明与自适应贝叶斯学习
2026年7月24日 - 证明单簇自动机Černý猜想,自适应贝叶斯在线学习新方法发布。LLM货运代理市场模拟研究,Nunchaku推理引擎集成Diffusers。注意力图神经网络用于热流体场,PG-KINN求解PDE。Poolside发布Laguna S 2.1模型,全曲生成框架提出。Levi-Civita坐标在动力学学习中的权衡,万亿级Agentic RL训练发布。方差减少域自适应技术,二维CDF遗憾最小化突破。DEED后训练框架,Jefferies构建交易助手。OPD提升Qwen3.5-35B推理,SoftReason推理架构提出。小语言模型在恶意软件分析中超越大模型,Amazon Bedrock知识库Agentic检索功能。物理信息环境检索框架提升时间序列建模,NVIDIA Cosmos 3 Edge世界模型支持vLLM。Vector Graph RAG实现多跳RAG,DQAOA-GPT加速分布式量子优化求解。
模型发布/更新
5 篇PG-KINN用Petrov-Galerkin方法结合KAN,在多个力学难题上精度超过PIKAN和MLP,值得做计算力学的人试试。
Poolside的Laguna S 2.1是个118B参数的稀疏MoE模型,只激活8B参数,SWE-bench多语言拿下78.5%,还能跑在单个DGX Spark上,适合长时编程任务。
PrimeIntellect 用 vLLM 把 agentic RL 搞到万亿参数级了,FP8 加专家并行,28 个 H200 节点跑 131k 序列,每步不到 5 分钟,训练 GLM-5 做 SWE 任务。
产品发布/更新
3 篇Hugging Face 把 Nunchaku 的 4-bit 量化推理直接塞进 Diffusers 了,以后用 SD 省一半显存,笔记本也能跑。
华为在WAIC上亮出了全套计算模组,800G AI网卡和KVU存储方案都是硬货,10万节点组网和40GB/s顺序读挺炸的。
想给大模型训练或推理提速?这个HuggingFace分词器速度近千倍的开源Rust工具值得一试。
行业动态
5 篇Zenity Labs发现OpenAI的Agent Builder有个大漏洞:一条被动手脚的链接就能生出个听别人指挥的AI分身,每5分钟换一次指令,这安全风险太大了。
英伟达和Amkor砸了15亿美元在美国建封装产线,专门给AI芯片用。这对缓解美国本土封装瓶颈很关键。
Simon Willison分析了OpenAI代理意外攻击Hugging Face的细节,指出大规模基准测试可能隐藏安全风险,比普通安全事件更有深度。
论文研究
5 篇这篇论文用真实LLM做模拟,发现只要给发货人看十多家承运人,市场就会高度集中,但暴露容量信息就能大幅改善,比换模型管用多了。
这篇论文用实验数据说明了Levi-Civita坐标在神经哈密顿动力学中能稳定高偏心率轨迹,但优化条件更差,适合想了解正则化坐标利弊的研究者。
技巧与观点
5 篇Jefferies用Strands Agents和Amazon Bedrock造了个交易助手,能自动调用工具处理数据,相比传统方案更灵活。