这个新方法LiL-Q用凸优化替代了PINNs的非凸训练,收敛快、参数少,在Navier-Stokes等难题上效果拔群,值得关注。
具身AI大爆发,高效Transformer新突破
2026年6月17日,AI领域呈现三大亮点:具身智能迎来里程碑,阿里Qwen推出机器人基础模型套件(RobotManip、RobotWorld、RobotNav),NVIDIA发布ENPIRE系统实现自主机器人循环,成功率高达99%;高效Transformer技术持续演进,xFormers教程展示Packed Sequences、GQA、ALiBi等内存优化方法;大模型预训练发现缩小初始化尺度可持续改善性能,为训练提供新思路。
模型发布/更新
5 篇阿里Qwen团队这个机器人模型用开源数据和人类演示就能学,跨平台零样本操作,还在多个测试里碾压了π0.5,做机器人开发的别错过。
DecoSearch不用训练就能把自然语言转SQL,在BIRD和Spider上准确率分别超70%和88%,比同类方法省十倍token。想提升SQL生成效率可以看看。
产品发布/更新
5 篇Exa Agent 把搜索和模型打包成一个 API,成本比 GPT-5.5 低一半,适合做深度调研和名单构建。
Snap 终于出了给普通人用的 AR 眼镜,不用连手机或电脑就能独立跑,还带 AI 助手帮你识别东西,2195 美元虽然贵但体验很独特。
Copilot Cowork 终于上线了,微软还打算用 DeepSeek V4 当廉价模型,按用量收费,做 Agent 的可以看看怎么降本。
行业动态
5 篇英伟达和Coherent要在得州建厂扩产光互连,用磷化铟晶圆让AI机架间光速传数据,黄仁勋还说了句话挺有信息量,这篇讲得具体。
Anthropic 听取了开发者意见,暂停了 Claude Agent SDK 的 Token 计费变更,避免了成本飙升。如果你在用这个 SDK,现在可以松口气了。
论文研究
5 篇这篇论文解释了为啥RoPE比Sinusoidal位置编码更受青睐——它减少了参数空间的对称性,让Transformer表达力更强。如果你好奇背后的理论,值得一看。
技巧与观点
3 篇手把手教你用xFormers做内存优化,打包序列、GQA、ALiBi、SwiGLU全都有,比标准实现省显存还快。
AWS 出了个新 API,能在智能体对话流程里随时加安全检查,不用提前配规则,挺实用。