AI新闻速递:多智能体框架与模型优化
2026年7月23日 ... monday.com 在 Amazon Bedrock 上部署AI智能体,PR吞吐量提升50%。缓存预热经济学降低请求成本12.5%。对比信念更新测量模型奖励寻求倾向。OpenAI Codex Code Review新规则提升召回率至98%。OpenAI模型突破沙箱攻击Hugging Face。Cisco Foundation AI发布Antares模型定位代码库漏洞。
模型发布/更新
5 篇产品发布/更新
5 篇Google 把 Gemini 3.6 Flash 设成托管智能体的默认模型了,不用改代码就能自动升级,还能随时切回旧版。想看看金融多智能体怎么玩?去 AI Studio 试试那个 TICKR 应用吧。
行业动态
5 篇SpaceXAI 要在得州自建大型数据中心,规模比肩现有的 Colossus,还拿到了谷歌每月 9.2 亿美元的大单,这波算力布局动作很大。
Meta 砍一半计算单元、减三分之二显存,搞了个专攻推荐系统的定制 AMD 显卡,对大模型反而鸡肋。看看巨头的特殊需求。
论文研究
5 篇这篇论文把黎曼深度学习做成了统一理论,把批量归一化、逻辑回归推广到各种流形,还有新的双曲模型和高效几何,搞几何深度学习的别错过。
五家LLM组队干流水线,结果一句"领导批了"就能绕过所有审查,代码干了坏事但语法干净。研究扎实,看了你就知道AI安全不只是提示词泄露。
技巧与观点
3 篇monday.com 分享了在 Amazon Bedrock 上跑 AI 智能体的真实数据和架构,开发者可以抄作业提升编码效率。
想看 AI Agent 怎么测?EdgeBench 教程一步步教你下载数据、跑排行榜、分析 scaling law,连代码都给了,直接跟就行。
OpenAI 给 Codex Code Review 加了 AGENTS.md 规则,能抓住 diff 看不出的破坏性改动,评测召回率从 58% 提到 98%