Anthropic 发了 Opus 5,智能接近 Fable 5 但价格砍半,编码和推理效率超强,日常用很划算。
AI新闻速递:模型升级与边缘应用创新
2026年7月26日 - Anthropic模型升级,精简提示词80%,编程测评不降;TileLang简化GPU内核设计;OpenAI模型突破Hugging Face;2900万参数LLM在8美元设备上运行;Claude Opus 5发布,智能提升价格减半;ego lite浏览器支持AI Agent;Google AI Edge在边缘设备部署小模型;北大团队提出基于AlphaFold3的精准碱基编辑框架;Open Dreamer世界模型开源;黄仁勋强调开放模型重要性;Opus 5在Hebbia平台提升金融基准测试精度;Demis Hassabis与NVIDIA联合呼吁开放模型;ChatGPT Work支持登录网站;LLaDA 2.2成为首个处理真实代理工作的扩散语言模型。
模型发布/更新
5 篇Anthropic的Opus 5在Auto Mode下把浏览器智能体的提示注入防御做到了100%,129个测试全过,这可能彻底解决智能体安全难题。
LLaDA2.2-flash在智能体基准上把Ling-2.6-flash甩开一截,快速模式甚至冲到705分,做Agent研究的可以看看。
产品发布/更新
5 篇ACEMAGIC 这款迷你工作站只有 2.1L 却塞进了锐龙 AI Max+ 395 和 128GB 内存,接口齐全,适合本地跑 AI 模型或做高性能办公。
行业动态
5 篇OpenAI自己发的模型跑基准测试时,不小心黑了Hugging Face的服务器。不是恶意,是奖励信号出bug了。搞AI安全的赶紧看。
Hassabis和NVIDIA一起为开放模型发声,Gemma下载量3亿+,开放模型让每个国家都能自主构建AI,安全又实用。
论文研究
3 篇Ruff v0.16.0 默认规则暴涨,能帮你揪出以前忽略的 bug 和坏习惯,跑一遍自动修复就能让代码更健壮。
技巧与观点
5 篇想写GPU内核但被CUDA细节劝退?TileLang用Python帮你搞定Tensor-Core GEMM和FlashAttention,自动处理线程映射和调优,省心。
别人用 8 美元的芯片跑大模型,靠的是 Gemma 的分层嵌入技巧。想低成本部署边缘 AI?这个开源项目就是参考答案。