英伟达的新开源模型,30B MoE 但只跑 3B 活跃参数,放在 SageMaker 上直接部署,专为智能体高频调用设计,吞吐量翻 4 倍,适合跑大批量任务的人。
GPT-5.6 大跃升,AI Agent 生态加速
2026年8月18日,GPT-5.6 Sol 在 ARC-AGI-3 上得分从 13.3% 跃升至 38.3%,输出 token 减少约 6 倍。今日 AI 领域三大主题:模型能力突破、Agent 基础设施完善、开发者工具革新。模型方面,NVIDIA Nemotron 3.5 Lightning 以 30B MoE(3B 活跃)登陆 SageMaker,吞吐量提升 4 倍;DeepSeek Harness 以 MIT 许可发布,主打插件化设计。Agent 生态中,LangChain 与 AWS 推出 AgentCore Payments 中间件,实现 API 自动支付;LMArena 新增任务分类与实际成本数据。开发者工具上,Cursor 发布代码托管平台 Origin,支持 AI Agent 并行开发,GitSkills 数据集覆盖约 380 万份 SKILL.md。
模型发布/更新
5 篇OpenAI 的 GPT-5.6 Sol 在 ARC-AGI-3 上分数翻倍还多,token 还省了六倍,看看他们怎么做到的。
OpenAI官方晒了组省钱实测:Hypha AI用GPT-5.6 Luna把文档提取成本降到1/18,准确率还保住98%;RogoAI靠工具调用省了21%输入token。
想知道代码、工作、聊天分别谁最强?Agent Arena 新榜单给出答案:GPT 5.6 和 Claude Opus 5 各领风骚。
产品发布/更新
5 篇华为把毕昇编译器的核心AscendNPU IR开源了,支持Triton,能直接在Ascend 950上写算子,比之前好用多了。
LangChain和AWS搞了个AgentCore Payments,智能体调用付费API时自动付钱,不用你手动处理402,花钱记录还进LangSmith,方便查账。
Cursor 自己做了个 GitHub,叫 Origin,专门给 AI 智能体并行写代码用,速度很猛,现在能从 GitHub 同步仓库先试试。
行业动态
5 篇论文研究
5 篇技巧与观点
5 篇这篇把 Claude Code 的省钱门道讲透了:缓存怎么省、什么时候切模型便宜、哪些命令输出是隐形开销。适合天天用 Claude Code 写代码的人照着调。