阿里智谱同日发新模型,开源AI再提速
2026年8月15日,开源大模型迎来爆发:阿里连续开源Qwen3.8-27B与Qwen3.8-Max,智谱发布GLM-5.3,三者同日亮相。Qwen3.8-27B可在单张Blackwell GPU部署,原生262K上下文可扩展至1M,vLLM/SGLang均Day-0支持;Qwen3.8-Max则以2.4T总参数、95B激活的MoE架构主攻编码与智能体任务。智谱GLM-5.3基于743B基座仅做后训练,Terminal Bench 3.0得分从4.6升至28.3,并发现2,436个真实漏洞。此外,DeepSeek Harness发布20小时获8万Star,其插件系统与AI辅助开发模式引发热议。整体来看,今日焦点是开源模型能力跃升与AI Agent工程化。
模型发布/更新
5 篇这个科学智能体模型能处理多模态数据,397B 版在时间序列预测上很强,还有个 4B 小模型能直接把生物任务分数拉高,适合搞科研的人看看。
Qwen3.8-27B开源了,SGLang当天就能跑,单张5090能到206 tok/s,小模型之王回来了,试试吧。
产品发布/更新
5 篇Qdrant和Minima搞了个agentic RAG,单张RTX PRO 6000就够,首次检索命中率从72%提到87%,延迟从21秒降到7.7秒,效率提升快三倍。
行业动态
5 篇三大EDA巨头在DAC 2026同时亮出智能体方案,Kimi K3已经连续干了48小时芯片设计,中国厂商也在抢这波机会。
论文研究
5 篇如果你在做MoE推理,TEMPO这个调度器在内存/算力瓶颈混合时能比常规方案快15.5%;不过DeepSeek-V3那种通信瓶颈场景它不灵。
技巧与观点
5 篇AWS官方教程,教你用SageMaker AI和Bedrock AgentCore搭多智能体流程,还能拿到token级监控,比Strands Agents默认的细致。
做 Agent 的看看:DeepSeek Harness 把 Prompt 当程序,能力自带 Prompt 指导,分三层作用域,比巨大 system prompt 优雅。
给老博客补标签别硬分类——先让LLM随便编,再用向量嵌入找最接近的现有标签。Simon Willison分享的这套路,比直接要模型选1856个标签里的一个靠谱。