Deepseek 新出的 V4.1-Flash 模型,参数量 5520 亿,内存占用比之前少四分之三,还比 GPT-5.6 Sol 和 Opus 5 表现好一点,适合做更便宜的 AI 代理。
早读VOL 2026.09.11287 篇
大模型参数量突破万亿,多模态与具身智能成焦点
新加坡·二〇二六年九月十一日 星期五·DAILY · 每早八时
2026年9月11日,AI领域迎来多模态模型参数量突破万亿的关键节点。DeepSeek V4.1-Flash模型以5520亿参数量刷新纪录,阿里Qwen3.8-2.4T-A95B和蚂蚁Ling-3.0-flash-VL等模型也达到万亿级别,推动AI代理成本降低。具身智能方面,Show-Harness系统实现VLM对机器人的零样本控制,AgiBot GE-Act 2.0在机器人技能上取得突破。基础模型应用方面,亚马逊推出通用PII检测工具和前缀感知路由优化SageMaker性能,OpenAI发布Agents API和GPT-Live-1语音代理API,推动多步骤任务和实时对话应用发展。
01
模型发布/更新
3 篇Deepseek 发布 V4.1-Flash 模型,参数量 5520 亿,内存需求减至前代四分之一
DeepSeek V4.1 Flash 模型上线国家超算互联网
DeepSeek 新出的 V4.1 Flash 模型,参数量 552B,用起来比上一代便宜很多,缓存需求也少,适合做 Agent 之类的任务。
IT之家原文
02
产品发布/更新
3 篇OpenAI 推出 Agents API 公测版,支持云端智能体多步骤任务运行
OpenAI 推出了 Agents API 公测版,开发者可以通过 API 调用云端 AI 智能体运行环境,支持多步骤任务运行,还能拆分任务让多个智能体并行处理,挺实用的。
IT之家原文
OpenAI 推出金融服务版 ChatGPT:集成 GPT-6 Astra 内置金融数据与细粒度引用,支持估值模型与研究报告
OpenAI 推出了面向金融服务的 ChatGPT 版本,集成 GPT-6 Astra 和金融数据,能帮你处理财报、做估值模型,比普通版本更专业。
IT之家原文
03
行业动态
3 篇04
论文研究
3 篇05
技巧与观点
3 篇Manual Review Challenges at Scale with LangSmith
Clay discusses LangSmith's challenges scaling manual review, highlighting the shift to online evaluators and insights products. Worth checking out for insights on scaling AI tools.
287今日事件
120一手报道
103新模型
82信源
AITOP · 编辑系统自动生成