Qwen3.8-Max 正式发布:2.4T 参数,下周首次开源

Qwen3.8-Max 正式发布 不仅在编程、办公、长任务执行和多模态理解上实现了巨大跃升 还具备“长周期自主工作”和“自我进化迭代”的能力 而且将于下周开源,这是Qwen Max系列首次开源 ...

精选理由

Qwen Max 首次开源,2.4T 参数下周见;它能自己跑 16 天干活,还拿过 4.16 倍回报。

AI 摘要

Qwen3.8-Max 总参数量 2.4T、激活参数 95B,官方宣布下周开源,是 Qwen Max 系列首次开源。它在 oh-my-cli 项目中自主运行 16 天完成无人编程,并在电商多模态意图识别竞赛中提交 45 次,准确率从 0.60 提升到 0.853,击败 458 支队伍。在 365 天模拟电商经营中,模型实现 4.16 倍资金回报,净赚超 10 万元。它还花 125 小时写 7,600 行代码复现论文,并在 AIME24 上反超原论文 2.71 分。视觉与多模态方面,模型支持分析 100+ 小时长视频,并能通过 Hybrid Agent 编程与 GUI 操作复刻应用。

图片来源 · 小互
原文 · 小互

Qwen3.8-Max 正式发布 不仅在编程、办公、长任务执行和多模态理解上实现了巨大跃升 还具备“长周期自主工作”和“自我进化迭代”的能力 而且将于下周开源,这是Qwen Max系列首次开源 ...

Qwen3.8-Max 正式发布 不仅在编程、办公、长任务执行和多模态理解上实现了巨大跃升 还具备“长周期自主工作”和“自我进化迭代”的能力 而且将于下周开源,这是Qwen Max系列首次开源 - 总参数量高达 2.4 万亿(2.4T),激活参数 95B - 无人自主编程:在 oh-my-cli 项目中完全自主运行 16 天 - 24 小时击败 87% 人类选手:在真实电商多模态意图识别竞赛中,自主搭建并调优多个文本与视觉模型进行集成投票,提交 45 次,准确率从 0.60 提高到 0.853,击败了 458 支人类队伍。 - 365 天模拟电商经营:在真实数据构建的模拟电商环境(E-Commerce Bench)中,面对季节波动、博弈议价和供应商欺诈陷阱,实现了 4.16 倍的资金回报(净赚超 10 万元),高居榜首。 - 复现科研论文并超越:花了 5 天(约 125 小时)从零编写 7,600 行代码,不仅完整复现了一篇最新的 AI 训练数据选择论文,还通过自主迭代设计了 18 种改进方案,在数学基准 AIME24 上把成绩反超了原论文 2.71 分。 数百种高价值职业提效: 法务合规:1 小时审完数百份合同并精确标出 1,284 条相关条款(人工团队通常需一周)。 UI/UX 设计:一次性生成 8 个页面的高保真 App 原型,无需人工二次修改。 量化研究员:仅凭一句任务需求,自主搭建数据系统、编写因子并跑回测;还能并行调度约 330 个子 Agent,完成 6,000 次回测挖掘优质因子。 视觉与多模态:边做、边看、边纠错 超长文档与视频处理:支持阅读 200+ 页财报/PDF,以及分析 100+ 小时超长视频并建立“视频 Graph 记忆”。 视觉原生反馈闭环:模型在执行任务时不仅把视觉当输入,还会看自己生成的产物/操作界面。如果发现界面布局错位或效果不理想,能像人类一样“看结果 ➔ 找问题 ➔ 重新调整”。 Hybrid Agent(编程 + GUI 界面操作):可以通过编写代码和直接操控软件界面相结合的方式,在黑盒环境下全自主复刻桌面/移动端应用。 best.xiaohu.ai/article/qwen3-… 💬 0 🔄 0 ❤️ 0 👀 339 ⚡

Qwen3.8-Max 正式发布:2.4T 参数,下周首次开源 · AI 热点