7月6日
16:26
16:26官方一手pandaily@contact@pandaily.com (Pandaily)
精选
腾讯发布Hunyuan Hy3,一个295B参数的MoE架构模型,其中21B为活跃参数。该模型在Agent任务中达到90%的解决率,超越DeepSeek V4 Pro和Qwen 3.7 Max。它在多个关键基准上表现领先。
事件专题

推荐理由:腾讯新出的Hunyuan Hy3,Agent任务解决率90%,直接超过DeepSeek和Qwen,搞智能体的话一定要看看。
5月27日
11:56
11:56官方一手歸藏(guizang.ai)@op7418
Qwen 3.7 Max 在 Arena Coding Agent 的 Frontend 榜单上排名第四,成为排名最高的中国实验室模型,超越了 GLM-5.1,并与 Claude Opus 4.6 在智能体网页开发任务上持平。这一成绩展示了阿里通义千问在智能体编程领域的强劲实力,对关注 AI 编程和前端开发的团队有重要参考价值。

推荐理由:Qwen 3.7 Max 在智能体编程榜单上超越 GLM-5.1 并追平 Claude Opus 4.6,做前端开发或智能体应用的团队值得关注这一国产模型的进展。
5月25日
10:21
10:21官方一手pandaily@contact@pandaily.com (Pandaily)
83°
阿里巴巴的 Qwen 3.7 Max 模型完成了一次长达 35 小时的自主任务运行,期间执行了 1,158 次工具调用。这一表现展示了模型在长时间、多步骤任务中的持续稳定能力,令海外开发者印象深刻。该成果凸显了 Qwen 系列在复杂自动化场景下的潜力,可能推动更多企业探索 AI 驱动的长周期工作流。

推荐理由:Qwen 3.7 Max 证明了 AI 可以稳定执行 35 小时的长任务,做自动化工作流或复杂项目管理的开发者值得关注,这可能是你寻找的可靠长任务模型。
5月22日
03:55
03:55rohanpaul_ai@rohanpaul_ai
Qwen 3.7 Max 在编程和智能体能力上接近前沿模型,在 Artificial Analysis 排名第五,与 GPT 5.4 (xhigh) 相当,略高于刚发布的 Gemini 3.5 Flash。该模型现已通过 AI/ML API 提供,代理可靠性是其核心亮点。AI/ML API 还为用户提供免费试用码,方便开发者体验。

推荐理由:Qwen 3.7 Max 在编程和智能体能力上逼近 GPT 5.4,做 AI 应用和智能体开发的团队值得试试,尤其是想低成本接近前沿模型的开发者。
5月21日