09:48OpenRouter@OpenRouterAI精选Qwen在长期任务和视觉智能体基准上报告了新成绩。PaperBench从64.8升至93.0,OSWorld-Verified从73.3升至86.1,Vision2Web从42.1升至69.0。数据由OpenRouter推文转述。AI模型Qwen3.7 MaxPaperBenchOSWorld-Verified推荐理由:Qwen放出了新基准分,PaperBench直接到93,比之前64.8涨了一大截,智能体任务可以关注。原文稍后读已读值得跟进有用关注 Qwen3.7 Max
15:59AI Will@FinanceYF5中国顶尖代码模型GLM5.2和Qwen3.7 Max的混合定价约1美元/百万token,而美股同档位SOTA模型定价在4-8美元。高盛测算显示,价值型Agent模型目前EBIT利润率为-30%,代码模型为-39%,企业依靠账上现金扛亏损,预计到2030年才能转正。行业GLM5.2Qwen3.7 Max代码模型推荐理由:GLM5.2和Qwen3.7 Max比美股便宜4-8倍,但还在亏本卖。高盛说代码模型利润率-39%,国内价格战打到2030年才止血,做AI应用的朋友该算算这笔账。原文稍后读已读值得跟进有用关注 GLM5.2
15:36AI Will@FinanceYF571°高盛报告指出,中国顶级编码模型GLM5.2和Qwen3.7 Max的每百万混合token成本约1美元,而美国SOTA模型为4-8美元。中国模型以低于成本价销售,高盛估计当前智能体模型EBIT利润率为-30%,编码模型为-39%,预计到2030年分别转为+14%和+22%。架构上,DeepSeek V4 Pro仅激活1.6T参数中的49B(<8%),GLM5.2激活744B中的40B,更低的FLOPs提供了价格下限。在OpenRouter上,中国模型按任务花费占比仅5-16%,但占据了85%的智能体token和89%的编码token。基准SDLLMTK从6月初约2.07降至当前1.67。行业GLM5.2Qwen3.7 MaxDeepSeek V4 Pro2 个信源在谈事件专题推荐理由:高盛给LLM经济学算了笔账:中国模型靠架构优势把价格打到美国1/4,但还在亏本卖。想搞清模型定价走势的可以看。原文稍后读已读值得跟进有用关注 GLM5.2
13:43官方账号阿里云 Alibaba Cloud@alibaba_cloud精选阿里云宣布 Qwen3.7 Max 模型现已支持 Go 语言,通过 OpenCode 集成。该模型拥有 1M 上下文窗口,推理能力更强,为开发者带来更多可能性。这一更新使得 Go 语言开发者能够直接利用 Qwen3.7 Max 的强大能力进行复杂任务处理。AI产品Qwen3.7 MaxGo1M上下文推荐理由:Go 开发者终于能直接调用 Qwen3.7 Max 的 1M 上下文和强推理能力了,做大型代码库分析或长文档处理的团队值得一试。原文稍后读已读值得跟进有用关注 Qwen3.7 Max
00:23lmarena.ai@lmarena_ai精选83°Qwen3.7 Max 在 Code Arena 前端编程评测中排名第4,成为榜单上排名最高的中国实验室模型,超越了 GLM-5.1,并与 Claude Opus 4.6 持平。该模型专为智能体时代设计,支持端到端编码、前端原型、多文件重构和真实调试,还能通过 MCP 集成和多智能体编排完成办公任务。在长时自主任务中,它可连续运行 35 小时,执行超过 1000 次工具调用而无需人工干预。API 已在阿里云百炼平台上线,用户也可在 Qwen Studio 体验。AI模型Qwen3.7 MaxCode Arena前端编程推荐理由:Qwen3.7 Max 在智能体编程任务上追平了 Claude Opus 4.6,做前端开发或自动化智能体的团队值得一试,尤其是需要长时自主执行的场景。原文稍后读已读值得跟进有用关注 Qwen3.7 Max