10:38官方一手pandaily@contact@pandaily.com (Pandaily)DeepSeek V4 Flash以7.1万亿token登顶OpenRouter单周全球token使用量榜首。全球使用量前五的模型中四席由中国厂商占据,国产开源模型对闭源巨头的冲击明显。面对这一局面,OpenAI已将GPT-5.6 Luna的定价下调80%。梁文锋在网络上的硬汉表情包成为这轮中国模型出海话题的文化注脚。行业DeepSeek V4 FlashOpenRouterGPT-5.6 Luna10 个信源在谈事件专题推荐理由:看DeepSeek V4 Flash怎么用7.1万亿token把OpenAI价格打下来,国产模型阵营首次霸榜前五。原文稍后读已读值得跟进有用关注 DeepSeek V4 Flash
00:34向阳乔木@vista8Kimi K3 在国产模型排名中登顶,成为当前第一名。这是Kimi团队在模型竞争中的重要成果。K3模型展现了国产模型的最强实力,引发社区广泛关注。AI模型Kimi K3国产模型排行榜10 个信源在谈事件专题推荐理由:Kimi K3 拿下国产模型第一,性能很能打,想了解国产最强模型就看它。原文稍后读已读值得跟进有用关注 Kimi K3
16:07IT之家(博客/媒体)在7月15日金山办公AI生产力大会上,CEO章庆元表示大模型稀缺性降低,各模型能力差距正在缩小,没有绝对壁垒。他透露,公司去年大量使用国外模型,但截至今年6月已全部切换为国产模型。这一决策基于商业判断:模型能力同质化后,选型标准转向稳定性和token量供给。章庆元认为,大模型正演变为类似云服务器的底层基础设施,真正的价值在于应用和工作流。行业金山办公章庆元国产模型推荐理由:金山办公CEO亲口说大模型能力差距在缩小,他们内部已经全用国产模型了,这对企业选模型很有参考价值。原文稍后读已读值得跟进有用关注 金山办公
23:08向阳乔木@vista8部分国产大模型API近期限制了temperature参数的调节范围,引发开发者讨论。有观点认为这可能是为了防止模型蒸馏,即通过固定temperature使输出更确定,增加蒸馏难度。但官方尚未明确原因。该限制影响了开发者对模型输出多样性的控制。行业国产模型APItemperature推荐理由:想调大模型temperature但发现被锁死了?看看这个讨论,可能是为了防止蒸馏,有意思。原文稍后读已读值得跟进有用关注 国产模型
15:59AI Will@FinanceYF5中国顶尖代码模型GLM5.2和Qwen3.7 Max的混合定价约1美元/百万token,而美股同档位SOTA模型定价在4-8美元。高盛测算显示,价值型Agent模型目前EBIT利润率为-30%,代码模型为-39%,企业依靠账上现金扛亏损,预计到2030年才能转正。行业GLM5.2Qwen3.7 Max代码模型推荐理由:GLM5.2和Qwen3.7 Max比美股便宜4-8倍,但还在亏本卖。高盛说代码模型利润率-39%,国内价格战打到2030年才止血,做AI应用的朋友该算算这笔账。原文稍后读已读值得跟进有用关注 GLM5.2
18:24shao__meng@shao__meng推特用户发起国产四个LLM的投票,GLM-5.2以79.7%得票率大幅领先。DeepSeek V4获13.4%,Kimi K2.7为5.2%,MiniMax M3仅1.7%。发起者认为GLM-5.2表现强劲而MiniMax M3得票惨淡。帖子还对比了Gemini 3.5 Flash,认为其性能不佳导致结果明显。行业GLM-5.2DeepSeek V4Kimi K2.7推荐理由:看看社区投票,GLM-5.2碾压式领先,想知道国产模型谁更受认可?结果挺有意思。原文稍后读已读值得跟进有用关注 GLM-5.2
16:18官方一手Pandaily@contact@pandaily.com (Pandaily)美国政府对 Anthropic 的 Claude Fable 5 发出出口管制令,非美国用户被限制访问。这一举措标志着 AI 出口管制进入新阶段,强化了中国发展自主研发 AI 模型的战略必要性。Claude Fable 5 是 Anthropic 于 2025 年发布的最新旗舰模型,此前已引发安全争议。中国国产模型如 DeepSeek、通义千问等被视为替代选择。分析师指出,依赖国外模型存在被切断服务的风险,国产 AI 是保障数据安全与自主可控的关键。行业Claude Fable 5Anthropic出口管制10 个信源在谈事件专题推荐理由:美国突然封锁 Claude Fable 5 对非美国用户,国产模型又成了唯一靠谱的选择。看看这事背后的出口管制新规,就知道为什么中国必须有自己的大模型了。原文稍后读已读值得跟进有用关注 Claude Fable 5
00:40orange.ai@oran_ge用户实测显示,智谱的 glm 5.2 模型在 COLA 基准上表现优于 deepseek 和 mimo,在智商和情商方面都有提升。该模型被评价为国产模型的新高度,但当前版本存在稳定性差和响应缓慢的问题。测试结果基于真实用户反馈,尚未有官方基准数据佐证。AI模型glm 5.2deepseekmimo推荐理由:如果你在找国产模型,glm 5.2 在 COLA 上比 deepseek 和 mimo 强,但别着急用,现在慢还不稳定。原文稍后读已读值得跟进有用关注 glm 5.2
00:36量子位@一水某国产模型在多项关键医疗测评中超过GPT-5.5。这些测评覆盖多个专科方向,准确率指标领先。这表明国产医疗AI在核心性能上已实现突破。AI模型GPT-5.5医疗AI基准测试推荐理由:国产医疗AI终于打败GPT-5.5了,评测成绩很能打,值得关心AI落地的人看一看。原文稍后读已读值得跟进有用关注 GPT-5.5
00:35Geek@geekbb从2022年期待本地运行ChatGPT-3.5,到2026年DeepSeek、Qwen、GLM、Kimi每月发布旗舰模型。本地部署模型列表包括GLM-4、DeepSeek R1/V3、Qwen3、Kimi-K2、GPT-oss-120b、Qwen3.7-Plus、Kimi-K2.7、Deepseek-V4、GLM-5.2等九个版本。迭代速度远超预期,社区感叹没有尽头。行业DeepSeekQwenGLM推荐理由:这帖子把2022到2026国产模型进化史盘得清清楚楚,DeepSeek、Qwen、GLM、Kimi每月一个旗舰,本地部署清单都快十个版本了,AI发烧友必看。原文稍后读已读值得跟进有用关注 DeepSeek
19:26Skywork@Skywork_aiSkywork AI 宣布其 SkyClaw-v1.0 模型自上线以来访问量激增,导致服务拥堵。为保障整体服务稳定,平台临时实施限流措施。但 Skywork Agent 上的 SkyClaw-v1.0 使用不受影响。团队感谢用户理解与支持。AI产品SkyClaw-v1.0Skywork AI限流推荐理由:SkyClaw-v1.0 的火爆说明其能力受认可,但限流可能影响直接 API 调用者。如果你在用 Skywork Agent 或关注国产模型进展,这条值得留意——Agent 端仍可正常使用。原文稍后读已读值得跟进有用关注 SkyClaw-v1.0
19:05岚叔@lufzzliz83°阿里通义千问发布 Qwen3.7-Max,在第三方 Arena 全球大模型盲测总榜中超越 Kimi-K2.6、DeepSeek-v4-pro、GLM-5.1,位列国产第一,与 GPT、Claude、Gemini 最强模型接近。在编程智能体方面,SWE-Pro、SWE-Multilingual 等测评领先,Terminal Bench 2.0 得分 69.7。通用智能体能力显著提升,在 MCP-Atlas、MCP-Mark 等现实测试中创国产新高。新增 preserve_thinking 参数,保留前序思维内容以增强 Agent 决策一致性,减少重复推理 Token 消耗,默认关闭。实测在 Claude Code 下跨框架泛化能力不错,但需要更精准的提示词和多轮迭代。AI模型Qwen3.7-Max国产模型编程智能体2 个信源在谈事件专题推荐理由:Qwen3.7-Max 在多项基准上追平国际顶尖模型,做 Agent 和编程自动化的开发者可以直接拿来替代闭源方案,尤其是 preserve_thinking 参数对长周期任务很有用,值得一试。原文稍后读已读值得跟进有用关注 Qwen3.7-Max