13:03Geek@geekbb精选DeepSeek V4 Pro-0813 发布后,有开发者认为其表现不如预期惊艳,未达到美国一线模型水平。评论指出,小模型如 DeepSeek-V4-Flash、Qwen 27b 和 GLM-5.2 在同尺寸下表现出色,而大模型可能因训练算力不足显得对齐不够。该观点将 V4 Pro 的落差归因于欠训和算力短缺,而非架构缺陷,并预期随着算力增加会逐步改善。AI模型DeepSeekV4 ProGLM6 个信源在谈事件专题推荐理由:DeepSeek V4 Pro 到底行不行?这条推文用公开数据聊了聊它为什么不够惊艳,顺便夸了 Flash 和 GLM-5.2,观点挺实在。原文稍后读已读值得跟进有用关注 DeepSeek
14:22IT之家(博客/媒体)精选智谱宣布其Coding Harness产品ZCode迎来重大升级,新增Goal、Subagents、Remote Control与闲时任务四大功能。官方在自研Z.ai Code Bench中,用GLM-5.2搭配ZCode与Claude Code对比,ZCode在任务整体通过率上高2.39%,检查项通过率低1.22%。ZCode优化了上下文缓存复用,GLM在ZCode中缓存命中率超98%,有效Token量提升约30%。即日起至2026年8月31日,GLM Coding Plan用户可获1.5倍限时额度加成,叠加后整体使用量接近常规额度的1.8倍。闲时任务功能允许用户在低峰时段自动执行任务,不扣减积分。AI产品ZCode智谱GLM推荐理由:智谱给ZCode加了Goal模式,让Agent自己跑完复杂任务,还能手机远程盯着进度。GLM Coding Plan额度今天全重置,还有1.5倍加成,用GLM的开发者可以试试。原文稍后读已读值得跟进有用关注 ZCode
16:09Geek@geekbb精选本机安装多个 AI 编程 Agent(ChatGPT、Claude、GLM、Kimi)时,官方配额余量与 Token 消耗分散在各个界面。Metrik 将这些数据汇总到一个桌面常驻工具中,免去逐个切换查看的麻烦。该项目已开源在 GitHub(keros68/metrik),推文目前有 5 个喜欢与 674 次浏览。AI产品MetrikChatGPTClaude推荐理由:装了多个 AI 编程 Agent 的话,用 Metrik 一个桌面工具就能看所有配额和 token 消耗,不用挨个翻界面了。原文稍后读已读值得跟进有用关注 Metrik
AITOP7月8日 10:58智谱AI GLM-Image:中文AI图像生成领域的破局者智谱AI最近发布的GLM-Image确实在AI图像生成领域投下了一枚重磅炸弹。免费、无水印、中文文本渲染能力强,这三个特点组合在一起,足以让整个行业重新审视中国AI技术的实际进展。 国内AI图像生成工具一直面临着中文文本渲染的难题。Midjourney等国外工具虽然在图像质量上表现优异,但对中文的支持却始终不尽如人意。GLM-Image的出现,似乎正在改变这一现状。GLM
03:20@koltregaskes@koltregaskes精选73°中国正在考虑限制海外访问其最先进的AI模型,涉及开源和闭源模型。官员已与阿里巴巴、字节跳动和Zai团队会面讨论具体限制方案。5月法律专家圆桌提出分级方法:基本开源模型需简单备案,更强模型要预发布检查,高风险模型实施严格国内控制或禁止发布。此举与美国将前沿AI视为受保护资产的做法类似,可能进一步缩小中立条件下可用模型池。受影响模型可能包括Seedance、Qwen、GLM。行业QwenGLMSeedance推荐理由:中国正考虑限制Qwen、GLM等顶级模型海外访问,开发者需关注新规对模型获取的影响。原文稍后读已读值得跟进有用关注 Qwen
03:48Guillermo Rauch@rauchg精选Vercel CEO 引用 8090.ai 的测试:在将 PHP 应用现代化为 Next.js 的任务中,Opus 4.8 搭配 Software Factory 比单独 Opus 4.8 便宜 1.4 倍、快 1.5 倍;换用 GLM 5.2 成本降低 16.4 倍,但速度慢 3 倍。测试为单样本方向性结果,后续将扩大样本量并对比美国开模型。AI模型GLMOpus 4.8Next.js10 个信源在谈事件专题推荐理由:GLM 搭配 8090 的 Software Factory 在代码迁移任务中成本砍到 1/16,虽然慢了点,但省钱效果很直观。原文稍后读已读值得跟进有用关注 GLM
01:24lmarena.ai@lmarena_ai精选Zai_org的GLM系列在Code Arena: Frontend基准上持续增长,GLM-4.6得分1408,GLM-5.2 (Max)达到1595,超越Opus 4.8并逼近Claude Fable 5的1665分。GLM-5.2 (Max)是该实验室最强的编码模型,在HTML/React真实任务上缩小了与前沿实验室的差距。该模型为开源发布。AI模型GLMZai_orgCode Arena推荐理由:Zai_org的GLM-5.2开源模型在前端编码上超过了Opus,离领先的Claude Fable只差一点,值得试试原文稍后读已读值得跟进有用关注 GLM
02:52rohanpaul_ai@rohanpaul_ai精选72°研究发现,大型混合专家(MoE)模型在处理许多简单token时,浪费了约一半的专家计算资源。新提出的ZEDA(零专家自蒸馏适应)框架,通过为路由器添加“零专家”选项,让模型在token不需要复杂处理时直接跳过专家计算。该方法无需重新训练,而是将原MoE模型作为冻结教师,通过自蒸馏学习何时安全跳过计算。在Qwen3-30B-A3B和GLM-4.7-Flash上测试,去除了约50%的专家计算,精度损失极小,实际推理速度提升约20%。这表明计算消耗并不简单跟随任务难度,而是与不确定性相关,为部署MoE模型提供了更经济的方案。论文MoE模型优化推理加速推荐理由:部署MoE模型的团队终于可以省下一半专家计算——ZEDA让Qwen3和GLM等模型自动跳过简单token,推理速度提升20%且几乎不掉精度,做模型推理优化的开发者可以直接参考论文方法。原文稍后读已读值得跟进有用关注 MoE
11:39Tw93@HiTw93精选Kaku 终端发布 V0.11.0 版本,这是一款为 AI 编程设计的快速、开箱即用的终端。新版本增加了对 DeepSeek、GLM、Kimi、Fireworks 等模型的隐藏推理支持,改进了会话恢复和初始化设置体验。同时修复了全屏标签、标题栏拖拽、光标渲染、低 DPI 文本和彩色 emoji 大小等细节问题。AI 流式传输、输入法输入、代理处理和多提供商传输也更加稳定。AI产品AI 编程终端Kaku推荐理由:Kaku 把 AI 作为终端的一等公民,做 AI 编程的开发者可以直接用它替代传统终端,体验更流畅的 AI 交互。原文稍后读已读值得跟进有用关注 AI 编程