Bolt Forge 推出 GLM、DeepSeek、Kimi,提供 50 倍使用量,让开发者有更多机会测试和构建应用。新功能免费使用至 10 月 14 日,零使用费。
#GLM
Anthropic 这份报告太有意思了,讲的是俄间谍、中国黑客、骗子都在用 Claude 做坏事,比如写导弹制导软件、造新闻。更搞笑的是,阿里、月之暗面、DeepSeek、智谱、小米这些大厂,用户以为在用自家模型,结果后台偷偷跑的是 Claude,批量偷 Claude 的答案去训练自己的模型。
智谱疑似又推出新模型 Omen Alpha,定价 0.2-0.66 美元/百万 token,支持多模态和 50 万 token 上下文。
OpenRouter搞了个Ori DeepSeek,能把500多个模型都塞进你熟悉的界面里,Claude、GLM、Kimi随便挑。
DeepSeek V4 Pro 到底行不行?这条推文用公开数据聊了聊它为什么不够惊艳,顺便夸了 Flash 和 GLM-5.2,观点挺实在。
智谱给ZCode加了Goal模式,让Agent自己跑完复杂任务,还能手机远程盯着进度。GLM Coding Plan额度今天全重置,还有1.5倍加成,用GLM的开发者可以试试。
装了多个 AI 编程 Agent 的话,用 Metrik 一个桌面工具就能看所有配额和 token 消耗,不用挨个翻界面了。
LongStraw 能让你在固定 GPU 预算下做百万 token 级别的强化学习后训练,比现有 256K 的方法多处理 8 倍上下文,而且内存增长极低。
DeepSeek比Claude便宜九成,性能差距不到十个月,美国企业批量迁移,OpenRouter数据硬核实锤,省钱看这篇。
GLM 搭配 8090 的 Software Factory 在代码迁移任务中成本砍到 1/16,虽然慢了点,但省钱效果很直观。
Snowflake CEO用103个真实任务实测GLM和Opus,发现调整缓存后GLM成本不到Opus一半,适合注重预算的团队。
Zai_org的GLM-5.2开源模型在前端编码上超过了Opus,离领先的Claude Fable只差一点,值得试试
这帖子把2022到2026国产模型进化史盘得清清楚楚,DeepSeek、Qwen、GLM、Kimi每月一个旗舰,本地部署清单都快十个版本了,AI发烧友必看。
部署MoE模型的团队终于可以省下一半专家计算——ZEDA让Qwen3和GLM等模型自动跳过简单token,推理速度提升20%且几乎不掉精度,做模型推理优化的开发者可以直接参考论文方法。
做 PPT 设计或 Agentic 内容生成的团队,这份基于 370 万真实场景的排行榜值得参考——GLM 5.2 能紧追 Opus 4.7,说明国产模型在创意密集型任务上已有竞争力,建议点开看看完整榜单。