14:53宝玉@dotey85°GLM-5.3与GLM-5.2共用同一基座,所有提升来自后训练强化学习。在Terminal Bench 3.0上从4.6分升至28.3分,DeepSWE v1.1从46.2升至66.9。网络安全方面,CyberGym得分84.5%,超过GPT-5.6 Sol的83.6%和Fable 5的83.8%。模型在269个开源项目中发现了2,436个漏洞,其中1,097个为中高危。权重将于两周后公开发布。AI模型GLM-5.3智谱AIZ.ai10 个信源在谈事件专题推荐理由:智谱发了GLM-5.3,编程和找漏洞都超强,开源模型里第一,比GPT-5.6还猛,但权重两周后才公开。原文稍后读已读值得跟进有用关注 GLM-5.3
02:31Philipp Schmid@_philschmid精选3.7 Flash在智能体循环中不再过度急切,而是先进行更多探索。3.7 Flash会先解析错误并运行测试,再修改代码。3.7 Flash的首次通过准确率明显更高,浪费的智能体轮次也更少。AI模型3.7 Flash智能体编程推荐理由:3.7 Flash改代码前先摸清环境、跑测试,少走弯路,能省不少无效循环。原文稍后读已读值得跟进有用关注 3.7 Flash
02:15Sundar Pichai@sundarpichai72°谷歌在3.6 Flash发布仅3周后推出3.7 Flash,重点提升编码和智能体工作能力。3.7 Flash在软件工程、知识工作和网页开发方面均有显著改进,定价为3.6 Flash原始成本的一半。该模型已通过Antigravity、Gemini API、AI Studio等渠道向开发者提供。AI模型Gemini 3.7 FlashGoogle智能体推荐理由:谷歌把3.7 Flash发了,编码和智能体能力比3.6强,价格还砍半,开发者快去试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
17:54AI Will@FinanceYF575°Grok 4.6正式发布,延续4.5的定价策略。新版本在Agent能力和编程任务上有所提升,并能更长时间处理复杂任务。在AA Intelligence Index基准上,Grok 4.6得分追平GPT-5.6 Sol。API价格为每百万输入Token 2美元,输出Token 6美元。AI模型GrokGPT-5.6 Sol智能体推荐理由:Grok 4.6发布,价格不变,Agent和编程更强,AA Intelligence Index追平GPT-5.6 Sol,API输入2美元/百万Token。原文稍后读已读值得跟进有用关注 Grok
10:00Paul Graham@paulgPaul Graham 在 X 上再次提及一个极限案例:超级程序员从零构建新项目,却大量复制现有服务的功能。这条推文有 9 条回复、50 个赞和 8106 次查看。推文发布在 X 平台,Paul Graham 用'once again'强调重复性。行业Paul GrahamX超级程序员推荐理由:Paul Graham 说超级程序员从零复制现有服务的极限案例。8106 次查看,9 条回复,观点很直接。原文稍后读已读值得跟进有用关注 Paul Graham
06:08官方一手marktechpost@Asif RazzaqDeepSeek于2026年7月31日发布DeepSeek-V4-Flash-0731,并同步将V4-Flash API转为公开测试版。该版本基于V4-Flash重新后训练,架构与规模未变。官方模型卡明确这是取代预览版的正式版本。新版在智能体任务与代码生成方面的表现有明显提升。AI模型DeepSeekDeepSeek-V4-Flash-0731智能体推荐理由:DeepSeek把V4-Flash正式版放出来了,智能体和写代码都变强,API也开放公测,可以直接上手试试。原文稍后读已读值得跟进有用关注 DeepSeek
14:50IT之家(博客/媒体)谷歌CEO桑达尔·皮查伊在2026年第二季度财报电话会议上透露,Gemini 4正在训练中,投入大量资源。他承认Gemini 3.5 Pro未按计划在6月发布,且在编程、智能体等领域存在不足,希望Gemini 4能追上前沿水平。9To5Google根据以往节奏预测,Gemini 4有望在2026年11月或12月发布。AI模型Gemini 4谷歌Gemini 3.5 Pro推荐理由:皮查伊亲口确认Gemini 4已经在训练,还坦白承认了Gemini在编程和智能体上的短板,目标年底前补上差距。原文稍后读已读值得跟进有用关注 Gemini 4
09:55宝玉@dotey《Clean Code》作者Bob Martin在X上表示他不阅读AI生成的代码,而是通过设置单元测试、Gherkin测试、QA流程、代码质量指标、变异测试和测试覆盖率等层层约束来确保代码质量。他今年推出了由四个Agent组成的流水线,分别负责需求规格化、编码、重构和架构审查,每个阶段自动化程度递增。他通过检查圈复杂度、模块大小等指标推断代码质量,而非逐行审查。他认为AI时代,写测试、定约束、设指标比读代码和写代码更重要,并在O'Reilly和Clean Coders平台开设相关课程。技巧Uncle Bob MartinClean Code测试驱动开发推荐理由:鲍勃大叔亲授怎么用AI写代码又不看代码,靠测试和指标把关,开发者可以学起来。原文稍后读已读值得跟进有用关注 Uncle Bob Martin
05:07官方账号Google DeepMind@GoogleDeepMindGoogle DeepMind 推出 Gemini 3.5 Flash-Lite。该模型在多个智能体和编程基准上超越了 Gemini 3 Flash。3.5 Flash-Lite 已在 Gemini App 和 Google 搜索中逐步上线,API 同时开放于 Google AI Studio 和 Android Studio。官方公告包含更多详情。AI模型Gemini 3.5 Flash-LiteGemini 3 FlashGoogle DeepMind10 个信源在谈事件专题推荐理由:Google 刚出的 Gemini 3.5 Flash-Lite 在智能体和编程上比 3 Flash 还强,现在 Gemini App 和搜索里就能用,API 也开放了,赶紧试试。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash-Lite
10:48AI Will@FinanceYF5Anthropic CEO Dario Amodei在社交媒体上回应了是否还应学习编程的问题。他认为,AI已经能完成95%的编程工作,但人类做剩下的5%仍能提升20倍生产力。他建议25岁年轻人重点培养批判性思维,因为当AI能生成一切时,辨别真假的能力才最值钱。行业AnthropicDario Amodei编程10 个信源在谈事件专题推荐理由:Anthropic CEO给年轻人的职业建议原文稍后读已读值得跟进有用关注 Anthropic
21:55官方账号Together AI@togethercompute75°DeepSeek V4 Pro在Together AI无服务器平台上发布,具备长上下文推理能力和领先的编程性能。该模型通过KV缓存、前缀重用、混合注意力、批处理、内核优化和端点配置等技术实现高效服务。来自@zhyncs42、@realDanFu等人的深入分析揭示了其技术细节。AI模型推理模型开源/仓库Together AI推荐理由:DeepSeek V4 Pro在长上下文推理和编程任务上的表现达到SOTA,同时其高效服务技术栈的公开分析对AI部署实践有重要参考价值。原文稍后读已读值得跟进有用关注 推理模型