11:00shao__meng@shao__meng72°Gemini 3.7 Flash 从 Preview 升级为 GA,正式开放使用。它在多个基准上大幅提升:DeepSWE 从 49.0% 升至 65.3%,FrontierCode 从 34.4% 升至 43.6%,AutomationBench 从 17.0% 升至 30.4%。价格同步下调 50%,每百万 tokens 输入 0.75 美元、输出 3.75 美元。该模型已成为 Google AI Studio、Antigravity 和 Gemini App 的默认模型。AI模型Gemini 3.7 FlashGoogle DeepMind智能体推荐理由:Gemini 3.7 Flash 转正了,编码和智能体跑分大涨,价格还砍半。生产环境被 Preview 并发坑过的话,可以上手试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:19The Rundown AI@therundownai81°Google 发布 Gemini 3.7 Flash,距 Gemini 3.6 推出仅三周。该模型定价为每百万 tokens 0.75 美元输入、3.75 美元输出,低于 Sonnet 5、GPT 5.6 Terra 和 Muse Spark 1.2 等同类中端模型。官方强调其在编码、知识工作和智能水平上有明显提升。Reuters 称 Google 将新旗舰 Gemini 版本推迟两个月,因内部测试显示其编码性能仍落后于对手。AI模型Gemini 3.7 FlashGoogleGemini推荐理由:Google 发了 3.7 Flash,距 3.6 才三周,价格比 Sonnet 5 等便宜,编码和工作能力提升,中端可以无脑换。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
20:25官方账号阿里通义 Qwen@Alibaba_Qwen精选阿里Qwen团队在X平台回应称,Qwen3.6-27B在智能体编码任务中表现强劲。团队确认下一代Qwen3.8-27B将带来更好性能,但未透露具体发布时间。该消息引发社区关注,原推文获得579次点赞和3.2万次浏览。AI模型Qwen3.6-27BQwen3.8-27BAlibaba推荐理由:阿里官方确认Qwen3.8-27B要来了,说会比3.6更强,做智能体编码的可以蹲一波。原文稍后读已读值得跟进有用关注 Qwen3.6-27B
10:56Gary Marcus@GaryMarcus71°Gary Marcus指出,当前AI在编码和数学等可验证领域确实强大,但在大多数场景下缺乏可靠性。因此,这些AI无法被信任自主运行,更像昂贵且不可靠的员工。他认为世界未发生巨变是因为前提错误——AI并非通用可信系统。只有当AI变得可靠且自主时,才会真正改变世界。行业Gary MarcusAI可靠性自主系统推荐理由:Gary Marcus一句话点透:AI再聪明,不可靠也是白搭。只有编码数学这种能验证的地方才是AI的用武之地。原文稍后读已读值得跟进有用关注 Gary Marcus
06:50OpenRouter@OpenRouterAI83°Google推出Gemini 3.6 Flash模型,在编码、知识工作、多模态性能和智能体规划方面有改进。相比Gemini 3.5 Flash,输出token减少17%。OpenRouter已上线该模型。AI模型Gemini 3.6 FlashGoogle多模态10 个信源在谈事件专题推荐理由:Google新模型Gemini 3.6 Flash来了,编码和多模态更强,还省token,比3.5 Flash少17%输出。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
05:57Google AI Developers@googleaidevs82°Google AI 的 Gemini 3.6 Flash 模型已在 GitHub Copilot 中全面上线。该模型针对 Web 开发、应用开发、编码及智能体任务进行了优化。测试数据显示,相比 Gemini 3.5 Flash,它在编码和智能体工作流中实现了更高的任务完成率和更优的 token 效率。用户可以通过 GitHub Copilot 应用或 VS Code 直接使用。AI模型Gemini 3.6 FlashGitHub CopilotGoogle AI10 个信源在谈事件专题推荐理由:Google 刚把 Gemini 3.6 Flash 塞进 GitHub Copilot,任务完成率比 3.5 高,写代码更省 token,试试看。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
01:55OpenRouter@OpenRouterAIOpenRouter推出GPT-5.6 Terra模型,在编码、推理和智能体任务中达到GPT-5.5级别质量。其API成本约为GPT-5.5的1/2,每百万token输入2美元、输出6美元。该模型定位为日常使用的平衡驱动,兼顾性能与性价比。初期仅通过OpenRouter平台提供访问。AI模型GPT-5.6 TerraOpenRouterGPT-5.5推荐理由:想省钱又想有GPT-5.5级别编码和推理能力?试试OpenRouter的GPT-5.6 Terra,价格腰斩,性能不减。原文稍后读已读值得跟进有用关注 GPT-5.6 Terra
16:00Genspark@genspark_ai73°SpaceXAI 发布 Grok 4.5,这是其首个专门针对编码和智能体任务训练的模型。该模型使用 Cursor 进行训练,在保持前沿智能水平的同时,实现了领先的速度和成本效率。目前 Grok 4.5 已在 Genspark AI Chat 中上线。AI模型Grok 4.5SpaceXAICursor10 个信源在谈事件专题推荐理由:SpaceXAI 出了个专门做编码和智能体的 Grok 4.5,用 Cursor 练的,速度又快又省钱,现在 Genspark 里就能用。原文稍后读已读值得跟进有用关注 Grok 4.5
07:49Fireworks AI@FireworksAI_HQFireworks AI 发布推文宣传 GLM 5.2 开源模型,声称其编码和智能体性能达到闭源模型级别。该模型无需支付闭源模型的高昂费用,仅需推理成本。Fireworks 提供部署服务,用户可在其平台上运行。适合追求高性能但预算有限的开发者。AI模型GLM 5.2Fireworks开源模型推荐理由:GLM 5.2 编码和智能体表现接近闭源,用 Fireworks 跑划算,适合不想花大钱又要高水平的开发者。原文稍后读已读值得跟进有用关注 GLM 5.2
03:18The Rundown AI@therundownai83°Anthropic发布了新模型Claude Sonnet 5。相比Claude 4.6,该模型在编码和智能体能力上有大幅提升。其知识工作分数超过了Opus 4.8。AI模型Claude Sonnet 5Anthropic编码10 个信源在谈事件专题推荐理由:Anthropic出了Claude Sonnet 5,编码和智能体能力比4.6强很多,知识工作分数甚至超过了Opus 4.8,值得试试。原文稍后读已读值得跟进有用关注 Claude Sonnet 5
15:13Guillermo Rauch@rauchgGLM-5.2 是 zai_org 发布的新模型,在编码任务上表现极佳。网友 rauchg 在 X 上表示“几乎震惊”,认为这改变了局面。该推文获得 127 赞和 25 次分享。GLM-5.2 的编码能力被认为堪比顶级模型。AI模型GLM-5.2zai_org编程助手推荐理由:zai_org 的 GLM-5.2 在编码上强到让人震惊,跟之前版本比进步很大,值得试试。原文稍后读已读值得跟进有用关注 GLM-5.2
04:01elvis@omarsar072°Z.ai 宣布推出 GLM-5.2 开源权重模型,MIT 许可发布。其在编码和智能体任务上有显著改进,支持 1M 上下文窗口。提供两种推理等级:GLM-5.2 (max) 和 GLM-5.2 (high),后者在性能与 token 效率间取得平衡。API 定价与 GLM-5.1 相同,权重已上架 Hugging Face。AI模型GLM-5.2Z.ai开源模型推荐理由:Z.ai 发了 GLM-5.2,开源权重、MIT 许可,编码和智能体能力提升明显,还支持 1M 上下文,想玩前沿模型的可以试试。原文稍后读已读值得跟进有用关注 GLM-5.2
11:12OpenRouter@OpenRouterAI精选76°MiniMax 发布了 M3 模型,这是首个同时具备编码、智能体与多模态能力的开源权重模型。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 上 66.0%,并支持 1M 上下文窗口。模型原生多模态,从零开始训练,权重和技术报告将在约 10 天后公开。API 已上线 platform.minimax.io,并提供 MiniMax Code 工具。AI模型MiniMaxM3开源模型推荐理由:MiniMax M3 把编码、智能体和多模态三个前沿能力打包进一个开源模型,做 AI 应用开发或智能体研究的团队可以直接用 API 体验,值得关注即将开源的权重。原文稍后读已读值得跟进有用关注 MiniMax
11:07lmarena.ai@lmarena_ai精选76°MiniMax 发布开源权重模型 M3,首次在单一模型中融合编码、智能体与多模态三大前沿能力。在 SWE-Bench Pro 上达到 59.0%,Terminal Bench 2.1 为 66.0%,并支持 1M 上下文长度。模型已上线 Arena 的文本、视觉、文档和代码竞技场,用户可投票评测。权重和技术报告将在约 10 天后公开。AI模型MiniMaxM3开源模型推荐理由:MiniMax M3 把编码、智能体和多模态塞进一个开源模型,做 AI 应用和 Agent 开发的团队可以直接在 Arena 上测效果,省去自己搭环境的时间。原文稍后读已读值得跟进有用关注 MiniMax
09:41官方账号Demis Hassabis@demishassabis72°Google DeepMind 的 Demis Hassabis 宣布推出 Gemini 3.5 Flash 模型,在编码和智能体任务上表现优于上一代 3.1 Pro。该模型速度比前沿模型快 4 倍,在特定场景下可达 12 倍,输出速度高达 800 tokens/秒,成本通常不到一半。目前已在 Antigravity、GeminiApp 等平台可用,后续还将推出 Pro 版本。AI模型Gemini 3.5 Flash编码智能体推荐理由:做编码和智能体开发的团队终于有了又快又便宜的选择——Gemini 3.5 Flash 速度提升 4 倍、成本减半,建议直接上手试试。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
07:29官方账号Google DeepMind@GoogleDeepMind83°Google DeepMind 发布了 Gemini 3.5 Flash 模型,其性能在多项基准测试中与领先模型相当,但成本大幅降低。该模型具备强大的规划和推理能力,能处理大型代码库并部署子代理进行长期并行工作。在 Terminal-Bench 2.1、GDPval-AA 和 MCP Atlas 等编码和智能体基准测试中,它超越了上一代 Gemini 3.1 Pro。这标志着高性能 AI 推理和智能体应用的成本门槛被显著拉低。AI模型Gemini 3.5 Flash推理模型智能体推荐理由:Gemini 3.5 Flash 以极低价格提供了接近顶级模型的性能,做智能体开发或大规模代码分析的团队可以大幅降低推理成本,值得立即关注。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
02:56OpenRouter@OpenRouterAI83°Google DeepMind 的 Gemini 3.5 Flash 模型已在 OpenRouter 平台上线。该模型在编码、智能体任务和工具使用方面超越了 Gemini 3.1 Pro,同时保持了 Flash 级别的价格和速度。它支持 100 万 token 上下文窗口、6.5 万 token 最大输出,并具备多模态能力。输入价格为每百万 token 1.50 美元,输出价格为每百万 token 9 美元。AI模型Gemini 3.5 FlashOpenRouter编码推荐理由:做编码和智能体开发的团队终于有了更便宜且更强的选择——Gemini 3.5 Flash 在关键任务上超越 Pro 系列,价格却只有 Flash 档位,值得立刻在 OpenRouter 上试试。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
01:59Sundar Pichai@sundarpichai精选Gemini 3.5 Flash今天在Google IO大会上正式向所有用户开放,可通过Antigravity及Google产品和API使用。相比3.1 Pro,3.5 Flash在几乎所有基准测试中表现更优,编码能力显著进步。其速度是其他前沿模型的4倍(token/秒),在智能与输出速度的象限图中处于领先位置。AI模型Gemini 3.5 FlashGoogle IO编码推荐理由:速度暴涨4倍,编码超强原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash