07:32IT之家(博客/媒体)76°谷歌于当地时间 8 月 13 日推出 Gemini 3.7 Flash 模型,专为编程与 Agents 场景打造,距离 3.6 Flash 发布仅约三周。该版本在软件工程、知识工作及网页开发工作流方面大幅提升,输入价格降至每百万 Token 0.75 美元,输出价格降至每百万 Token 3.75 美元。即日起,Gemini Spark 面向 160 多个国家和地区的 Google AI Pro 及 Ultra 订阅用户接入该模型,并新增针对 CBRN 与网络攻击滥用场景的安全防御机制。AI模型Gemini 3.7 Flash谷歌智能体推荐理由:谷歌把 Gemini 3.7 Flash 价格砍到 3.6 的一半,编程和智能体场景变强了,还直接给 Spark 用上,搞开发可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
07:05IT之家(博客/媒体)78°OpenAI 以预览形式推出 GPT-5.6 Sol 的 Ultrafast 模式,由 Cerebras 提供支持,输出速度达到标准处理的 14 倍,最高每秒输出 750 个词元。该模式针对事故响应、金融研究、客服语音、电商问答等实时性要求高的场景。目前仅向一小批客户开放,早期测试将用于判断速度提升在哪些环节价值最大。AI模型OpenAIGPT-5.6 SolCerebras5 个信源在谈事件专题推荐理由:OpenAI 给最强模型 GPT-5.6 Sol 上了个超快模式,每秒能出 750 个词元,比原来快 14 倍,适合客服、金融这些要抢时间的活儿。原文稍后读已读值得跟进有用关注 OpenAI
06:44OpenRouter@OpenRouterAI精选OpenRouter 新增代码检索模型 Voyage Code 4,由 VoyageAI 与 MongoDB 联合推出。该模型支持 Matryoshka 嵌入,可在 256、512、1024、2048 四种维度间灵活切换。同时提供多种量化选项,帮助开发者降低存储与计算成本。开发者可直接在 OpenRouter 平台上调用该模型。AI模型OpenRouterVoyage Code 4VoyageAI推荐理由:写代码的智能体要检索代码库?OpenRouter 上新了 Voyage Code 4,四档嵌入维度可调,还有量化选项,省资源又灵活。原文稍后读已读值得跟进有用关注 OpenRouter
06:06Replicate@replicateMinimax 旗下的 Hailuo AI 推出最新视频模型 H3,现已上线 Replicate 平台。H3 针对参考图生成和视频编辑场景做了专门调优,支持对话式交互和视频延长功能。用户可通过 Replicate 直接调用该模型进行创作和二次编辑。AI模型Hailuo AIMinimaxH3推荐理由:海螺AI的H3模型上线Replicate了,支持参考图创作和视频编辑,还能加长视频,做视频的可以试试。原文稍后读已读值得跟进有用关注 Hailuo AI
05:42Hailuo AI@Hailuo_AI精选76°MiniMax 正式发布新一代开源权重音乐模型 MiniMax-Music3。该模型定位生产级(production-ready),可用于多种音乐生成场景。官方称其为 SOTA 级开源音乐模型。权重开放,开发者可自行部署和微调。AI模型MiniMaxMusic3开源模型推荐理由:MiniMax 把音乐模型开源了,叫 Music3,号称开源里最强,能直接生成各种风格的音乐,适合想做 AI 音乐应用的人。原文稍后读已读值得跟进有用关注 MiniMax
05:19techcrunch@Russell BrandomWriter 发布了基于 Z.ai 开源模型 GLM-5.2 的后训练新模型。新系统(基于 GLM-5.2)宣称以更低价格提供部署就绪能力,并升级 harness 控制 token 成本。Writer 表示,该模型延续了 GLM-5.2 的开源生态优势。AI模型WriterGLM-5.2Z.ai推荐理由:Writer 出了新模型,基于 GLM-5.2 改的,价格更低还升级工具省 token 成本,适合想省钱的开发者。原文稍后读已读值得跟进有用关注 Writer
05:17Poe@poe_platform72°Gemini 3.7 Flash 已在 Poe 平台上线。这是 Google 推出的高频工作模型,主打快速推理,覆盖编程与智能体场景。其上下文窗口为 1M token,可处理文本、图像、音频和视频。Poe 用户现在即可直接体验。AI模型Gemini 3.7 FlashPoeGoogle推荐理由:Google 的 Gemini 3.7 Flash 上 Poe 了,1M 上下文,跑代码和 Agent 都快,想试就去 Poe 找。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
04:41GitHub@github76°Gemini 3.7 Flash 现已在 GitHub Copilot 中全面可用,覆盖 Copilot 应用、CLI 和 VS Code。早期测试显示它在 Web 和 App 开发及智能体编码工作流上有所提升。它还改进了代码质量、最终输出呈现、代码库研究和复杂任务验证。开发者可直接在 GitHub Copilot 中试用。AI模型Gemini 3.7 FlashGitHub CopilotGoogleAI推荐理由:Google 的 Gemini 3.7 Flash 上线 GitHub Copilot 了,写代码和智能体任务都有改善,在 Copilot 里就能直接用。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
04:02Philipp Schmid@_philschmid78°谷歌发布Gemini 3.7 Flash,在Zapier的AutomationBench基准上拿下30%得分,成为首个突破30%的模型。三周前Gemini 3.6 Flash得分19.8%,这次每任务成本仅增加3美分。在营销、财务、销售、支持四个领域表现领先,其中营销38%、财务37.5%。但在运营领域仍落后,Opus 5以50%保持领先。AI模型Gemini 3.7 FlashAutomationBenchZapier推荐理由:谷歌突袭发布Gemini 3.7 Flash,AutomationBench拿到30%,比贵一倍的模型还强。做智能体自动化任务可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:55Aravind Srinivas@AravSrinivas75°xAI发布的新模型Grok 4.6现已集成到Perplexity和Perplexity Computer,面向Pro和Max用户开放。Perplexity在WANDR基准上使用Perplexity Computer harness测试其作为协调器的表现,结果显示Grok 4.6位于性能与成本的帕累托前沿。在WANDR上,Grok 4.6匹配Fable 5的结果,但成本降低超过60%。AI模型Grok 4.6PerplexityxAI推荐理由:Perplexity官推宣布Grok 4.6上线,当协调器用,效果追平Fable 5,成本却低六成,Pro和Max用户直接能用。原文稍后读已读值得跟进有用关注 Grok 4.6
03:53Aravind Srinivas@AravSrinivas83°谷歌在3.6 Flash发布三周后推出Gemini 3.7 Flash。新版本在编码和智能体任务上进步明显,软件工程、知识工作与网页开发均有提升。其首发价格为3.6 Flash原价的一半。模型现已通过Gemini API、Google AI Studio与Antigravity开放使用。AI模型Gemini 3.7 Flash谷歌智能体推荐理由:谷歌新出的3.7 Flash只要3.6一半价格,编码和智能体更强,适合做子智能体跑任务。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:41Varun Mohan@_mohansolo71°Google Antigravity 正式上线 Gemini 3.7 Flash。这是谷歌面向编程和智能体场景的最新主力模型,API 成本降至原先一半。官方称其为 Antigravity 迄今最智能的实用型模型。用户升级或下载 Antigravity 应用即可使用。AI模型Gemini 3.7 FlashGoogle Antigravity编程助手推荐理由:谷歌的Gemini3.7Flash上了Antigravity,编程和智能体更强,API便宜一半,试下。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:39Paul Couvert@itsPaulAi83°谷歌发布Gemini 3.7 Flash,被评价为该智能水平上最高效的模型之一。它的性能优于Sonnet 5、GPT-5.6 Terra和Muse Spark 1.2。价格仅为Gemini 3.6 Flash的一半,优惠至少持续到年底。目前已在AI Studio和Antigravity平台上线。只有GPT-5.6 Luna Max在效率上更胜一筹,但它不擅长前端任务。AI模型Gemini 3.7 FlashGoogleSonnet 5推荐理由:谷歌新发的Gemini 3.7 Flash,效率比Sonnet 5高,价格只有3.6 Flash一半,现在AI Studio就能玩。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:28官方账号Simon Willison@simonw精选Google DeepMind 发布 Gemini 3.7 Flash,官方称其在调试、问题解决等编码任务上较 3.6 Flash 有明显提升。该模型能用更少提示词设计更实用的网页布局和应用,并在真实业务工作流中提供更好的推理和准确性。API 已上线 Google AI Studio 和 Android Studio,Pro/Ultra 用户可在 Gemini App 中使用。不过 3.7 Flash 的“入门定价”计划于 2026 年 12 月 31 日翻倍,发布者认为五个月后该模型可能已过时。AI模型Gemini 3.7 FlashGoogle DeepMind3.6 Flash推荐理由:3.7 Flash 刚出,定价却预告明年翻倍,有点怪。想试试新模型的可以看看它比 3.6 强在哪。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
03:23官方账号xAI@xai精选76°Grok 4.6 已上线 Pi 平台。该版本面向长时间运行的智能体任务,编码、知识工作和视觉能力有所提升。定价为输入每百万 tokens 2 美元,输出每百万 tokens 6 美元。用户刷新模型目录即可选用。AI模型Grok 4.6PixAI推荐理由:Pi 上现在能直接用 Grok 4.6,跑长任务智能体更稳,编码和视觉也比之前强,价格也公布了。原文稍后读已读值得跟进有用关注 Grok 4.6
03:02lmarena.ai@lmarena_ai精选Gemini 3.7 Flash (High) 在 Text Arena 中以1490分排名第9,较前代 Gemini 3.6 Flash (High) 的第16位明显提升。分项中创意写作从第12升至第3,数学从第7升至第4,指令跟随从第17升至第9,多轮对话从第21升至第10。其得分与 Qwen-3.8 (Max) 的1491分、Claude Opus 5 (Max) 的1493分几乎持平。AI模型Gemini 3.7 FlashText ArenaQwen-3.8推荐理由:Gemini 3.7 Flash在Text Arena冲到第9,创意写作第3,数学第4,跟Qwen-3.8和Claude Opus 5只差几分。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:57官方账号Perplexity@perplexity_aiGrok 4.6 已在 Perplexity 和 Perplexity Computer 上线。该模型在 WANDR 基准上位于性能和效率的帕累托前沿。相比 Fable 5,Grok 4.6 在结果持平的情况下成本降低超过 60%。用户现在即可在 Perplexity 生态中直接使用 Grok 4.6。AI模型Grok 4.6PerplexityWANDR6 个信源在谈事件专题推荐理由:Grok 4.6 上线 Perplexity 了,在 WANDR 上跟 Fable 5 结果持平,成本还低 60% 以上。原文稍后读已读值得跟进有用关注 Grok 4.6
02:49官方账号Decoder@Matthias Bastian71°谷歌在 3.6 Flash 发布仅三周后推出 Gemini 3.7 Flash,定位为编码和 AI 智能体场景的旗舰工作模型。官方基准显示,Gemini 3.7 Flash 在编码任务上超过 Claude Sonnet 5 和 GPT-5.6 Terra,而价格仅为两者的一半。新模型的价格也比三周前的 Gemini 3.6 Flash 低 50%。AI模型Gemini 3.7 FlashGoogleClaude Sonnet 5推荐理由:谷歌新出的 Gemini 3.7 Flash,编码和智能体能力更强,价格比 3.6 又砍半,还比 Claude 和 GPT 便宜一半,拿来写代码试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:47lmarena.ai@lmarena_ai精选Agent Arena完整排行榜详情已在官网公开,页面地址为arena.ai/leaderboard。官方通过X平台账号发布了链接,该推文目前已有1233次浏览,并附带1张数据图表。用户可前往页面查看各智能体的具体排名与表现。AI模型Agent Arena智能体评测基准推荐理由:想看AI智能体谁强谁弱?Agent Arena完整榜单出来了,去arena.ai/leaderboard就能看。原文稍后读已读值得跟进有用关注 Agent Arena
02:46lmarena.ai@lmarena_ai精选arena.ai更新了Code Arena: WebDev和Text Arena的帕累托前沿图。帕累托前沿展示了不同模型在多维性能上的最优组合。用户可据此快速比较模型,并跳转到对应排行榜查看详细数据。AI模型Code ArenaText Arena帕累托前沿推荐理由:想去arena.ai找代码或文本任务的最强模型?看这个帕累托前沿图,一眼就能知道哪些模型在权衡点上更值。原文稍后读已读值得跟进有用关注 Code Arena
02:38Google AI Developers@googleaidevs78°谷歌AI开发者宣布推出Gemini 3.7 Flash,称其为用于编码和智能体任务的最智能实干型模型。Gemini 3.7 Flash提升了指令遵循、首次代码准确率和智能体任务执行质量。官方演示中,该模型在Antigravity环境中构建了一个复杂3D网络游戏,包括生成Three.js样板代码、相机移动和碰撞检测。演示还使用Nano Banana创建PBR材质贴图和自定义精灵表,并集成了程序化音频。AI模型Gemini 3.7 FlashGoogle AI智能体推荐理由:谷歌发了Gemini 3.7 Flash,写代码和跑智能体任务更稳了,官方演示用它搭3D游戏,开发者可看看。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:31Philipp Schmid@_philschmid精选3.7 Flash在智能体循环中不再过度急切,而是先进行更多探索。3.7 Flash会先解析错误并运行测试,再修改代码。3.7 Flash的首次通过准确率明显更高,浪费的智能体轮次也更少。AI模型3.7 Flash智能体编程推荐理由:3.7 Flash改代码前先摸清环境、跑测试,少走弯路,能省不少无效循环。原文稍后读已读值得跟进有用关注 3.7 Flash
02:30Philipp Schmid@_philschmid82°Google宣布Gemini 3.7 Flash正式可用。该模型在DeepSWE基准上从49.0%升至65.3%,在FrontierCode上得分43.6%,AutomationBench上得分30.4%。它现为Google AI Studio、Antigravity和Gemini App的默认模型。输入输出价格下调50%,分别为每百万token 0.75美元和3.75美元,优惠持续到年底。AI模型Gemini 3.7 FlashGoogle智能体推荐理由:谷歌发布Gemini 3.7 Flash,DeepSWE从49%涨到65%,编码智能体都能打,价格还打五折,直接上手吧。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:24lmarena.ai@lmarena_ai72°Google DeepMind的Gemini 3.7 Flash (High)在Agent Arena取得+3.4%净提升。整体排名第20,高于Gemini 3.6 Flash (High)的第35名。长程智能体任务表现与Claude Sonnet 4.6和GPT-5.6 Terra (xHigh)处于同一区间。其Confirmed Success信号得分提升10%,位列第5。官方称该模型在编码、知识工作和网页开发方面更强。AI模型Gemini 3.7 FlashGoogle DeepMindAgent Arena推荐理由:谷歌新出的Gemini 3.7 Flash在智能体评测里冲到第20,比上代强一截,编码和网页开发更好用了,感兴趣的可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:23lmarena.ai@lmarena_ai81°Google DeepMind 发布 Gemini 3.7 Flash (High),已在 LMArena 的 Code Arena: WebDev 和 Text Arena 上线。该模型在 WebDev 排名从第 19 位升至第 8 位,明显优于上一代 Gemini 3.6 Flash (High)。它在数据与分析类别排名第 7,在模拟、游戏与内容创作工具类别排名第 8,在参考设计类别排名第 9。AI模型Gemini 3.7 FlashGoogle DeepMindLMArena推荐理由:谷歌 DeepMind 的新 Flash 模型在 WebDev 榜冲到第8,比上代进步不小,做网页或数据任务可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:19The Rundown AI@therundownai81°Google 发布 Gemini 3.7 Flash,距 Gemini 3.6 推出仅三周。该模型定价为每百万 tokens 0.75 美元输入、3.75 美元输出,低于 Sonnet 5、GPT 5.6 Terra 和 Muse Spark 1.2 等同类中端模型。官方强调其在编码、知识工作和智能水平上有明显提升。Reuters 称 Google 将新旗舰 Gemini 版本推迟两个月,因内部测试显示其编码性能仍落后于对手。AI模型Gemini 3.7 FlashGoogleGemini推荐理由:Google 发了 3.7 Flash,距 3.6 才三周,价格比 Sonnet 5 等便宜,编码和工作能力提升,中端可以无脑换。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:15Sundar Pichai@sundarpichai72°谷歌在3.6 Flash发布仅3周后推出3.7 Flash,重点提升编码和智能体工作能力。3.7 Flash在软件工程、知识工作和网页开发方面均有显著改进,定价为3.6 Flash原始成本的一半。该模型已通过Antigravity、Gemini API、AI Studio等渠道向开发者提供。AI模型Gemini 3.7 FlashGoogle智能体推荐理由:谷歌把3.7 Flash发了,编码和智能体能力比3.6强,价格还砍半,开发者快去试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:04官方账号Google DeepMind@GoogleDeepMind82°Gemini 3.7 Flash在调试和问题解决等关键编码任务上表现优于3.6 Flash。它能用更少的提示词设计出更实用的网页布局和应用。该模型在真实业务流程中的推理和准确性也有改进。开发者可通过Antigravity使用,API已在Google AI Studio和Android Studio开放。Google AI Pro和Ultra订阅者可在Gemini App的Gemini Spark中体验。AI模型Gemini 3.7 FlashGoogle DeepMindAntigravity推荐理由:谷歌新出的Gemini 3.7 Flash,写代码和修bug比3.6强,做网页更省事,还能在Antigravity里直接试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
02:02官方账号Logan Kilpatrick@OfficialLoganKGemini 3.7 Flash 正式发布,API 价格较 3.6 Flash 降低 50%,优惠持续到年底。该模型在约三周内通过算法改进实现了显著的智能提升。它已上线 API、AI Studio 和 Antigravity 等平台。官方强调其运行速度很快。AI模型Gemini 3.7 FlashGeminiAPI推荐理由:Gemini 3.7 Flash 来了,比 3.6 Flash 便宜一半,速度更快,想用 API 的可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:54官方一手marktechpost@Asif Razzaq78°谷歌发布Gemini 3.7 Flash,在推理核心上对Gemini 3.6 Flash做了算法改进。该模型支持1M token上下文和64K token输出,可处理文本、图像、音频与视频。编码基准上,FrontierCode 1.1 Main成绩43.6%(前代34.4%),DeepSWE v1.1为65.3%,WebDev Arena Elo为1588。文档与工作流基准同样提升,GDP.pdf从22.0%升至34.0%,AutomationBench从17.0%升至30.4%。模型仅通过API和企业提供,无开放权重,输入输出每百万token定价0.75/3.75美元,优惠至2026年12月31日。AI模型Gemini 3.7 FlashGoogle智能体推荐理由:谷歌新出的Gemini 3.7 Flash,编码和智能体分数提升明显,输入每百万token只要0.75美元,划算,但只走API。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:47lmarena.ai@lmarena_aiCode Arena 推出 WebDev 排行榜,用于展示各模型在网页开发任务上的表现。WebDev 排行榜已通过 arena.ai 向公众开放,支持查看完整排名。Code Arena 的 WebDev 榜单为开发者在挑选模型时提供了直接对比。AI模型Code Arena网页开发基准测试推荐理由:Code Arena 搞了个 WebDev 排行榜,做网页开发选模型时可以参考排名,不用自己瞎试了。原文稍后读已读值得跟进有用关注 Code Arena
01:45OpenRouter@OpenRouterAIOpenRouter 宣布为 Gemini 3.7 Flash 添加多模态工作负载支持。该模型覆盖图像理解、PDF 解析和文档提取等任务。在智能体工作流中,用户可在 Ori Harness 中直接调用。AI模型Gemini 3.7 FlashOpenRouterOri Harness推荐理由:Gemini 3.7 Flash 现在也能处理图片和 PDF 了,跑智能体还能配合 Ori Harness 用,OpenRouter 上就能试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:44官方账号Google AI@GoogleAI73°Google AI 发布 Gemini 3.7 Flash,定位编码和智能体任务的高性价比模型。Gemini App 中的 Gemini Spark 已接入该模型,可跨 Gmail、Google Calendar、Google Docs 执行多步骤操作。新模型在规划和工具调用上投入更多计算,减少人工监督与重试。定价为每百万输入 token 0.75 美元、输出 3.75 美元,截至年底为 3.6 Flash 原价的一半。AI模型Gemini 3.7 FlashGoogle编码助手推荐理由:Google AI 上了 Gemini 3.7 Flash,处理复杂任务更省心,年底前每百万 token 只要 0.75 美元,比 3.6 Flash 便宜一半。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:43lmarena.ai@lmarena_ai83°xAI 的 Grok-4.6 (High) 在 Code Arena 的 WebDev 榜单以 1630 分升至第五名,超过 Claude Fable 5 的 1627 分和 GPT-5.6 Sol xHigh 的 1622 分。相比 Grok 4.5 的 1553 分(第13位),Grok-4.6 得分提升明显。目前这三款模型分差仅 4 至 9 分,分别排在第五至第七名。AI模型Grok-4.6SpaceXAICode Arena1 个信源在谈事件专题推荐理由:Grok-4.6 刚发布就把网页开发能力冲进第一梯队,分数压过 Claude 和 GPT 的最新版,差距只有个位数,写代码的可以关注下。原文稍后读已读值得跟进有用关注 Grok-4.6
01:41官方账号Google AI@GoogleAI谷歌在Gemini App中通过Spark向Pro和Ultra订阅用户开放Gemini 3.7 Flash模型。该模型同时上线Gemini Enterprise Agent Platform和Gemini Enterprise应用,开发者可通过Google AI Studio和Android Studio的Gemini API调用。谷歌还展示了在Antigravity中构建agent优先工作流的示例。AI模型Gemini 3.7 FlashGoogle AIGemini App推荐理由:谷歌刚出了个新模型Gemini 3.7 Flash,Pro和Ultra用户今天就能在Gemini App里玩到,还能用API搭智能体。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:26Patrick Loeber@patloeber78°Gemini 3.7 Flash 已通过 API、AI Studio 和 Antigravity 开放。相比 3.6 Flash,智能水平在约三周内明显提升。到今年年底前,价格比 3.6 Flash 低 50%。官方称它速度很快,主要得益于算法改进。AI模型Gemini 3.7 FlashGeminiAI Studio推荐理由:官方发布了 Gemini 3.7 Flash,性能比 3.6 强,价格打五折,API 和 AI Studio 都已上线。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:25AK@_akhaliq腾讯ARC发布了SCoPE,一种名为Sightline-Coordinate Positional Encoding的位置编码方法,专门用于视频扩散Transformer。该方法通过视线坐标建模视频帧间的时空关系,改进现有位置编码在长视频生成中的表现。SCoPE模型已开源在HuggingFace平台,用户可直接获取。推文展示了相关视频生成效果,但尚未公布具体基准数据。AI模型SCoPETencentARC视频生成推荐理由:腾讯ARC开源了SCoPE,一种视频扩散Transformer的位置编码,搞视频生成可以试试。原文稍后读已读值得跟进有用关注 SCoPE
01:19官方账号OpenAI@OpenAI83°OpenAI 预览 GPT-5.6 Sol 的 Ultrafast 模式,速度最高提升至 14 倍。该模式首先在 OpenAI API 中面向一组精选客户推出,并随着容量增长向更多企业开放。官方尚未公布定价与全面开放时间。AI模型GPT-5.6 SolOpenAIAPI5 个信源在谈事件专题推荐理由:OpenAI 出了个 GPT-5.6 Sol 极速版,快 14 倍,先在 API 给一小部分客户用,后面会铺开。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
00:53lmarena.ai@lmarena_ai在视频编辑竞技场(Video Edit Arena)中,MiniMax-H3以1390分位列开源模型和总榜第一。它比第二、第三名的Dreamina Seedance 2.0和Gemini Omni Flash高出32分,比第四名HappyHorse 1.0高出83分。MiniMax官方已宣布该模型在Hugging Face上公开发布。AI模型MiniMax-H3MiniMax视频编辑2 个信源在谈事件专题推荐理由:MiniMax-H3登顶视频编辑榜,领先Seedance和Gemini 32分,已开源可下载。原文稍后读已读值得跟进有用关注 MiniMax-H3
00:50官方账号Decoder@Jonathan KemperDeepSeek将旗舰模型V4-Pro从测试阶段转为正式发布,同时以MIT许可证开源了智能体软件Harness v0.1。API价格同步上调,缓存命中成本涨至原来的6倍。对于反复读取相同文件的智能体工作流,这是价格涨幅最大的部分。AI模型DeepSeekV4 ProHarness推荐理由:DeepSeek把V4 Pro转正,开源了Harness v0.1,但缓存涨价到6倍,跑智能体工作流得多算算账。原文稍后读已读值得跟进有用关注 DeepSeek
AITOP8月7日 17:02Kimi K3沙盒逃逸:一只“只搜不攻”的文明越狱者,为何令安全圈集体警觉?Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索答案,未发起攻击。而此前 OpenAI 与 Anthropic 的模型在同类测试中,均出现了攻击外部系统或 Hugging Face 的主动行为。