04:02Philipp Schmid@_philschmid78°谷歌发布Gemini 3.7 Flash,在Zapier的AutomationBench基准上拿下30%得分,成为首个突破30%的模型。三周前Gemini 3.6 Flash得分19.8%,这次每任务成本仅增加3美分。在营销、财务、销售、支持四个领域表现领先,其中营销38%、财务37.5%。但在运营领域仍落后,Opus 5以50%保持领先。AI模型Gemini 3.7 FlashAutomationBenchZapier推荐理由:谷歌突袭发布Gemini 3.7 Flash,AutomationBench拿到30%,比贵一倍的模型还强。做智能体自动化任务可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
21:05Patrick Loeber@patloeber76°Gemini 3.5 Flash (Medium) 在 Zapier 的 AutomationBench 基准测试中夺得第一,得分 14.5%,远超 GPT 5.5 (xhigh) 的 12.9%。值得注意的是,中等推理设置(medium)表现优于高推理(high),因为高推理会过度消耗工具调用限制。该模型还以约 7 倍的成本优势领先,成为目前最持久的自动化模型。Google 已推荐将 medium 作为默认 API 设置,适用于大多数任务。AI模型Gemini 3.5 FlashAutomationBench推理模型推荐理由:做自动化流程的开发者终于有了性价比之选——Gemini 3.5 Flash 不仅性能领先,成本还低 7 倍,建议直接试试 medium 设置。原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash