Google 这篇论文有点反直觉:答案一致反而可能是错的。VeriHarness 用同款模型当验证器挑毛病,五个基准上都能涨分,数据也开源了。
#Gemini 3.5 Flash
有人实测了 Gemini 3.6 Flash,发现和上一代差不多但省点 token。Antigravity 也接入了这个模型,还重置了配额,可以看看效果。
谷歌出了Gemini 3.6 Flash,日常模型更强了,编码和推理升级,还省了最多65%的token。另外还有个更快的3.5 Flash-Light,Gemini 4也在训练了,可以关注。
有人把 Gemini 3.5 Flash 塞进了 Grok,Grok 这下能用上 Google 的新模型和 API 了,看评论区反响挺热闹。
最近这几个Flash模型我帮你试了,Step 3.7 Flash写博客页和抓GitHub项目都很稳,页面好看,一次跑通,成本也就一两块钱,值得试试。
Google 刚给 Gemini 3.5 Flash 加了 computer use,这份教程用一条命令就能在模拟器上跑 agent 控制手机,还支持远程和 iOS,很实用。
Google 给 Gemini 3.5 Flash 加了 Computer Use 工具,能让智能体跨浏览器、手机和桌面干活,还能自定义安全策略,实用!
Google 开发者生态又更新了,Patrick 讲了 AI Studio、Gemini 3.5 Flash 和新的 Interactions API,做应用开发可以看看。
Google 把屏幕操控塞进了 Gemini 3.5 Flash,OSWorld 得分和 GPT-5.5 差不多。开发者直接用 API 就能做自动化,很实在。
谷歌新榜单实测,Gemini 3.5 Flash 在安卓开发任务中得分低、成本高,性价比远不如 DeepSeek V4 Flash。
做国际化产品、跨国会议或实时翻译应用的团队,可以直接用 Gemini API 接入这个模型,省去自研语音翻译的麻烦,建议立即体验。
Google Workspace 重度用户终于有了一个能跨应用执行复杂任务的 AI 助手,看完演示可以直接在 Docs 和 Gmail 里试试。
想看看 Gemini 3.5 Flash 在真实场景中能跑多远?这场黑客松的获奖项目就是最好的参考——做多模态应用或语音交互的开发者值得关注这些实战案例。
Notion 用户现在可以用 Gemini 3.5 Flash 打造更快的自定义智能体,做自动化工作流的团队值得一试,成本更低、响应更快。
GitHub Copilot 用户注意了——不同模型 Token 消耗倍数差异巨大,选错模型可能多花十几倍费用,做 AI 编程的团队建议收藏对比表。
UI/UX 设计师和前端开发者可以借助 Gemini 3.5 Flash 的并行生成能力,将原型迭代时间从小时级压缩到分钟级,建议直接体验 Google AI Studio 中的这个 demo。
Antigravity 用户终于可以省 Token 了——简单任务用低配模型能省近一半,做自动化开发的团队建议立刻切换试试。
智能体开发者可以关注:Gemini 3.5 Flash 用更小参数实现了更强性能,意味着更低成本和更快响应,值得在项目中尝试。
做自动化流程的开发者终于有了性价比之选——Gemini 3.5 Flash 不仅性能领先,成本还低 7 倍,建议直接试试 medium 设置。
Lovable 用户现在可以直接用 Gemini 3.5 Flash 为应用添加智能体功能,做低代码 AI 应用的团队值得一试,能快速提升交互体验。