主要来源OpenRouter
查看原文事件专题 · 多源确认
Google 发布 Gemini 3.5 Flash-Lite:系列最快模型,面向低延迟高吞吐
Google 推出 Gemini 3.5 Flash-Lite,这是其 3.5 系列中速度最快的模型,在 OpenRouter 上运行速度超过 150 tok/s。该模型专为低延迟、高吞吐场景设计,适用于智能体搜索、文档处理和子智能体任务。相比系列其他模型,Flash-Lite 在保持推理质量的同时大幅提升了响应速度。目前可通过 OpenRouter 的 API 直接调用。
当前结论
跑 Agent 和批量文档处理最快的 Gemini 来了,150+ tok/s 的吞吐,OpenRouter 直接用,便宜又爽。
11 个信源62° AI 热度最后更新 2026/7/21 21:54:25
证据链
相关来源 1Google AI
查看原文相关来源 2Philipp Schmid
查看原文相关来源 3Jeff Dean
查看原文相关来源 4小互
查看原文相关来源 5marktechpost
查看原文相关来源 6Poe
查看原文相关来源 7Geek
查看原文相关来源 8The Rundown AI
查看原文相关来源 9LangChain
查看原文相关来源 10Jerry Liu
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。