事件专题 · 多源确认

Google 发布 Gemini 3.5 Flash-Lite:系列最快模型,面向低延迟高吞吐

Google 推出 Gemini 3.5 Flash-Lite,这是其 3.5 系列中速度最快的模型,在 OpenRouter 上运行速度超过 150 tok/s。该模型专为低延迟、高吞吐场景设计,适用于智能体搜索、文档处理和子智能体任务。相比系列其他模型,Flash-Lite 在保持推理质量的同时大幅提升了响应速度。目前可通过 OpenRouter 的 API 直接调用。

当前结论

跑 Agent 和批量文档处理最快的 Gemini 来了,150+ tok/s 的吞吐,OpenRouter 直接用,便宜又爽。

11 个信源62° AI 热度最后更新 2026/7/21 21:54:25

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情