litert·general

LiteRT

别名
首次出现
2026-05-22
最近出现
2026-07-15
累计提及
17
§ 01综述

LiteRT是Google推出的端侧AI推理运行时,支持在移动设备、浏览器等环境中高效运行.tflite模型,通过WebGPU等技术实现跨平台加速。它旨在弥合云端与边缘AI之间的差距,让开发者无需依赖服务器即可部署复杂的机器学习模型。

LiteRT近期进展

  • Google发布LiteRT.js:通过WebGPU在浏览器中运行.tflite模型原文
  • 2026年7月15日,Google发布了LiteRT的JavaScript绑定LiteRT.js,利用WebGPU在浏览器中加速TFLite模型推理。据IT之家报道,该框架使AI推理速度提升3倍,为Web端高性能AI应用铺平了道路。
  • Gemma 4 12B与Google AI Edge打通,笔记本上跑Agentic工作流原文
  • Gemma 4 12B模型已与Google AI Edge(基于LiteRT)集成,可在笔记本上运行端侧智能体工作流,凸显了LiteRT在部署轻量级大模型方面的能力。
  • 用Qdrant EDGE和Google LiteRT搭建本地RAG流水线原文
  • Qdrant展示了结合其边缘向量数据库Qdrant EDGE与LiteRT构建本地检索增强生成(RAG)方案,实现完全离线的智能搜索与问答,进一步拓展了LiteRT在本地AI应用中的生态。

    当前焦点与观察点

    LiteRT的竞争力体现在其跨平台能力和硬件加速策略。与苹果CoreAI在端侧推理上形成直接竞争——测试显示CoreAI在M4 Mac上运行Qwen3 0.6B模型解码速度是MLX的2.47倍,而LiteRT则通过WebGPU在浏览器端取得突破。此外,LiteRT对NPU的支持(如Google发布LiteRT框架助力移动端NPU高效运行AI)使其在边缘设备上更具潜力。未来,随着更多模型(如Gemma系列)和开发工具链的完善,LiteRT有望成为端侧AI事实标准,但其普及程度仍取决于开发者社区和硬件厂商的采纳速度。
    § 02相关报道08 条在档
    1. 01
      Google发布LiteRT.js:通过WebGPU在浏览器中运行.tflite模型
      marktechpost
    2. 02
      谷歌发布LiteRT.js,Web AI推理速度提升3倍
      IT之家
    3. 03
      Vector Space Talks预告:用Qdrant Edge和Google LiteRT构建本地RAG
      Qdrant
    4. 04
      用Qdrant EDGE和Google LiteRT搭建本地RAG流水线
      Qdrant
    5. 05
      苹果 CoreAI 端侧架构测试:M4 Mac 上 Qwen3 0.6B 解码速度是 MLX 的 2.47 倍
      IT之家
    6. 06
      Gemma 4 12B 与 Google AI Edge 打通,笔记本上跑 Agentic 工作流
      berryxia
    7. 07
      Gemma 4 12B 发布:统一架构支持多模态与智能体推理
      Patrick Loeber
    8. 08
      Google发布LiteRT框架,助力移动端NPU高效运行AI
      Google Developers Blog
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/LiteRT