事件专题 · 单一信源

在 8 美元 ESP32-S3 上运行近 2900 万参数 LLM,利用 Gemma Per-Layer Embeddings 将参数存于 Flash

开发者成功在售价 8 美元的 ESP32-S3 芯片上运行了接近 2900 万参数的 LLM。核心技巧是将大部分模型参数存储在 Flash 而非 RAM 中,借鉴了 Google Gemma 的 Per-Layer Embeddings 思路。该方法大幅降低了内存占用,使低成本边缘设备也能运行较大模型。项目已开源在 GitHub 上。

当前结论

别人用 8 美元的芯片跑大模型,靠的是 Gemma 的分层嵌入技巧。想低成本部署边缘 AI?这个开源项目就是参考答案。

2 个信源61° AI 热度最后更新 2026/7/25 08:10:00

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情