#本地部署

共 109 条 · 7 天 17 条 · 30 天 30 条
6月12日
6月11日
模型中美对照多源确认83°02:00
Google 发布 DiffusionGemma:26B MoE 开源模型,激活仅 3.8B,推理速度超快

本地 LLM 用户终于等来速度突破——DiffusionGemma 的并行生成机制让推理快 4 倍,做本地部署或边缘计算的开发者可以直接在 18GB 显存下体验,值得一试。

事件专题
rohanpaul_ai@rohanpaul_ai7 个信源在谈原文
6月10日
6月9日
6月7日
6月5日
6月4日
模型中美对照官方一手88°02:51
Google DeepMind 发布 Gemma 4 12B:无编码器多模态模型,原生音频支持,16GB 笔记本可跑

多模态模型终于能跑在普通笔记本上了,做本地 AI 应用或边缘计算的开发者可以直接下载试用,16GB 内存就能跑视觉+音频推理,开源许可也友好。

事件专题
官方一手marktechpost@Asif Razzaq3 个信源在谈原文
6月3日
5月29日
5月28日
5月27日
5月26日
5月24日
5月22日
5月19日
5月16日