7月7日
17:00
17:00@koltregaskes@koltregaskes
精选
分析显示,前沿模型发布到可本地运行的类似开源模型平均滞后25个月。例如GPT-3到Llama 2 70B约37个月,GPT-4到Gemma 3/Qwen3约2年,Claude 3.5 Sonnet到Gemma 4 31B约21个月。趋势预示当前前沿能力可能在两年后出现在笔记本电脑级模型中。该图表预测Fable/Mythos级模型约2028年中出现。
事件专题

推荐理由:想了解前沿模型多久能变成你能在笔记本上跑的开源版?这篇用GPT-4、Claude 3.5等具体案例算出了平均25个月的滞后,还画了未来预测图。
6月4日
02:42
02:42Google AI Developers@googleaidevs
Google AI 开发者团队宣布推出 Gemma 3 模型,该模型兼容 llama.cpp、MLX、LM Studio、vLLM、Ollama、UnslothAI 和 SGLang 等主流推理框架。权重已同步上传至 Kaggle 和 Hugging Face 平台,开发者可自由下载使用。这一发布意味着 Gemma 3 能无缝融入现有 AI 工具链,降低部署门槛。
推荐理由:Google 终于把 Gemma 3 的兼容性做全了——主流推理框架全覆盖,做本地部署或模型微调的开发者可以直接去 Hugging Face 下载权重,省去适配烦恼。
5月28日
22:50
22:50官方账号Decoder@Jonathan Kemper
Google 在 Google I/O 上发布了 Coral Board,一款紧凑型单板计算机,专为设备端 AI 设计。该板卡能够本地运行 Gemma 3 模型,无需依赖云端。这为边缘计算和物联网设备提供了强大的 AI 能力,降低了延迟并增强了隐私保护。开发者可以将其用于智能家居、工业自动化等场景,实现实时推理。
事件专题

推荐理由:边缘 AI 终于有了官方硬件方案——Coral Board 让 Gemma 3 在本地跑起来,做嵌入式或物联网的开发者可以直接用它部署模型,省去云端依赖。