一个 19 岁创业者做了台叫 Core 的无屏小电脑,卖 3499 美元,能在家里本地跑 AI 模型,不连云也能用 Agent。
#本地模型
微软把代码模型压到 3-bit 塞进本地跑,成本降到四分之一,Terminal-Bench 成绩还涨了,Copilot 用户可以直接试试。
Microsoft 把自家 MAI-Code-1.1-Flash 塞进了 GitHub Copilot,本地跑代码智能体还不收推理费,用 Copilot 的可以试试。
微软这台 Surface Laptop Ultra 用 NVIDIA 的 Grace + Blackwell 芯片,128GB 统一内存能直接在笔记本上跑 1200 亿参数的本地模型,搞 AI 开发的可以盯一下。
LangChain创始人发推说Codex这类编程harness其实没多少功能,还预言五年后本地模型吃掉大部分日常任务,厂商得靠放权竞争。
有人做了个开源小工具,能把 macOS 27 里悄悄下载的 Apple 模型删掉、省回硬盘空间,不用关 SIP,Mac 快满的人可以看看。
Perplexity 的本地版 Windows 客户端开始支持 AMD Ryzen AI Max 芯片,Agent 能直接操作你电脑里的应用和文件,还能定时自动跑任务。
升级 macOS 27 前先看看这条:Apple Intelligence 自动下载且关不掉,有人被占了 30GB 空间,文中还教你怎么查自己被占了多少。
Logan Markewich 发布了一个叫 jeff 的本地模型,用 GliFormer 构建的,在 GitHub 上有源代码,比 Jev 稍慢一点但便宜一点。
Perplexity AI 推出了 Portable Computer,让你能在 Windows PC 上直接运行他们的模型,不用再依赖云端,更方便地处理本地文件和应用。
Denis Yarats分享了Perplexity在多智能体协作方面的进展,本地模型作为远程模型的门户,可以显著提升性能并降低成本,如果你对这一领域感兴趣,不妨私信他了解更多。
AI Engineer 大会的 Local AI 专场正在直播,讲桌面端、本地模型、边缘压缩和模型路由,想围观最新方向就看这个。
本地模型跑Agent总嫌慢?Hermes Agent这次用上NeMo Relay,省token还少绕路,更新试试就知道。
你可以根据自己电脑配置在Hugging Face上筛选能跑的模型,省下API钱,还能自己掌控模型,很实用。