14:52Paul Couvert@itsPaulAi精选Paul推荐了5款可在笔记本上运行的本地模型,无需$10k Mac Studio。Qwen3.6-27B被认为是最佳编程智能体模型,Qwen3.6-35B-A3B是更快选项。Gemma 4 12B适合日常问答,Parakeet 0.6B v3是语音转文本最佳模型。Gemma 4 E4B可离线在手机运行,Gemma 4 26B diffusion在本地模型中Token/秒最高。建议使用Unsloth量化版搭配LM Studio或llama.cpp运行。技巧Qwen3.6-27BGemma 4ParakeetLM Studio本地模型1 个信源在谈推荐理由:Paul整理了5款能塞进笔记本的本地模型,从编程到语音全覆盖,帮你省掉高价工作站的钱。原文
AITOP5月29日 08:02Opus 4.8发布:编程助手的“静默时刻”,是解放开发者,还是新门槛?🔥Anthropic 把 AI 编程的“确认键”彻底删掉了!Claude Code 搭载全新 Opus 4.8 模型,长时间任务不跑偏、不废话、不中断,像一个资深工程师一样默默干活,从功能开发到漏洞清扫全包圆,你在旁边喝茶等结果就行。过去 AI 写代码三步一问“这样可以吗”,现在它直接交完整交付物……自主编程的最后一层窗户纸,被捅破了。做自动化开发和代码审查的团队,这个模型建议直接上手,效率差距肉眼可见……
06:49Clement Delangue@ClementDelangue精选llama.cpp 新增 MTP(Multi-Token Prediction)支持,使本地模型推理速度大幅提升。在 A10G 上测试 Qwen3.6-27B 模型,生成速度从 25 tok/s 提升至 45 tok/s,增幅达 78%。这一优化让本地模型具备了作为日常驱动力的实用性,对本地部署和隐私敏感场景意义重大。开发者可直接在 llama.cpp 中启用 MTP 功能,体验更流畅的本地推理。AI模型llama.cppMTP/多令牌预测本地推理Qwen3.6-27B推理优化推荐理由:本地模型速度翻倍,做本地部署的开发者终于可以告别卡顿,建议直接试试 MTP 支持。原文