17:23IT之家(博客/媒体)联想百应AI主机300搭载AMD锐龙AI Max+395处理器,采用Zen5架构、16核32线程,最高频率5.1GHz。内置Radeon 8060S显卡(40个RDNA 3.5计算单元),NPU算力50 TOPS。板载128GB LPDDR5x内存,统一架构下可分配最高96GB给显存。Cinebench R23多核得分36886pts,3DMark Time Spy显卡得分12108。该主机支持在本地部署120B参数级别大模型,功耗比RTX 4090降低87%。AI产品联想百应AI主机300AMD锐龙AI Max+395Radeon 8060S本地大模型迷你工作站推荐理由:联想这款迷你主机塞进了128GB统一内存和锐龙AI Max+395,能本地跑120B大模型,性能打平RTX 4070,功耗还特低,AI玩家可以看看。原文
15:23berryxia@berryxiaLocally AI 在被 LM Studio 收购后,迅速推出了移动手机版客户端,旨在让用户能在手机上更高效地运行本地大模型。这一动作体现了 AI 领域的快速迭代速度,但当前移动端本地模型运行场景仍未被充分挖掘,用户需求支持尚不完善。该客户端可能为开发者或 AI 爱好者提供更便捷的本地推理体验,但实际应用效果有待观察。AI产品LM StudioLocally AI本地大模型移动客户端AI 产品2 个信源在谈推荐理由:LM Studio 收购后快速推出移动版,解决了本地大模型在手机端运行的需求,适合经常在移动设备上测试或使用 AI 模型的开发者和爱好者,建议关注其实际体验。原文
01:23IT之家(博客/媒体)微软在 Build 2026 大会上推出 Surface RTX Spark Dev Box 迷你开发机,采用铝制机身兼散热器,TDP 为 100W。该设备配备 128GB 统一内存,可本地运行最高 1200 亿参数的大语言模型,专为 AI 推理优化。它预装 VS Code 等开发环境,默认启用开发者模式、深色主题和 PowerShell 7,旨在提供开箱即用的工作体验。产品将于今年晚些时候在美国发售,定价尚未公布。这款设备与高通取消的骁龙 Dev Kit 理念相似,旨在推动 Arm 版 Windows 应用迁移。AI产品微软Surface RTX Spark Dev BoxAI 推理本地大模型Arm 版 Windows2 个信源在谈推荐理由:AI 开发者终于有了官方定制的本地推理硬件,128GB 内存能跑 1200 亿参数模型,做边缘部署或隐私敏感应用的团队可以直接关注。原文
12:39rohanpaul_ai@rohanpaul_ai精选76°atomic.chat 展示了 Multi-Token Prediction(MTP)技术,让本地运行的 Qwen 27B 密集模型从 51 tokens/s 提升到 117 tokens/s,MoE 35B-A3B 模型在 2x RTX 5090 上从 218 提升到 267 tokens/s。MTP 通过一次生成并验证多个未来 token,减少 GPU 重复读取模型权重的次数,从而突破内存带宽瓶颈。测试中约 80% 的 draft token 被接受,且零精度损失,仅额外占用约 1GB VRAM。该项目完全开源,对本地大模型部署者是个重大利好。AI模型本地大模型MTP/多 token 预测推理加速Qwen开源/仓库推荐理由:本地大模型用户终于可以突破内存带宽瓶颈了——MTP 让 Qwen 27B 速度翻倍还零精度损失,跑本地模型的开发者建议直接去 GitHub 试。原文