全部 AI 动态 · AI 热点

6月22日

17:23

17:23IT之家（博客/媒体）

联想百应AI主机300搭载AMD锐龙AI Max+395处理器，采用Zen5架构、16核32线程，最高频率5.1GHz。内置Radeon 8060S显卡（40个RDNA 3.5计算单元），NPU算力50 TOPS。板载128GB LPDDR5x内存，统一架构下可分配最高96GB给显存。Cinebench R23多核得分36886pts，3DMark Time Spy显卡得分12108。该主机支持在本地部署120B参数级别大模型，功耗比RTX 4090降低87%。

AI产品联想百应AI主机300 AMD锐龙AI Max+395 Radeon 8060S 本地大模型迷你工作站

推荐理由：联想这款迷你主机塞进了128GB统一内存和锐龙AI Max+395，能本地跑120B大模型，性能打平RTX 4070，功耗还特低，AI玩家可以看看。

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？

6月5日

15:23

15:23

berryxia@berryxia

Locally AI 在被 LM Studio 收购后，迅速推出了移动手机版客户端，旨在让用户能在手机上更高效地运行本地大模型。这一动作体现了 AI 领域的快速迭代速度，但当前移动端本地模型运行场景仍未被充分挖掘，用户需求支持尚不完善。该客户端可能为开发者或 AI 爱好者提供更便捷的本地推理体验，但实际应用效果有待观察。

AI产品 LM Studio Locally AI 本地大模型移动客户端 AI 产品

推荐理由：LM Studio 收购后快速推出移动版，解决了本地大模型在手机端运行的需求，适合经常在移动设备上测试或使用 AI 模型的开发者和爱好者，建议关注其实际体验。

6月3日

01:23

01:23IT之家（博客/媒体）

微软在 Build 2026 大会上推出 Surface RTX Spark Dev Box 迷你开发机，采用铝制机身兼散热器，TDP 为 100W。该设备配备 128GB 统一内存，可本地运行最高 1200 亿参数的大语言模型，专为 AI 推理优化。它预装 VS Code 等开发环境，默认启用开发者模式、深色主题和 PowerShell 7，旨在提供开箱即用的工作体验。产品将于今年晚些时候在美国发售，定价尚未公布。这款设备与高通取消的骁龙 Dev Kit 理念相似，旨在推动 Arm 版 Windows 应用迁移。

AI产品微软 Surface RTX Spark Dev Box AI 推理本地大模型 Arm 版 Windows

推荐理由：AI 开发者终于有了官方定制的本地推理硬件，128GB 内存能跑 1200 亿参数模型，做边缘部署或隐私敏感应用的团队可以直接关注。

5月21日

12:39

12:39

rohanpaul_ai@rohanpaul_ai

精选76°

atomic.chat 展示了 Multi-Token Prediction（MTP）技术，让本地运行的 Qwen 27B 密集模型从 51 tokens/s 提升到 117 tokens/s，MoE 35B-A3B 模型在 2x RTX 5090 上从 218 提升到 267 tokens/s。MTP 通过一次生成并验证多个未来 token，减少 GPU 重复读取模型权重的次数，从而突破内存带宽瓶颈。测试中约 80% 的 draft token 被接受，且零精度损失，仅额外占用约 1GB VRAM。该项目完全开源，对本地大模型部署者是个重大利好。

AI模型本地大模型 MTP/多 token 预测推理加速 Qwen 开源/仓库

推荐理由：本地大模型用户终于可以突破内存带宽瓶颈了——MTP 让 Qwen 27B 速度翻倍还零精度损失，跑本地模型的开发者建议直接去 GitHub 试。