#MLX
共 18 条 · 7 天 0 条 · 30 天 4 条
信息流里打上「MLX」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月3日
9月25日
Qwen3.8-27B 在 Mac 上跑起来:内存、引擎与测试全流程
教你把 Qwen3.8-27B 装进 Mac 本地跑代码,内存要多少、怎么配引擎、测试怎么兜底都写清楚了,还能当 Claude Code 的免费备胎。
9月22日
9月13日
8月20日
8月15日
MLX-Serve:用 Zig 写的 Apple Silicon 原生 LLM 推理服务器
Mac 本地跑模型试试这个 Zig 写的 MLX-Serve,免 Python 还带菜单栏,配 Qwen 3 跑 Pagoda 测试比之前都强。
8月5日
7月21日
7月18日
7月2日
6月17日
在Apple Silicon Mac上用MLX本地跑LLM并开OpenAI兼容API
想在Mac上本地跑大模型、不用联网?这个工具能从Hugging Face下模型,用MLX推理,还直接开个OpenAI API,当本地服务使。
6月12日
产品20:47
oMLX 支持标准 HF 缓存目录,本地 AI 部署更便捷对于在 Apple Silicon 上跑本地模型的开发者,oMLX 支持 HF 缓存目录意味着省去模型重复下载和路径配置的麻烦,建议直接更新体验。
6月11日
苹果 CoreAI 端侧架构测试:M4 Mac 上 Qwen3 0.6B 解码速度是 MLX 的 2.47 倍
苹果端侧 AI 架构迎来重大更新,CoreAI 在小模型推理上显著提速,做本地 AI 应用或模型部署的开发者值得关注,尤其是 M4 Mac 用户可以直接感受到更快的响应。
IT之家原文
Prince Canuma 将 DiffusionGemma 和 Cohere North Mini Code 塞进 Mac MLX
Mac 开发者终于能在本地跑最新大模型了,DiffusionGemma 和 North Mini Code 都支持 Day-0 运行,做本地 AI 实验的可以直接装来玩。
6月4日
GoogleDeepMind Gemma 4-12B 上线 Ollama,支持 MLX
Ollama 让 Gemma 4-12B 的本地部署门槛降到最低,做模型实验或本地 Agent 开发的团队可以直接跑起来,省去繁琐配置。
5月26日
开源 macOS 菜单栏 AI 启动器,Swift 构建,本地运行 MLX 模型
macOS 用户终于有了一个本地化、轻量的 AI 入口,无需联网即可在菜单栏调用模型,隐私敏感或离线场景下的开发者值得一试。
5月22日
产品08:20
Stable Audio 3 本地跑音乐模型,Mac 用户狂喜音乐创作者和 AI 爱好者终于能在本地 Mac 上跑音乐模型了,LoRA 微调不到 1 小时,适合快速出 demo 或训练个人风格,建议有 Mac 的开发者直接试。
5月15日
产品00:48
MLX CUDA后端测试全过,苹果框架杀入NVIDIA生态MLX打通CUDA后,做本地AI推理的开发者终于可以一套代码跑通Mac和NVIDIA显卡,省去PyTorch兼容折腾,建议关注这个框架的跨平台潜力。