事件专题 ·单一信源

JustFit 让 27B 模型在 24GB 笔记本上处理 20万token

JustFit 是一种 MLX 推理运行时,通过 KVExec、PhaseSwap 和 StateTrans 机制,让 Qwen3.8-27B 模型在 24GiB MacBook 上处理 196,608 个输入 token 和 16,384 个输出 token,单次请求上下文从 30,720 增加到 212,992,支持更长的推理。

当前结论

朋友,刚看到 JustFit 这个技术,它能让 27B 的 Qwen 模型在 24GB 笔记本上处理 20万token,比之前的方法快很多,对本地开发很有用。

2 个信源44° AI 热度最后更新 2026/9/15 17:15:48

证据链

2 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。