Qwen-Image-2.1-Turbo GGUF 量化版发布,2.6 GB 起可本地运行
用 Qwen-Image-2.1-Turbo 的人可以下载这些 GGUF 量化,4.2 GB 那档比 llama.cpp 的 Q4_K 失真少 21%,小显存也能本地跑。
atomic_chat_hq 在 Hugging Face 上发布了 Qwen-Image-2.1-Turbo 的 GGUF 量化版本,从 2-bit(2.6 GB)到无损 BF16(14.2 GB)共多个规格。其 4.2 GB 的 AD-Q4_K 版本相比 llama.cpp 的 Q4_K,LPIPS 低 21%,生成图像更接近原始输出。这使消费级设备本地跑图像生成模型成为可行选项。
Run Qwen-Image-2.1-Turbo GGUF locally 🖼️
We released quants on Hugging Face, from 2-bit (2.6 GB) up to lossless BF16 (14.2 GB)
Our 4.2 GB AD-Q4_K has 21% lower LPIPS than a plain llama.cpp Q4_K, so its images stay closer to the original
GGUFs: https://t.co/CnrvhcCXKy https://t.co/Ce1PgTvOVH