Qwen3.8-27B 现已成为 Hugging Face第一
这波开源模型无论说什么都建议大家自己部署试试了。
现在得益于 Unsloth 团队这次速度极快,Qwen3.8-27B 发布几乎同时就放出了全套 GGUF 量化版本。他们说要把这个模型压到 17GB,结果真做到了。
mlx-works 在 8 月 16 日更是快速发布了 Qwen3.8-27B-oQ4e-mtp——用 oMLX v0.5.7 做的混合精度量化版,专为 Mac 优化。
而 M5 Macbook Air 32G 实测,短上下文生成速度能达到 18.8tok/s。
