@Lonely__MH: 为所欲为! Qwen3.8-27B 剥离安全限制的无审查版本来了! 为社区速度点赞!专为 Mac M芯片深度优化! 看大家都在讨论 ling-3.0-flash 的 DGX Spark 部署,很多人第一反应都是算力太贵买不起 既然云端成本…
摘要
Qwen3.8-27B 无审查版本发布,专为 Mac M 芯片优化,支持本地部署,保留多模态能力和安全研究功能,提供简化安装步骤。
查看缓存全文
缓存时间: 2026/08/18 18:30
为所欲为! Qwen3.8-27B 剥离安全限制的无审查版本来了!
为社区速度点赞!专为 Mac M芯片深度优化!
看大家都在讨论 ling-3.0-flash 的 DGX Spark 部署,很多人第一反应都是算力太贵买不起
既然云端成本高,不如直接用你手里的 Mac 本地部署这个真·本地多模态大杀器:Qwen3.8-27B-Uncensored-MLX
划重点:
-
0 拒绝:正交化剥离了拒绝方向,直接顺从各种极端红队/安全研究指令
-
能力全保留:多模态图像理解、思考控制、工具调用及 262K 长上下文都在
-
高画质权重:核心视觉塔保持 BF16 精度,仅语言线性层做 Affine 量化
-
空间开销:推荐 4-bit 版(仅 15GB 空间,24G 内存 Mac 即可流畅起飞);无损可选 8-bit(27.5GB 空间,需 32G 内存)- 大家量力而行
3步极简本地部署(兼容 OpenAI 接口):
(1)升级库:pip install -U mlx-vlm (2)下载 4-bit 权重
hf download orcarouter/Qwen3.8-27B-Uncensored-MLX –include “4-bit/*” –local-dir ./Qwen3.8-27B-Uncensored-MLX
– (3)一键拉起本地 API 服务器
python -m mlx-vlm server –model ./Qwen3.8-27B-Uncensored-MLX/4-bit –port 8080
本地部署,安全无审查,简直为所欲为
相似文章
@nicekate8888: 最近二十天我都在折腾一件事——怎么让 Qwen3.6-27B 在我的 Mac 上跑得又快又好。 一开始我用 Unsloth Q5,18 tok/s,风扇呼啦呼啦响。 后来换成 MLX 6bit + DFlash,提到 22 tok/s,还…
用户分享在Mac上通过不同量化方法(Unsloth Q5、MLX 6bit + DFlash、MTPLX 4bit)优化Qwen3.6-27B推理速度的经验,最终达到43 tok/s。
@Lonely__MH: 来来来!为所欲为 2.0 版本来了! Qwen 3.8-27B 破解版 直接API调用! 都不用本地部署了!彻底解放电脑! 昨天刚分享了 Qwen-3.8 27B 无审查版本的本地教程,不少推友反馈门槛有点高。 这不,直接把 API 喂到…
本文宣布了Qwen 3.8-27B的破解版本,提供直接API调用功能,无需本地部署,旨在简化AI模型的访问。
@Xudong07452910: Hacker News 上有一篇评论区火了的文章:Qwen 3.6 27B 是本地开发的理想选择。 核心发现是:密集参数模型、原生支持 256k 上下文,在 MacBook Max M5 上跑 Q8_0 量化版能达到 30 tokens/…
Qwen 3.6 27B is a dense 27B model that achieves impressive performance on local hardware with 256k context, running at 30 tokens/s on MacBook Max M5 and 50 tokens/s on RTX 5090, and is considered by some as the first local model with true general intelligence.
Qwen3.8-27B 在 Apple Silicon 上借助 mlx-dspark 速度提升至约3倍
mlx-dspark v0.10.0 新增了对 Apple Silicon 上 Qwen3.8-27B 的支持,通过无损验证的推测解码提供高达3倍的速度提升。
@MinLiBuilds: https://x.com/MinLiBuilds/status/2089338660386992295
本文对比了NVIDIA DGX Spark和魔改RTX 4090在本地部署Qwen3.8-27B和Ling-3.0-flash模型的性能,提供了基准测试数据和购买建议。