@Lonely__MH: 为所欲为! Qwen3.8-27B 剥离安全限制的无审查版本来了! 为社区速度点赞!专为 Mac M芯片深度优化! 看大家都在讨论 ling-3.0-flash 的 DGX Spark 部署,很多人第一反应都是算力太贵买不起 既然云端成本…

X AI KOLs Timeline 模型

摘要

Qwen3.8-27B 无审查版本发布,专为 Mac M 芯片优化,支持本地部署,保留多模态能力和安全研究功能,提供简化安装步骤。

为所欲为! Qwen3.8-27B 剥离安全限制的无审查版本来了! 为社区速度点赞!专为 Mac M芯片深度优化! 看大家都在讨论 ling-3.0-flash 的 DGX Spark 部署,很多人第一反应都是算力太贵买不起 既然云端成本高,不如直接用你手里的 Mac 本地部署这个真·本地多模态大杀器:Qwen3.8-27B-Uncensored-MLX 划重点: 1. 0 拒绝:正交化剥离了拒绝方向,直接顺从各种极端红队/安全研究指令 2. 能力全保留:多模态图像理解、思考控制、工具调用及 262K 长上下文都在 3. 高画质权重:核心视觉塔保持 BF16 精度,仅语言线性层做 Affine 量化 4. 空间开销:推荐 4-bit 版(仅 15GB 空间,24G 内存 Mac 即可流畅起飞);无损可选 8-bit(27.5GB 空间,需 32G 内存)- 大家量力而行 3步极简本地部署(兼容 OpenAI 接口): (1)升级库:pip install -U mlx-vlm (2)下载 4-bit 权重 -- hf download orcarouter/Qwen3.8-27B-Uncensored-MLX --include "4-bit/*" --local-dir ./Qwen3.8-27B-Uncensored-MLX -- (3)一键拉起本地 API 服务器 -- python -m mlx-vlm server --model ./Qwen3.8-27B-Uncensored-MLX/4-bit --port 8080 -- 本地部署,安全无审查,简直为所欲为
查看原文
查看缓存全文

缓存时间: 2026/08/18 18:30

为所欲为! Qwen3.8-27B 剥离安全限制的无审查版本来了!

为社区速度点赞!专为 Mac M芯片深度优化!

看大家都在讨论 ling-3.0-flash 的 DGX Spark 部署,很多人第一反应都是算力太贵买不起

既然云端成本高,不如直接用你手里的 Mac 本地部署这个真·本地多模态大杀器:Qwen3.8-27B-Uncensored-MLX

划重点:

  1. 0 拒绝:正交化剥离了拒绝方向,直接顺从各种极端红队/安全研究指令

  2. 能力全保留:多模态图像理解、思考控制、工具调用及 262K 长上下文都在

  3. 高画质权重:核心视觉塔保持 BF16 精度,仅语言线性层做 Affine 量化

  4. 空间开销:推荐 4-bit 版(仅 15GB 空间,24G 内存 Mac 即可流畅起飞);无损可选 8-bit(27.5GB 空间,需 32G 内存)- 大家量力而行

3步极简本地部署(兼容 OpenAI 接口):

(1)升级库:pip install -U mlx-vlm (2)下载 4-bit 权重

hf download orcarouter/Qwen3.8-27B-Uncensored-MLX –include “4-bit/*” –local-dir ./Qwen3.8-27B-Uncensored-MLX

– (3)一键拉起本地 API 服务器

python -m mlx-vlm server –model ./Qwen3.8-27B-Uncensored-MLX/4-bit –port 8080

本地部署,安全无审查,简直为所欲为

相似文章

@Xudong07452910: Hacker News 上有一篇评论区火了的文章:Qwen 3.6 27B 是本地开发的理想选择。 核心发现是:密集参数模型、原生支持 256k 上下文,在 MacBook Max M5 上跑 Q8_0 量化版能达到 30 tokens/…

X AI KOLs Timeline

Qwen 3.6 27B is a dense 27B model that achieves impressive performance on local hardware with 256k context, running at 30 tokens/s on MacBook Max M5 and 50 tokens/s on RTX 5090, and is considered by some as the first local model with true general intelligence.