Qwen 3.6 27b Abliterated (apostate)

Reddit r/LocalLLaMA 模型

摘要

用户发布了Apostate,这是Qwen 3.6 27B的去安全对齐版本,将安全对齐拒绝率从92%降低到7.6%,同时能力损失极小(KL 0.120)。

我一直在开发一个名为Apostate的项目,并终于将其中的第一个大模型发布到了Hugging Face上。Qwen 3.6 27B移除了安全对齐,拒绝率从92%降至7.6%,对模型能力影响极小(KL 0.120)。Qwen 3.6 27B Apostate Qwen 3.6 27b Apostate GGUF
查看原文

相似文章

0bserverx/Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF

Hugging Face Models Trending

本文介绍了Qwen3.8-27B-Heretic-Abliterated-Uncensored-GGUF的发布,这是Qwen模型的一个双重精炼、异端消融的变体,针对成年用户减少了拒绝,并采用ARA技术用于研究和创意写作。

OBLITERATUS/Qwen3.6-27B-OBLITERATED

Hugging Face Models Trending

OBLITERATUS 发布了经过修改的 27B Qwen3.6 检查点,通过源绑定消融技术消除了拒绝行为,保留了能力并支持无审查的本地使用。公开基准测试显示高非拒绝率,同时保持了 MMLU-Pro 分数。

8 个无审查的 Qwen 3.8 27B 变体,1 个基座模型,167 GPU 小时 — Abliterlitics

Reddit r/LocalLLaMA

本文对 8 个 Qwen 3.8 27B 模型的 abliterated 变体与基座模型进行了全面基准测试,消耗 167 GPU 小时,涵盖权重分析、KL 散度、13 项基准测试及 HarmBench 拒绝测试。分析表明,精细化编辑显著优于大幅修改:激进的 abliteration 会导致模型在多达 45% 的对抗性响应中陷入思考循环,且部分变体中检测到聊天模板操纵。

Qwen/Qwen3.6-35B-A3B-FP8

Hugging Face Models Trending

阿里巴巴发布了Qwen3.6-35B-A3B-FP8,这是Qwen3.6的开源权重量化变体,拥有35B参数,通过MoE激活3B,具有改进的智能编码能力和保持思维链的迭代开发特性。