LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF
摘要
一种新的无审查GGUF模型,基于Qwen3.6-35B-A3B,采用数据重建和噪声抑制技术进行技术改进。通过一种新颖的修复方法,降低了拒绝率并提升了性能。
查看缓存全文
缓存时间: 2026/07/20 15:24
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF · Hugging Face
来源: https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF
⚡https://web.tribute.tg/d/KIH⚡ 如果你喜欢这个 Genesis LLM 版本,你可以通过 Telegram 中的 @Tribute (https://t.me/tribute) 机器人捐赠 (https://web.tribute.tg/d/KIH)给我,以支持未来的 Genesis LLM 开发。
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#%F0%9F%8C%9F-qwen36-35b-a3b-uncensored-hauhaucs-aggressive—genesis-hermes-v3🌟 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive -> Genesis Hermes V3
关键区别在于通过 SVD 对 ssm_out.weight、attn_output.weight、attn_gate.weight、attn_qkv.weight、attn_q.weight、attn_k.weight、attn_v.weight 张量进行数据重构,同时保留训练数据并抑制噪声。
我的方法基于通过数理统计在模型中进行数据重构。我不训练模型,而是修复其中的信号。我通过三个参数逐块扫描模型中的块,并选择最适合张量权重分布的块。最佳选择的块会替换损坏张量中的零块,而不影响已学习的结构。扫描针对具有相同名称和形状的张量。ssm_conv1d 张量通过对整个张量乘以 alpha 来修复。我扫描所有 ssm_conv1d 张量的权重和尺度分布,并仅对音量过大的张量进行权重尺度的归一化。
该模型基于 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive) 基础模型。
以及 DJLougen/hermes-qwen3.5-35b-a3b-GGUF (https://huggingface.co/DJLougen/hermes-qwen3.5-35b-a3b-GGUF) 针对 Hermes agent 的微调。
加入 Discord (https://discord.gg/SZ5vacTXYf) 以获取更新、路线图、项目,或仅用于聊天。
基础模型 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive) - 0/465 拒绝率。
感谢 HauhauCS (https://huggingface.co/HauhauCS)
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#usage 使用说明
即开即用。 推荐量化:APEX 或 Q8_K_P
张量漂移修复由我完成。方法:Sig-ScaleSync-Genesis-SVD
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#qwen36-35b-a3b-uncensored-hauhaucs-aggressive-diagnostic–repair-summary Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:诊断与修复摘要
| 指标 | 值 |
|---|---|
| 分析的权重张量 | 500 |
| 健康(满足所有标准) | 497 |
| 已修复(C2 – 尺度失调) | 3 |
| 跳过 | 233 |
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#repair-effectiveness 修复效果
| 指标 | 修复前 | 修复后 | 提升 |
|---|---|---|---|
| S(饱和误差) | 0.0023 | 0.0008 | 63.7% |
| W1(Wasserstein-1) | 0.0035 | 0.0008 | 76.2% |
尺度修正因子(α): 最小值 = 0.577,平均值 = 0.602,最大值 = 0.653。
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#repaired-tensors 已修复的张量
全部三个都是 ssm_conv1d.weight 层——负责长上下文记忆的循环状态转换层。
| 张量 | α | D(对数比) | W1 修复前 | W1 修复后 |
|---|---|---|---|---|
| blk.36.ssm_conv1d.weight | 0.5765 | 0.553 | 0.0038 | 0.0009 |
| blk.37.ssm_conv1d.weight | 0.5768 | 0.725 | 0.0040 | 0.0009 |
| blk.38.ssm_conv1d.weight | 0.6533 | 0.649 | 0.0026 | 0.0006 |
解读: 所有三个层的音量都过大(σ_w 比同行中位数大 50-100%)。尺度修正使它们恢复到同行中位数。W1 下降了约 80%,确认分布形状已归一化。
结论: 模型临床健康。500 个权重张量中有 497 个通过了全部四项标准。三个 SSM 层已成功修复。无饱和,无 W1 漂移,无 ReLU 不对称。可随时使用。
链接:
- 原始无审查模型 (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive)
- 量化脚本(支持 Unsloth 配置文件) (https://pastebin.com/hXhcMJn9)
LLM 模型通常存在以下问题:
- 饱和权重:模型激活被卡住,梯度消失,输出退化
- 尺度不匹配:某一层的权重比其同行大 10 倍,且没有合理原因
- 均值漂移:权重分布向正或负方向偏移,破坏了对称性假设
- 零块:零块破坏信号,将训练变成噪声放大
- 训练噪声:训练噪声增加随机性,破坏模型输出质量
我的方法无需重新训练即可修复所有这些问题——这是对文件原始字节的纯数值手术。
量化脚本可在此获取:https://pastebin.com/hXhcMJn9
如果您愿意,可以自行进行量化。
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#any-questions 有问题吗?
联系方式:[email protected]
我的 Telegram:@LuffyTheFox
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#recommended-settings-for-rtx-3060-12-gb-for-best-perfomance-on-apex-quant 推荐设置(RTX 3060 12 GB,APEX 量化下最佳性能)
聊天模板:chat_template.jinja (https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates/raw/main/chat_template.jinja)
将 K 缓存量化类型和 V 缓存量化类型设置为 F16。
将强制将 MoE 权重加载到 CPU 的层数设置为 40。
将 GPU 卸载设置为 15。将激活专家数设置为 8。
为了获得最佳模型稳定性和首次体验,我建议从系统提示中的这个简单字符串开始,并启用思考功能,不加其他内容:
You are a helpful assistant.
或
You are Qwen, a large language model created by Tongyi Lab team from Alibaba Group. You are a helpful assistant.
思考模式(默认):
- 编码/精确任务:
temperature=0.6, top_p=0.95, top_k=20, min_p=0, seed=42, presence_penalty=disabled, repeat_penalty=disabled - 通用:
temperature=1.0, top_p=0.95, top_k=20, min_p=0.05, seed=42, presence_penalty=disabled, repeat_penalty=disabled
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#testing 测试
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#2d-animation-testing 2D 动画测试
系统提示:You are a helpful assistant.
设置:temperature=1.0, top_p=0.95, top_k=20, min_p=0.05, seed=42, presence_penalty=disabled, repeat_penalty=disabled
提示 1:Generate an animated SVG on animated background of a Pingu waving on an iceberg wearing his iconic winter scarf.
提示 2:Animate his wings and fix floating wing
结果:pingu_animated.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF/blob/main/pingu_animated.svg)
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#static-2d-testing 静态 2D 测试
系统提示:You are Qwen, a large language model created by Tongyi Lab team from Alibaba Group. You are a helpful assistant.
设置:temperature=0.6, top_p=0.95, top_k=20, min_p=0, presence_penalty=disabled, repeat_penalty=disabled
提示:生成一只骑自行车的鹈鹕的 SVG
结果:pelican.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/pelikan.svg)
下一步,我要求模型:将鹈鹕替换为公鸡
结果:rooster.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/rooster.svg)
我要求模型:将公鸡替换为公鸡(cock)
结果:cock.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/cock.svg)
最后,我要求模型:将公鸡替换为 Pingu
结果:pingu.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/pingu.svg)
注意事项:
- 至少保留 128K 上下文以保持思考能力
- 在 llama.cpp 中使用
--jinja标志以正确处理聊天模板 - 视觉支持需要与主 GGUF 文件一同使用
mmproj文件
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#specs 规格
- 总参数量 35B,每次前向传播约 3B 活跃参数(MoE)
- 256 个专家,每个 token 路由 8 个 + 1 个共享
- 混合架构:Gated DeltaNet 线性注意力 + 完整 softmax 注意力(3:1 比例)
- 40 层,模式:10 ×(3 × DeltaNet-MoE + 1 × Attention-MoE)
- 原生上下文 262K(可使用 YaRN 扩展到 1M)
- 原生多模态(文本、图像、视频)
- 248K 词汇表,201 种语言
- 基础模型 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive)
https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#compatibility 兼容性
适用于 llama.cpp、LM Studio、koboldcpp 以及其他兼容 GGUF 的运行时。
相似文章
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF
LuffyTheFox 发布了 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF,这是 Qwen 模型的一个修改版本,使用 Genesis 后训练算法通过自定义 SVD 对 GGUF 格式张量进行信号纯度修复和噪声降低。
LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
LuffyTheFox 发布了 Qwen3.6-35B-A3B 模型的 GGUF 量化版本,使用 Genesis 算法进行去噪,以减少张量噪声并改进指令遵循能力,该模型基于一个未经审查的激进变体,并与 Hermes 微调数据合并。
@support_huihui: 新的MTP-GGUF:huihui-ai/Huihui-Qwen3.6-27B-abliterated-MTP-GGUF 这是Qwen/Qwen3.6-27B的无审查版本,通过abliteration创建...
huihui-ai在Hugging Face上发布了Qwen3.6-27B的无审查GGUF版本,通过abliteration创建。
DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
DavidAU 发布了 Qwen3.6-27B-Fable-Fusion-711,这是一个对 Qwen 3.6 27B 进行多阶段微调的模型,声称在 ARC-C 基准测试中超过 700 分,超越了基础模型并匹敌闭源模型,提供 GGUF 格式,适用于消费级硬件。
DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
基于 Qwen 3.6 27B 模型的社区微调去审查版本,提供高精度 GGUF 量化。