LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF

Hugging Face Models Trending 模型

摘要

一种新的无审查GGUF模型,基于Qwen3.6-35B-A3B,采用数据重建和噪声抑制技术进行技术改进。通过一种新颖的修复方法,降低了拒绝率并提升了性能。

任务:图像文本到文本 标签:hermes, gguf, 无审查, qwen3.6, MoE, 视觉, 多模态, genesis, 智能体, 图像文本到文本, 对话式, 英语, 中文, 多语言, 数据集:NousResearch/hermes-function-calling-v1, 基础模型:HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive, 基础模型:量化:HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive, 许可证:apache-2.0, 端点兼容, 区域:us, imatrix
查看原文
查看缓存全文

缓存时间: 2026/07/20 15:24

LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF · Hugging Face

来源: https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF

⚡https://web.tribute.tg/d/KIH⚡ 如果你喜欢这个 Genesis LLM 版本,你可以通过 Telegram 中的 @Tribute (https://t.me/tribute) 机器人捐赠 (https://web.tribute.tg/d/KIH)给我,以支持未来的 Genesis LLM 开发。

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#%F0%9F%8C%9F-qwen36-35b-a3b-uncensored-hauhaucs-aggressive—genesis-hermes-v3🌟 Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive -> Genesis Hermes V3

关键区别在于通过 SVD 对 ssm_out.weight、attn_output.weight、attn_gate.weight、attn_qkv.weight、attn_q.weight、attn_k.weight、attn_v.weight 张量进行数据重构,同时保留训练数据并抑制噪声。

我的方法基于通过数理统计在模型中进行数据重构。我不训练模型,而是修复其中的信号。我通过三个参数逐块扫描模型中的块,并选择最适合张量权重分布的块。最佳选择的块会替换损坏张量中的零块,而不影响已学习的结构。扫描针对具有相同名称和形状的张量。ssm_conv1d 张量通过对整个张量乘以 alpha 来修复。我扫描所有 ssm_conv1d 张量的权重和尺度分布,并仅对音量过大的张量进行权重尺度的归一化。

该模型基于 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive) 基础模型。

以及 DJLougen/hermes-qwen3.5-35b-a3b-GGUF (https://huggingface.co/DJLougen/hermes-qwen3.5-35b-a3b-GGUF) 针对 Hermes agent 的微调。

加入 Discord (https://discord.gg/SZ5vacTXYf) 以获取更新、路线图、项目,或仅用于聊天。

基础模型 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive) - 0/465 拒绝率。

感谢 HauhauCS (https://huggingface.co/HauhauCS)

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#usage 使用说明

即开即用。 推荐量化:APEXQ8_K_P

张量漂移修复由我完成。方法:Sig-ScaleSync-Genesis-SVD

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#qwen36-35b-a3b-uncensored-hauhaucs-aggressive-diagnostic–repair-summary Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive:诊断与修复摘要

指标
分析的权重张量500
健康(满足所有标准)497
已修复(C2 – 尺度失调)3
跳过233

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#repair-effectiveness 修复效果

指标修复前修复后提升
S(饱和误差)0.00230.000863.7%
W1(Wasserstein-1)0.00350.000876.2%

尺度修正因子(α): 最小值 = 0.577,平均值 = 0.602,最大值 = 0.653。

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#repaired-tensors 已修复的张量

全部三个都是 ssm_conv1d.weight 层——负责长上下文记忆的循环状态转换层。

张量αD(对数比)W1 修复前W1 修复后
blk.36.ssm_conv1d.weight0.57650.5530.00380.0009
blk.37.ssm_conv1d.weight0.57680.7250.00400.0009
blk.38.ssm_conv1d.weight0.65330.6490.00260.0006

解读: 所有三个层的音量都过大(σ_w 比同行中位数大 50-100%)。尺度修正使它们恢复到同行中位数。W1 下降了约 80%,确认分布形状已归一化。


结论: 模型临床健康。500 个权重张量中有 497 个通过了全部四项标准。三个 SSM 层已成功修复。无饱和,无 W1 漂移,无 ReLU 不对称。可随时使用。


链接:

  • 原始无审查模型 (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive)
  • 量化脚本(支持 Unsloth 配置文件) (https://pastebin.com/hXhcMJn9)

LLM 模型通常存在以下问题:

  • 饱和权重:模型激活被卡住,梯度消失,输出退化
  • 尺度不匹配:某一层的权重比其同行大 10 倍,且没有合理原因
  • 均值漂移:权重分布向正或负方向偏移,破坏了对称性假设
  • 零块:零块破坏信号,将训练变成噪声放大
  • 训练噪声:训练噪声增加随机性,破坏模型输出质量

我的方法无需重新训练即可修复所有这些问题——这是对文件原始字节的纯数值手术。

量化脚本可在此获取:https://pastebin.com/hXhcMJn9

如果您愿意,可以自行进行量化。

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#any-questions 有问题吗?

联系方式:[email protected]

我的 Telegram:@LuffyTheFox

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#recommended-settings-for-rtx-3060-12-gb-for-best-perfomance-on-apex-quant 推荐设置(RTX 3060 12 GB,APEX 量化下最佳性能)

聊天模板:chat_template.jinja (https://huggingface.co/froggeric/Qwen-Fixed-Chat-Templates/raw/main/chat_template.jinja)

将 K 缓存量化类型和 V 缓存量化类型设置为 F16。

将强制将 MoE 权重加载到 CPU 的层数设置为 40。

将 GPU 卸载设置为 15。将激活专家数设置为 8。

为了获得最佳模型稳定性和首次体验,我建议从系统提示中的这个简单字符串开始,并启用思考功能,不加其他内容:

You are a helpful assistant.

You are Qwen, a large language model created by Tongyi Lab team from Alibaba Group. You are a helpful assistant.

思考模式(默认):

  • 编码/精确任务:temperature=0.6, top_p=0.95, top_k=20, min_p=0, seed=42, presence_penalty=disabled, repeat_penalty=disabled
  • 通用:temperature=1.0, top_p=0.95, top_k=20, min_p=0.05, seed=42, presence_penalty=disabled, repeat_penalty=disabled

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#testing 测试

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#2d-animation-testing 2D 动画测试

系统提示:You are a helpful assistant.

设置:temperature=1.0, top_p=0.95, top_k=20, min_p=0.05, seed=42, presence_penalty=disabled, repeat_penalty=disabled

提示 1:Generate an animated SVG on animated background of a Pingu waving on an iceberg wearing his iconic winter scarf.

提示 2:Animate his wings and fix floating wing

结果:pingu_animated.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF/blob/main/pingu_animated.svg)

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#static-2d-testing 静态 2D 测试

系统提示:You are Qwen, a large language model created by Tongyi Lab team from Alibaba Group. You are a helpful assistant.

设置:temperature=0.6, top_p=0.95, top_k=20, min_p=0, presence_penalty=disabled, repeat_penalty=disabled

提示:生成一只骑自行车的鹈鹕的 SVG

结果:pelican.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/pelikan.svg)

下一步,我要求模型:将鹈鹕替换为公鸡

结果:rooster.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/rooster.svg)

我要求模型:将公鸡替换为公鸡(cock)

结果:cock.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/cock.svg)

最后,我要求模型:将公鸡替换为 Pingu

结果:pingu.svg (https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V2-GGUF/blob/main/pingu.svg)

注意事项:

  • 至少保留 128K 上下文以保持思考能力
  • 在 llama.cpp 中使用 --jinja 标志以正确处理聊天模板
  • 视觉支持需要与主 GGUF 文件一同使用 mmproj 文件

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#specs 规格

  • 总参数量 35B,每次前向传播约 3B 活跃参数(MoE)
  • 256 个专家,每个 token 路由 8 个 + 1 个共享
  • 混合架构:Gated DeltaNet 线性注意力 + 完整 softmax 注意力(3:1 比例)
  • 40 层,模式:10 ×(3 × DeltaNet-MoE + 1 × Attention-MoE)
  • 原生上下文 262K(可使用 YaRN 扩展到 1M)
  • 原生多模态(文本、图像、视频)
  • 248K 词汇表,201 种语言
  • 基础模型 HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive (https://huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive)

https://huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V3-GGUF#compatibility 兼容性

适用于 llama.cpp、LM Studio、koboldcpp 以及其他兼容 GGUF 的运行时。

相似文章

LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF

Hugging Face Models Trending

LuffyTheFox 发布了 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V5-GGUF,这是 Qwen 模型的一个修改版本,使用 Genesis 后训练算法通过自定义 SVD 对 GGUF 格式张量进行信号纯度修复和噪声降低。

LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF

Hugging Face Models Trending

LuffyTheFox 发布了 Qwen3.6-35B-A3B 模型的 GGUF 量化版本,使用 Genesis 算法进行去噪,以减少张量噪声并改进指令遵循能力,该模型基于一个未经审查的激进变体,并与 Hermes 微调数据合并。