@Ex0byt:激活、切片、拼接、微调数日,外加15小时屏息凝神的NVFP4校准/传播轮次……

X AI KOLs Following 模型

摘要

社区成员发布了Qwen3.6-35B-A3B-PRISM-NVFP4——一款经过多轮、数据集校准、零损耗的NVFP4量化版Qwen模型。

激活、切片、拼接、微调数日,外加15小时屏息凝神的NVFP4校准/传播轮次。我免费奉上Qwen3.6-35B-A3B-PRISM-NVFP4——最高质量的多轮、1024条自定义数据集校准、零损耗NVFP4(支持
查看原文
查看缓存全文

缓存时间: 2026/04/23 12:06

历经数日的模型激活、切片、拼接、微调,以及 15 小时的 NVFP4 校准/传播煎熬,我无偿奉上 Qwen3.6-35B-A3B-PRISM-NVFP4——最高品质的多轮次、1024 条自定义数据集校准、零损失 NVFP4(支持

相似文章

RedHatAI/Qwen3.6-35B-A3B-NVFP4

Hugging Face Models Trending

Red Hat AI 发布 NVFP4 量化的 35B MoE 版 Qwen3.6,在保持 96.28% GSM8K 精度的同时,通过 vLLM 实现 4-bit 推理。

unsloth/Qwen3.8-27B-NVFP4

Hugging Face Models Trending

Unsloth 发布了 Qwen3.8-27B AI 模型的 NVFP4 量化版本,该模型在编码、专业工作、智能体任务和原生视觉语言理解方面提供了增强的能力。

nvidia/Qwen3.6-35B-A3B-NVFP4 · Hugging Face

Reddit r/LocalLLaMA

NVIDIA发布了Qwen3.6-35B-A3B-NVFP4,这是阿里巴巴混合专家多模态语言模型的量化版本,使用Model Optimizer优化以在NVIDIA GPU上部署。