spectralquant

标签

Cards List
#spectralquant

我们构建了一个Qwen3.5 0.8B的校准感知Q4_K_M量化版,与纯llama.cpp Q4_K_M相比,恢复了96.5%的BF16性能差距(SpectralQuant)

Reddit r/LocalLLaMA · 2026-06-27

Qwen3.5 0.8B使用SpectralQuant的校准感知Q4_K_M量化版,与标准llama.cpp Q4_K_M量化版相比,恢复了96.5%的BF16性能差距。

0 人收藏 0 人点赞
#spectralquant

@anirudhbv_ce: 介绍 SpectralQuant.. 来拯救您的 KV 缓存 :)

X AI KOLs Timeline · 2026-05-18 缓存

SpectralQuant 是一种新的 KV 缓存量化技术,在 Mistral 7B 上实现了 5.95 倍压缩,仅带来 7.5% 的困惑度开销,显著优于 TurboQuant,且每个模型只需 15 秒校准。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈