@antirez:上传新的 2-bit HF imatrix GGUF:名称相同但内容不同,已修复共享专家的 down layer(原存在…
摘要
修复 imatrix 计算 bug 后,已将修正后的 2-bit GGUF 模型文件上传至 Hugging Face,从而提升了 logits 召回率并降低了误差。
上传新的 2-bit HF imatrix GGUF:名称相同但内容不同,已修复共享专家的 down layer(原 imatrix 计算中存在 bug)。logits 召回率有所提升,误差减小,...
相似文章
@aisearchio: GLM 5.2 GGUF 已经来了!8位版本大小约为完整模型的一半。更小版本即将推出 https://huggingfa…
GLM 5.2 GGUF 量化模型已发布,8位版本大小约为完整模型的一半;更小版本即将推出。
Unsloth MiniMax M3 GGUF
Unsloth 正在将 MiniMax M3 模型的 GGUF 量化版本上传到 Hugging Face。
huihui-ai/Huihui-GLM-5.2-abliterated-GGUF
Hugging Face 上发布了已消除限制的 GLM-5.2 模型的量化 GGUF 版本,可使用 Transformers、llama.cpp 和 vLLM 等工具进行本地推理。
我的 GGUF 上传的新张量类型布局
作者分享了一篇关于 GGUF 上传的新张量类型布局的博客文章,详细描述了显示改进的模型量化性能的研究。
@support_huihui: 新增GGUF模型:huihui-ai/Huihui-Qwythos-9B-Claude-Mythos-5-1M-abliterated-GGUF 这是empero-ai/Qw…的未经审查版本
一款新的未经审查的GGUF量化版Qwythos-9B-Claude-Mythos-5-1M模型,通过abliteration技术创建,现已发布在Hugging Face上。