我创建了一个用于编码的140GB IQ2_XXS REAP量化版GLM 5.2。正在寻找测试者。

Reddit r/LocalLLaMA 模型

摘要

一个用于编码的140GB IQ2_XXS REAP量化版GLM 5.2已被创建,作者正在寻找测试者。

暂无内容
查看原文

相似文章

有人测试过 IQ1_M 342GB 剪枝版 Kimi K3 吗?能用吗?

Reddit r/LocalLLaMA

这是一个高度实验性的 GGUF 版本,基于 2.8T 参数的 Kimi K3 MoE 模型,剪枝了 55% 的专家并量化至约 2.15 bpw(319 GiB)。运行它需要特定的 llama.cpp PR 和自定义补丁,并包含详细的使用说明。

GLM 5.2 Q1_S 对比 Qwen 27B Q8

Reddit r/LocalLLaMA

一位爱好者将高度量化的 GLM 5.2(Q1_S)与高量化版本的 Qwen 27B(Q8)在代码生成任务上进行对比,发现量化程度较低的大模型在质量和完整性上明显优于量化程度较高的小模型。