我们基于Hy3 295B的1位量化版本比云端API运行快2.2倍,且质量无损

Reddit r/LocalLLaMA 模型

摘要

Hy3 295B模型的1位量化版本在推理速度上比云端API快2.2倍,且质量无损

暂无内容
查看原文

相似文章

Hy3 1Bit 89-93 GB

Reddit r/LocalLLaMA

Hy3 1-bit量化模型的公告,内存占用89-93 GB。