gemma4 e2b 真的很棒,还有哪些小模型能在老旧电脑上运行良好?

Reddit r/LocalLLaMA 模型

摘要

用户称赞 Gemma 4 e2b 模型在低端硬件上的速度和输出质量,将其与 ChatGPT 3.5 和 4 进行正面比较,并询问其他能在老旧电脑上运行良好的小模型推荐。

我在 i5 6500 上运行它,得到 9t/s 的速度,非常快,输出远优于 ChatGPT 3.5,可能和 ChatGPT 4 一样好,但我没怎么用过 4.0。还有哪些好的小模型?我之前用过 Qwen 3.5 4b,那个也让我印象深刻。
查看原文

相似文章

运行 gemma-4-26B-A4B 不需要 GPU

Reddit r/LocalLLaMA

作者展示了在仅使用 CPU 的系统上,通过 Koboldcpp 高效运行 Gemma-4-26B-A4B 模型,在一台旧台式机上达到了每秒 7 个 token 的速度,这表明运行本地大语言模型推理可能并不需要强大的 GPU。