本地测试(更新后的)Gemma 4在OpenCode中的编码表现

Reddit r/LocalLLaMA 模型

摘要

在M5 Pro上使用llama.cpp本地测试了更新后的Gemma 4,使用OpenCode进行编码任务时达到60 tokens/s;后端表现良好,但UI/UX不佳。

Gemma 4已更新(主要是聊天模板),我对其进行了测试。在本地llama.cpp服务器上运行于M5 Pro(48GB),26B A4B(Q6)大约有60t/s,与OpenCode配合良好。对于后端工作效果不错(考虑到其规模),但UI/UX不可接受。观看测试:https://www.youtube.com/watch?v=m4KR_3E_7Uk
查看原文

相似文章

Gemma 4 31B 的能力让我惊讶

Reddit r/LocalLLaMA

一位用户分享了轶事发现:Gemma 4 31B 在理解和重构杂乱的学术代码方面优于 Qwen 3.6 模型,并与 Opus 4.7 能力相当,还突出了一个 Gemma 擅长的基准测试(SciCode)。