Qwen与Gemma的僵局情况(针对基准测试分数)?

Reddit r/LocalLLaMA 新闻

摘要

关于Qwen和Gemma AI模型在基准测试性能中可能存在的僵局情况的讨论或报告。

暂无内容
查看原文

相似文章

Qwen3.6-35B 与 Gemma4-26B 在 7900 XTX 上的对比

Reddit r/LocalLLaMA

一项详细的基准测试对比了 Radeon 7900 XTX 上的 Qwen3.6-35B 和 Gemma4-26B,结果显示尽管 Gemma 的 token 生成速度较慢,但端到端快了约 20%,原因是 Qwen 因内部推理生成了约两倍的 token。文章建议:在吞吐量受限的批量任务中使用 Qwen,在延迟敏感的单次请求中使用 Gemma。