26b

标签

Cards List
#26b

在4090上以高达475t/s运行DiffusionGemma 26b……以及一些想法

Reddit r/LocalLLaMA · 2026-06-18

一位用户分享了他们在4090 GPU上通过vLLM运行DiffusionGemma 26B的经验,速度高达475t/s,但指出了单用户限制、准确度较低和上下文短等缺点,并认为它不值得替代常规的26B模型。

0 人收藏 0 人点赞
#26b

DiffusionGemma 26B A4B 在我5090上的结果

Reddit r/LocalLLaMA · 2026-06-11

本文介绍了在RTX 5090 GPU上运行DiffusionGemma 26B A4B GGUF模型的基准测试结果及调优参数,通过优化温度设置和量化选择实现最高44%的加速。

0 人收藏 0 人点赞
#26b

关于Gemma4 12b与26a4b的思考,哪个更好?

Reddit r/LocalLLaMA · 2026-06-08

讨论Gemma4 12b和26a4b变体的比较,重点放在写作和聊天等创意任务上。

0 人收藏 0 人点赞
#26b

@0x0SojalSec: SUPER GEMMA 4 26B UNCENSORED GGUF v2 太强了 - 0/100 次拒绝(实际上无审查) - 修复了所有工具调用和令牌化…

X AI KOLs Following · 2026-06-07 缓存

Super Gemma 4 26B Uncensored GGUF v2 是一个社区微调模型,提供无审查的回复,零拒绝,改进的速度,修复了工具调用,针对 llama.cpp 和 vLLM 上的本地推理进行了优化。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈