@mervenoyann: DiffusionGemma 已发布,它受计算限制,因此相比其他 Gemma-4 模型快 4 倍(H100 上 1k tok/s),在……方面也很出色

X AI KOLs Following 模型

摘要

DiffusionGemma 已发布;它受计算限制,比其它 Gemma-4 模型快 4 倍(H100 上 1k tok/s),擅长编码任务,包括 3D 生成和前端开发。

DiffusionGemma 已发布 🔥 它受计算限制,因此相比其他 Gemma-4 模型快 4 倍(H100 上 1k tok/s)💨 在编码方面也很出色,可生成并迭代从 3D 生成到前端的任何代码 ⤵️ https://t.co/NAjEaml6dV
查看原文
查看缓存全文

缓存时间: 2026/06/10 17:53

DiffusionGemma 发布了 🔥

它是计算密集型模型,因此比其他 Gemma-4 模型快 4 倍(H100 上每秒 1000 token)💨

在编码方面也很出色,可以生成并迭代从 3D 生成到前端的任何代码 ⤵️ https://t.co/NAjEaml6dV

相似文章

DifussionGemma 4 on 4x7900xtx

Reddit r/LocalLLaMA

报告了在四块AMD 7900 XTX GPU上使用vllm运行DiffusionGemma 26B,生成时达到100 tps,总时间约为45-60 t/s(包括提示处理等待时间),并分享了性能指标和设置命令。

DiffusionGemma: 文本生成速度提升4倍

Hacker News Top

Google推出DiffusionGemma,这是一个实验性的26B MoE开源模型,通过文本扩散技术,在GPU上实现高达4倍的文本生成速度提升,针对速度要求高的交互式本地工作流。