@_philschmid:我们刚刚发布了 Gemma 4 12B!这是我们首个具备原生音频输入的中型模型。Gemma 4 12B 是一个统一的、无需编码器的多模态模型。

X AI KOLs Following 模型

摘要

我们刚刚发布了 Gemma 4 12B,一个中型多模态模型,支持原生音频输入,仅需 16GB 内存,并以 Apache 2.0 许可证发布。

我们刚刚发布了 Gemma 4 12B!这是我们首个具备原生音频输入的中型模型。Gemma 4 12B 是一个统一的、无需编码器的多模态模型。 🧠 视觉和音频直接接入 LLM。 💻 仅需 16GB 内存。 📊 基准测试接近 26B。 📄 Apache 2.0。https://t.co/o7sKQBHoWx
查看原文
查看缓存全文

缓存时间: 2026/06/03 17:53

我们刚刚发布了 Gemma 4 12B!这是我们首个支持原生音频输入的中型模型。Gemma 4 12B 是一款统一的无编码器多模态模型。

🧠 视觉与音频直连 LLM。 💻 仅需 16GB 内存即可运行。 📊 基准测试逼近 26B 模型。 📄 采用 Apache 2.0 许可。https://t.co/o7sKQBHoWx

相似文章