Google 挫败 OpenAI 和 Anthropic 的最佳方式是发布一款 120B 密集多模态 Gemma 模型

Reddit r/LocalLLaMA 模型

摘要

建议 Google 发布一款 120B 密集多模态 Gemma 模型,以与 OpenAI 和 Anthropic 竞争,针对那些对中文模型持谨慎态度的西方企业。

这两家领先的实验室已经感受到来自 Qwen 等模型的巨大威胁,但我认为西方有很多企业和组织对使用中文模型感到不适。我相信这些组织会热衷于一个具有 Google 品牌、接近前沿的开源权重模型,这是破坏 OpenAI 和 Anthropic IPO 的完美方式。请务必这样做,Google。
查看原文

相似文章

google/gemma-4-26B-A4B-it

Hugging Face Models Trending

Google DeepMind 发布 Gemma 4,一系列开放权重的多模态模型,参数量从2.3B到31B,支持文本、图像、视频和音频输入。模型具有256K上下文窗口,MoE和密集架构,增强的推理能力,并针对从移动设备到服务器的部署进行优化。

推出 Gemma 3

Google DeepMind Blog

Google 推出了 Gemma 3,这是一套轻量级开源模型集合(1B、4B、12B、27B),设计用于在单个 GPU 或 TPU 上运行,支持 140+ 种语言、128k 上下文窗口和多模态功能。这些模型在保持高效性能的同时,性能超越了 Llama 3 和 DeepSeek-V3 等更大的竞品,适合边缘设备部署。

google/gemma-4-31B-it-assistant

Hugging Face Models Trending

Google DeepMind 发布了 Gemma 4,这是一个开源权重的多模态模型家族,支持文本、图像、视频和音频,具备增强的推理和编码能力,并通过多令牌预测(MTP)实现高达 2 倍的解码速度提升。