Google 正在更新 Gemma 4 的聊天模板,大幅修复工具调用并减少“惰性”,在 Hopper GPU 上启用 Flash Attention 4,同时提供关于如何操作及改进其视觉能力的交互式指南!
摘要
Google 更新了 Gemma 4 的聊天模板,显著修复了工具调用,减少了惰性,在 Hopper GPU 上启用了 Flash Attention 4,并发布了交互式视觉指南。这些更新现已可在 Hugging Face 上获取。
查看缓存全文
缓存时间: 2026/07/15 19:57
衷心感谢社区提交修复方案并不断发掘新方法,让 Gemma 变得更好。没有你们,我们做不到!❤️
🤗 准备好体验加速效果了吗?立即在 Hugging Face 下载最新的 Gemma 4 更新:https://t.co/zAtd2yx7FB (5/5)
Gemma 4 - Google 系列
来源:https://huggingface.co/collections/google/gemma-4
- — #### google/gemma-4-31B-it Image-Text-to-Text• 33B• 更新于约 3 小时前 • 12.3M • • 3.21k (https://huggingface.co/google/gemma-4-31B-it)
- — #### google/gemma-4-31B Image-Text-to-Text• 33B• 更新于约 3 小时前 • 817k • 465 (https://huggingface.co/google/gemma-4-31B)
- — #### google/gemma-4-26B-A4B-it Image-Text-to-Text• 27B• 更新于约 3 小时前 • 14.2M • • 1.27k (https://huggingface.co/google/gemma-4-26B-A4B-it)
- — #### google/gemma-4-26B-A4B Image-Text-to-Text• 27B• 更新于约 3 小时前 • 1.06M • 341 (https://huggingface.co/google/gemma-4-26B-A4B)
- — #### google/gemma-4-E4B-it Any-to-Any• 8B• 更新于约 3 小时前 • 5.77M • 1.37k (https://huggingface.co/google/gemma-4-E4B-it)
- — #### google/gemma-4-E4B Any-to-Any• 8B• 更新于约 3 小时前 • 466k • 357 (https://huggingface.co/google/gemma-4-E4B)
- — #### google/gemma-4-E2B-it Any-to-Any• 5B• 更新于约 3 小时前 • 2.78M • 819 (https://huggingface.co/google/gemma-4-E2B-it)
- — #### google/gemma-4-E2B Any-to-Any• 5B• 更新于约 3 小时前 • 111k • 393 (https://huggingface.co/google/gemma-4-E2B)
- — #### google/gemma-4-E2B-it-assistant Any-to-Any• 78M• 更新于约 3 小时前 • 86.2k • 67 (https://huggingface.co/google/gemma-4-E2B-it-assistant)
- — #### google/gemma-4-E4B-it-assistant Any-to-Any• 78.8M• 更新于约 3 小时前 • 262k • 115 (https://huggingface.co/google/gemma-4-E4B-it-assistant)
- — #### google/gemma-4-26B-A4B-it-assistant Any-to-Any• 0.4B• 更新于约 3 小时前 • 285k • 169 (https://huggingface.co/google/gemma-4-26B-A4B-it-assistant)
- — #### google/gemma-4-31B-it-assistant Any-to-Any• 0.5B• 更新于约 3 小时前 • 1.33M • 312 (https://huggingface.co/google/gemma-4-31B-it-assistant)
- — #### google/gemma-4-12B-it-assistant Any-to-Any• 0.4B• 更新于约 3 小时前 • 99.3k • 100 (https://huggingface.co/google/gemma-4-12B-it-assistant)
- — #### google/gemma-4-12B-it Any-to-Any• 12B• 更新于约 3 小时前 • 2.84M • 1.3k (https://huggingface.co/google/gemma-4-12B-it)
- — #### google/gemma-4-12B Any-to-Any• 12B• 更新于约 3 小时前 • 305k • 656 (https://huggingface.co/google/gemma-4-12B)
相似文章
Gemma 4 Chat Template 现在支持保留思考
Google 的 Gemma 4 31B IT 模型现在更新了聊天模板,支持保留思考过程,并改进了空值处理、推理保留和输入验证。
@googlegemma: 我们正在推出对 Gemma 4 的一些重大改进,这得益于社区提供的惊人反馈和贡献!以下是……
Google Gemma 正在推出对 Gemma 4 的重大改进,这些改进源于社区的反馈和贡献,详情参见一条推文串。
Google AI Edge Gallery v1.0.13 和 v1.0.14 更新:Gemma 4 多令牌预测、Pixel TPU 支持、实验性 MCP、新技能,以及聊天历史保存功能
Google AI Edge Gallery v1.0.13 和 v1.0.14 更新增加了对 Gemma 4 的多令牌预测支持、Pixel TPU 优化、实验性 MCP、新技能以及聊天历史保存功能,提升了设备端生成式 AI 能力。
Gemma 4 发布:前沿多模态智能,端侧可用
Google DeepMind 发布 Gemma 4,这是一系列前沿多模态模型,已在 Hugging Face 上以 Apache 2 协议开源,针对端侧部署进行了优化,并支持多种推理框架。
借助 Gemini 3.5 Flash,谷歌将下一波 AI 押注在智能体而非聊天机器人上
谷歌发布了 Gemini 3.5 Flash,这是一款针对编码和自主智能体优化的新 AI 模型,将重点从聊天机器人转向智能体 AI。它的性能优于之前的模型,并为 Antigravity 2.0 和 Gemini Spark 等新产品提供支持。