Google AI Edge Gallery v1.0.13 和 v1.0.14 更新:Gemma 4 多令牌预测、Pixel TPU 支持、实验性 MCP、新技能,以及聊天历史保存功能
摘要
Google AI Edge Gallery v1.0.13 和 v1.0.14 更新增加了对 Gemma 4 的多令牌预测支持、Pixel TPU 优化、实验性 MCP、新技能以及聊天历史保存功能,提升了设备端生成式 AI 能力。
查看缓存全文
缓存时间: 2026/05/19 22:49
google-ai-edge/gallery 来源:https://github.com/google-ai-edge/gallery # Google AI Edge Gallery ✨ 许可证 GitHub 发布(最新日期)(https://github.com/google-ai-edge/gallery/releases) 探索、体验并评估 Google AI Edge 驱动的设备端生成式 AI 未来。
AI Edge Gallery 是首选的移动设备端开源大语言模型(LLM)运行平台。直接在您的硬件上体验高性能生成式 AI——完全离线、私密且极速。
最新特性:Gemma 4
最新版本正式支持新发布的 Gemma 4 系列。作为本次发布的核心,Gemma 4 让您能够测试设备端 AI 的前沿能力。体验先进的推理、逻辑和创造力,无需将任何数据发送至服务器。
| 立即从 Google Play 安装应用 | 立即从 App Store 安装应用 |
|---|---|
对于无法访问 Google Play 的用户,请从 最新发布 安装 apk(https://github.com/google-ai-edge/gallery/releases/latest/)
应用预览
✨ 核心功能
- Agent 技能:将您的 LLM 从对话助手转变为主动式助理。使用 Agent 技能卡片,通过 Wikipedia 等工具增强模型能力,实现事实锚定、交互式地图和丰富的可视化摘要卡片。您还可以从 URL 加载模块化技能,或在 GitHub Discussions 中浏览社区贡献。
- 带思考模式的 AI 聊天:进行流畅的多轮对话,并开启全新的思考模式,一窥模型“内部”运作。该功能让您观察模型的逐步推理过程,非常适合理解复杂问题解决。注意:思考模式目前适用于支持的模型,从 Gemma 4 系列开始。
- 提问图片:利用多模态能力,通过设备摄像头或相册识别物体、解决视觉谜题或获取详细描述。
- 语音速记:实时将语音录音转录并翻译为文字,使用高效的设备端语言模型。
- 提示实验室:一个专用工作区,用于测试不同提示和单轮用例,并精细控制模型参数(如温度、top-k)。
- 移动端操作:解锁完全由 FunctionGemma 270m 微调模型驱动的离线设备控制和自动化任务。
- 迷你花园:一个有趣的实验性小游戏,使用自然语言通过 FunctionGemma 270m 微调模型种植并收获虚拟花园。
- 模型管理与基准测试:Gallery 是一个灵活的沙箱,支持多种开源模型。轻松从列表下载模型或加载自定义模型。无缝管理您的模型库,并运行基准测试,了解每个模型在您特定硬件上的表现。
- 100% 设备端隐私:所有模型推理均在设备硬件上直接完成。无需联网,确保您的提示、图片和敏感数据完全私密。
🏁 快速上手!
- 检查操作系统要求:Android 12 及以上版本,以及 iOS 17 及以上版本。
- 下载应用:
- 从 Google Play(https://play.google.com/store/apps/details?id=com.google.ai.edge.gallery)或 App Store(https://apps.apple.com/us/app/google-ai-edge-gallery/id6749645337)安装应用。
- 对于无法访问 Google Play 的用户:从 最新发布 安装 apk(https://github.com/google-ai-edge/gallery/releases/latest/)
- 安装并探索: 如需详细的安装说明(包括企业设备)和完整用户指南,请访问我们的 项目 Wiki(https://github.com/google-ai-edge/gallery/wiki)!
🛠️ 技术亮点
- Google AI Edge: 用于设备端机器学习的核心 API 和工具。
- LiteRT: 用于优化模型执行的轻量级运行时。
- Hugging Face 集成: 用于模型发现和下载。
⌨️ 开发
请查看开发说明了解如何在本地构建应用。
🤝 反馈
这是一个实验性 Beta 版本,您的意见至关重要!
- 🐞 发现 bug? 在此报告!(https://github.com/google-ai-edge/gallery/issues/new?assignees=&labels=bug&template=bug_report.md&title=%5BBUG%5D)
- 💡 有想法? 建议新功能!(https://github.com/google-ai-edge/gallery/issues/new?assignees=&labels=enhancement&template=feature_request.md&title=%5BFEATURE%5D)
📄 许可证
依据 Apache 许可证 2.0 版本授权。详情请参阅 LICENSE 文件。
🔗 实用链接
- 项目 Wiki(详细指南)(https://github.com/google-ai-edge/gallery/wiki)
- Hugging Face LiteRT Community(https://huggingface.co/litert-community)
- LiteRT-LM(https://github.com/google-ai-edge/LiteRT-LM)
- Google AI Edge 文档(https://ai.google.dev/edge)
相似文章
Google宣布为Pixel 10的TPU优化的Gemma 4(两分钟阅读)
Google宣布了为Pixel 10的TPU优化的Gemma 4 E2B,实现了设备端多模态AI能力,如离线聊天、图像识别和音频转录。
Google 正在更新 Gemma 4 的聊天模板,大幅修复工具调用并减少“惰性”,在 Hopper GPU 上启用 Flash Attention 4,同时提供关于如何操作及改进其视觉能力的交互式指南!
Google 更新了 Gemma 4 的聊天模板,显著修复了工具调用,减少了惰性,在 Hopper GPU 上启用了 Flash Attention 4,并发布了交互式视觉指南。这些更新现已可在 Hugging Face 上获取。
将 Gemma 4 12B 引入您的笔记本电脑:通过 Google AI Edge 解锁本地、自主工作流
谷歌宣布通过 Google AI Edge 在笔记本电脑上提供 Gemma 4 12B,借助 AI Edge Gallery 和 Eloquent 等工具,支持本地、自主和多模态工作流。
google/gemma-4-31B-it-assistant
Google DeepMind 发布了 Gemma 4,这是一个开源权重的多模态模型家族,支持文本、图像、视频和音频,具备增强的推理和编码能力,并通过多令牌预测(MTP)实现高达 2 倍的解码速度提升。
Gemma 4 发布:前沿多模态智能,端侧可用
Google DeepMind 发布 Gemma 4,这是一系列前沿多模态模型,已在 Hugging Face 上以 Apache 2 协议开源,针对端侧部署进行了优化,并支持多种推理框架。