@googlegemma: 查看由 @ivanfioravanti 在此发布的原始帖子:
摘要
这是一个使用 Apple MLX 在 iPad 上本地运行 Gemma 4 E4B AI 模型的演示,被展示为一个适合儿童的有趣应用。
查看缓存全文
缓存时间: 2026/08/20 02:56
请查看@ivanfioravanti的原文:https://t.co/PJUOUPccUP
Ivan Fioravanti ᯅ (@ivanfioravanti): MLX:通过Apple MLX技术在iPad本地运行的汤姆·里德尔日记,背后由Gemma 4 E4B模型驱动。
孩子们对这种东西肯定会兴奋不已,不是吗?🔥
相似文章
@rohanpaul_ai:Gemma 4(特别是其面向边缘优化的 E2B 与 E4B 量化版)通过 Locally 等应用,在 iPhone 上实现完全离线运行……
Google 的 Gemma 4 E2B/E4B 量化模型现已通过 Locally AI 等应用,在 iPhone 上实现完全离线运行,借助 Apple Neural Engine 进行本地推理。
@rohanpaul_ai: 设备端小模型的可能性太多了。@adrgrondin 正在 iPhone 17 Pro 上运行 Google 的 Gemma 4 E2B。大约 4…
Google 的 Gemma 4 E2B 通过 MLX 优化在 iPhone 17 Pro 上运行演示,达到约 40 tokens/秒,支持 128K 上下文以及离线思考模式,适用于编程和数学。
@ivanfioravanti:在 M5 Max 上用 oMLX 本地运行 @karpathy 的 autoresearch,借助 6bit 量化的 gemma-4-26b-a4b-it 训练 Gemma 4 E2B……
开发者 Ivan Fioravanti 展示如何在 Apple Silicon 上本地运行 Andrej Karpathy 的 autoresearch 项目,使用 6bit 量化 Gemma-4-26B 模型,暗示已成功训练 Gemma 4 E2B IT 变体。
谷歌的 Gemma 4 12B 刚刚发布 —— 下面教你如何在 Mac 上本地运行它
Google 发布了 Gemma 4 12B,这是一款基于 Apache 2.0 开源协议的多模态模型,支持文本、视觉和音频处理,上下文窗口达 256K。本文提供了一份指南,介绍如何在 Mac 上使用 Ollama、LM Studio 或 llama.cpp 本地运行该模型。
@MiaAI_lab:我使用Fable-5风格推理和助手轨迹对Gemma 4 12B进行了微调,并将其发布为Gemmable 4 12b。**可用…
Mia-AiLab发布了Gemmable 4 12B,这是Google Gemma 4 12B模型的微调版本,使用了Fable-5风格推理和助手轨迹,提供GGUF和MLX格式用于本地推理。