@_ar9av: 所以谷歌似乎将 Gemini Nano 4B 大语言模型(上下文限制:9216 tokens)内置于 Chrome 中。我尝试将其暴露出来……

X AI KOLs Timeline 工具

摘要

一位开发者发现谷歌将 Gemini Nano 4B 大语言模型内置到 Chrome 中,并创建了一个兼容 OpenAI 的 API 封装用于本地使用,无需 API 密钥或外部网络调用。

所以谷歌似乎将 Gemini Nano 4B 大语言模型(上下文限制:9216 tokens)内置于 Chrome 中 我尝试将其以 OpenAI 兼容 API 的形式暴露出来供本地使用,这样基本上不需要 API 密钥、不需要外部网络调用、也不需要 ollama 演示和仓库如下 ↓ https://t.co/RUtcrzk1aF
查看原文
查看缓存全文

缓存时间: 2026/06/17 22:04

显然,Google 在 Chrome 浏览器中内置了 Gemini Nano 4B 大语言模型(上下文限制:9216 tokens)。

我尝试将其以兼容 OpenAI 的 API 形式暴露给本地环境使用——无需 API 密钥、无需外部网络调用、也无需安装 ollama。

演示和仓库如下 ↓

唯一缺点是不支持多模态,仅能处理文本。

也就是说,Chrome 已经自带了一个完全离线运行在电脑上的免费 AI 聊天机器人,而这个仓库能帮你开启它,并提供一个简单的聊天窗口与之对话。

相似文章

直接在PC上运行Chrome的小型Gemma4(即Gemini Nano),无需GPU

Reddit r/LocalLLaMA

一位开发者创建了一个名为Dobby的Chrome扩展程序,可以在PC上本地运行谷歌的Gemma4(Gemini Nano),无需GPU,只需Chrome和16GB内存。该扩展提供了一个简单的界面,用于与模型交互,完成拼写检查或摘要等任务。

有人有4GB的"Gemini Nano"模型的GGUF吗?

Reddit r/LocalLLaMA

用户询问Chrome为设备端功能静默下载的约4GB AI模型(可能是Gemini Nano)的具体身份,并请求获得GGUF版本以便通过llama.cpp本地运行。

Google 正在推出自己的 OpenClaw 版本

The Verge

Google 推出 Gemini Spark,一款由 Gemini 3.5 Flash 驱动的始终在线 AI 代理,支持后台运行、通过 MCP 集成 Workspace 和第三方应用,并更新了 Antigravity。