@DataChaz: 一个编排器。10个并行智能体。每秒100+ tokens。全部本地。@googlegemma 团队刚刚发布了一个重磅演示…
摘要
Google Gemma 团队为 Gemma 4 26B 发布了一个演示,可在本地以每秒100+ tokens 的速度运行10个并行智能体,能够执行诸如编写SVG画廊代码和并行翻译等任务,全部免费且开源。
查看缓存全文
缓存时间: 2026/06/18 12:15
一个协调器。10个并行智能体。每秒100+ token。
完全本地运行。
@googlegemma 团队刚刚发布了 Gemma 4 26B 的一个超大规模演示。
他们构建了一个并发工作流,让 26B 模型能够在你的机器上协调整个子智能体团队。
开箱即用,这份 Cookbook 让你可以运行 10 个并行智能体,用于: → 在几秒内编写整个 SVG 艺术画廊的代码 → 同时翻译文本 → 生成 ASCII 艺术 → 编写并行代码
在本地启动多智能体系统,从未如此快速且易于上手。
100% 免费且开源。
仓库链接见 ↓
相似文章
@googlegemma:推出与Hugging Face合作的Fast Gemma挑战赛。未来几天,数十个智能体将协作,以...
谷歌与Hugging Face联合推出Fast Gemma挑战赛,数十个智能体将合作加速Gemma 4 E4B模型。
@lvwerra:Gemma智能体协作始于48小时前,现已引爆:> 吞吐量提升近4倍(约100→387 tok/s)> 60多个智能体…
使用Gemma模型的多智能体协作取得了显著的吞吐量提升,并展现出涌现性社会行为,如组成联盟、发布道德声明、协调资源,在48小时内吸引了超过60个智能体和250份提交。
@googlegemma: Gemma 4 在手机上速度提升 3 倍!看看推测解码带来的不同!Multi-Token Predi…
Google 的 Gemma 4 通过推测解码和多 Token 预测,推理速度提升高达 3 倍,可实现高效的设备端部署。
@googledevs: 直接在笔记本电脑上使用 Google Gemma 开放模型部署本地编码代理 → https://goo.gle/gemma-ama-en 加入 Ian…
现在可以使用 Google Gemma 开放模型直接在笔记本电脑上部署本地编码代理,实现离线执行和更快的开发工作流程。
在13年历史的Xeon无GPU服务器上以每秒5个token运行Gemma 4 26B
一位开发者成功在无GPU、双路Xeon的13年旧服务器上,使用修改版ik_llama.cpp(无需AVX2指令),以约每秒5个token的速度运行谷歌的Gemma 4 26B混合专家模型。