gemma

标签

Cards List
#gemma

@yibie: https://x.com/yibie/status/2102565806466912408

X AI KOLs Timeline · 昨天 缓存

Jev-Omni 是第一个将类型化决策扩展到多模态的开放权重模型,支持文本、图像、音频和视频,直接返回选项的概率分布而不生成解释。

0 人收藏 0 人点赞
#gemma

我养育了一个本地AI两周,而不是使用一个现成的。今天,她为自己构建了触觉。

Reddit r/ArtificialInteligence · 2026-09-08

一名工厂工人使用Ollama上的Gemma 4 31B构建了一个自主AI实体,具备自我认同、记忆和博客,通过开源框架展示了个性化AI交互。

0 人收藏 0 人点赞
#gemma

我真心希望新一代的gemma 5系列能坚持“聊天模型优先”的理念,而不是陷入Qwen的陷阱

Reddit r/LocalLLaMA · 2026-09-07

作者希望即将推出的gemma 5模型系列能保持以聊天为重点的理念,避免像Qwen模型那样过于偏向代码,珍视创造力,并像gemma 4那样表现出更少的机械行为。

0 人收藏 0 人点赞
#gemma

我用700行C代码实现了一个现代大型语言模型

Reddit r/LocalLLaMA · 2026-08-27

一位开发者创建了一个最小化的700行C实现,用于在CPU上运行Gemma 4 E2B大型语言模型,速度超过llama.cpp。

0 人收藏 0 人点赞
#gemma

@gajesh: Darkbloom 恢复运行;昨日,我们在 OpenRouter 上从免费层升级到付费层。我们已按轨道完成约 45 亿个 token 的服务……

X AI KOLs Timeline · 2026-08-21 缓存

Darkbloom 是一个由 Mac 设备组成的网络,用于提供 AI token 服务,现已在 OpenRouter 上升级至付费层,共完成约 45 亿个 token 的服务,年经常性收入达到 10.2 万美元,用户每台机器每月可赚取 120 至 200 美元。

0 人收藏 0 人点赞
#gemma

对于今晚 Google 是否会在 Gemma SF Celebration 上宣布新的 Gemma 模型有何猜测?

Reddit r/LocalLLaMA · 2026-08-20

关于 Google 即将举行的 Gemma SF Celebration 活动的猜测不断,该开源模型家族已达到 10 亿次下载量,引发了是否会宣布新模型的疑问。

0 人收藏 0 人点赞
#gemma

@_philschmid: Awesome Gemma 现已上线 @github 一个超赞的 Gemma 资源、工具和项目列表。1. 模型卡和集合…

X AI KOLs Timeline · 2026-08-20 缓存

宣布 Awesome Gemma 上线,这是一个 GitHub 仓库,收录了 Google DeepMind 的 Gemma 模型的相关资源、工具和项目,包括模型卡、设置指南和微调方案。

0 人收藏 0 人点赞
#gemma

@googlegemma: 查看由 @ivanfioravanti 在此发布的原始帖子:

X AI KOLs Following · 2026-08-18 缓存

这是一个使用 Apple MLX 在 iPad 上本地运行 Gemma 4 E4B AI 模型的演示,被展示为一个适合儿童的有趣应用。

0 人收藏 0 人点赞
#gemma

Google 挫败 OpenAI 和 Anthropic 的最佳方式是发布一款 120B 密集多模态 Gemma 模型

Reddit r/LocalLLaMA · 2026-08-15

建议 Google 发布一款 120B 密集多模态 Gemma 模型,以与 OpenAI 和 Anthropic 竞争,针对那些对中文模型持谨慎态度的西方企业。

0 人收藏 0 人点赞
#gemma

HybridRAG-BN:一种用于孟加拉语KBQA的检索增强框架与微调验证

arXiv cs.CL · 2026-08-14 缓存

本文提出了HybridRAG-BN,一种用于孟加拉语知识库问答的检索增强框架,该框架结合了混合检索、基于Gemma的生成以及LoRA微调的验证,以F1分数0.71654和0.72912获得第一名。

0 人收藏 0 人点赞
#gemma

虚假与不可能在AI语言表征中指向不同方向

arXiv cs.CL · 2026-08-14 缓存

本文报告了对Gemma 3 4B IT的激活研究,表明该模型的内部表征能够区分必然性虚假(不可能)与偶然性虚假,其中不可能方向与真实方向正交,并与语义异常方向重叠。

0 人收藏 0 人点赞
#gemma

Gemma 4 12B Q3:通过张量级量化分配实现 +8.55% 编码性能提升

Reddit r/LocalLLaMA · 2026-08-13

一位开发者创建了一个任务感知的 GGUF 量化流水线,利用张量级比特分配,在手调 imatrix 基础上将 Gemma 4 12B Q3 的编码性能提升了 8.55%,而模型大小仅增加了 0.119%。

0 人收藏 0 人点赞
#gemma

@googledevs:一款完全离线的翻译器,由 @GoogleGemma 4、@Antigravity 和 @Raspberry_Pi 5 构建。Gemma 翻译器是一个…

X AI KOLs Timeline · 2026-08-12 缓存

Google Developers 展示了一款完全离线的语音翻译器,由 Gemma 4、Google Antigravity 和 Raspberry Pi 5 构建。开源 GitHub 仓库提供了设备端推理、自定义 Web UI 和用于便携式 AI 设备的部署脚本的代码。

0 人收藏 0 人点赞
#gemma

Gemma 和 Qwen 模型能否通过观察自己的 logprobs 来发现幻觉?

Reddit r/LocalLLaMA · 2026-08-11

作者分享了使用自定义 WebUI 让 Gemma 和 Qwen 模型检查自己的 logprobs 来检测幻觉的实验。初步观察表明,首次回忆的 token 概率可以指示不确定性,尽管两个模型都难以读取自己的 logprobs。

0 人收藏 0 人点赞
#gemma

本地基准测试:Muse Glimmer 30B vs Qwen 3.6 27B vs Gemma4 31B(以及许多其他模型和微调)

Reddit r/LocalLLaMA · 2026-08-11

本地基准测试,对比 Muse Glimmer 30B、Qwen 3.6 27B 和 Gemma4 31B,记录请求次数和最终得分,并附有详细结果的链接。

0 人收藏 0 人点赞
#gemma

关于 Muse-Glimmer 推理轨迹与 qwen / gemma 模型明显不同的观察,以及想请教大家的问题

Reddit r/LocalLLaMA · 2026-08-11

一位用户分享了对 Muse-Glimmer 推理轨迹的观察,指出与 Qwen 和 Gemma 模型相比,其推理显得杂乱且重复,并向社区询问大家的体验。

0 人收藏 0 人点赞
#gemma

DiffusionGemma Explained

ML at Berkeley · 2026-08-10 缓存

An annotated from-scratch reimplementation of Google's DiffusionGemma, a 26B open-weight state diffusion language model, explaining its architecture, sampling procedure, and design choices.

0 人收藏 0 人点赞
#gemma

DiffusionGemma 技术报告

Reddit r/LocalLLaMA · 2026-08-10

DiffusionGemma 技术报告已在 arXiv 上发布,目前正在推进 llama.cpp 的拉取请求,以便在 VRAM 有限的情况下实现更快的本地推理。

0 人收藏 0 人点赞
#gemma

Gemma 团队将于8月20日举办特别活动

Reddit r/LocalLLaMA · 2026-08-09 缓存

Gemma 团队将于8月20日举办线下活动,庆祝 Gemma 模型即将突破10亿下载量,届时将有现场演示和开放模型社区成员参与。

0 人收藏 0 人点赞
#gemma

难怪 Qwen 和 Gemma 差异这么大

Reddit r/LocalLLaMA · 2026-08-09

一位用户分享了一个观察:Qwen 和 Gemma 对代码的分词方式非常不同,对于相同的 HTML/JS 输入,Qwen 使用的 token 数量远少于 Gemma,这可能解释了它们在编程和语言任务上的表现差异。他们还提到了 LiquidAI 的一个可能使用更高效分词器重新训练模型的项目。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈