我将Gemma4-31B扩展至44B(88层)——既然Google不愿发布比31B更大的模型
摘要
一位用户将Google的Gemma4-31B模型扩展至44B参数、88层,并批评Google未发布更大版本。
暂无内容
相似文章
更多Gemma 4模型即将推出
谷歌宣布即将推出更多Gemma 4模型,可能包含一个120B参数的模型。
与Gemma 4 31B对话!
宣布推出Gemma 4 31B,这是谷歌的一款新的大型语言模型。
google/gemma-4-26B-A4B-it
Google DeepMind 发布 Gemma 4,一系列开放权重的多模态模型,参数量从2.3B到31B,支持文本、图像、视频和音频输入。模型具有256K上下文窗口,MoE和密集架构,增强的推理能力,并针对从移动设备到服务器的部署进行优化。
*咳* gemma3 270M *咳*
谷歌发布了Gemma 3,一个270M参数的语言模型。
我没有放弃 - extGemma4-40_5B 回归
一位用户分享了他们成功扩展微调后的 Gemma 模型的经历,通过插入新层并克服初始化失败,创建了 extGemma4-40_5B,同时保留了原始模型的能力。