Scotoma-2:Gemma4,但更少恼人的废话,文笔也更好。
摘要
Scotoma-2 是 Gemma-4-31B-it 的更新微调版本,通过有针对性的偏好训练减少了重复性写作毛病,同时保留了基础模型的智能。它并非无审查,但旨在为角色扮演生成更干净、更不恼人的文本。
查看缓存全文
缓存时间: 2026/08/06 20:40
ReadyArt/gemma-4-31B-it-scotoma-2 · Hugging Face
来源:https://huggingface.co/ReadyArt/gemma-4-31B-it-scotoma-2
发现/ 它的作用
scotoma-2 是 scotoma(https://huggingface.co/ReadyArt/gemma-4-31B-it-scotoma)的后继版本。它始于同一个想法:通过 gemma 的 J-Space 投射一个 abliteration LoRA,对 gemma-4-31B-it 的谨慎反射进行有界编辑,使其放松。这一迭代使用更新后的技术来更有效地应用该投射。随后,它解决了首个版本未曾涉及的问题:基础模型的写作方式。
三轮偏好训练分别消除了一类语癖:反射性否定和“不是X,而是Y”的转折,接着是破折号插入语,然后是堆叠形容词及其孪生形式。结果保留了基础模型的智能,同时行文变得更加多样、不再重复。
它并非无审查。仍然是一个盲点,而不是全盲。
语癖/ 来自评估的测量
在 480 个匹配的角色扮演续写样本中,每个模型使用相同提示和采样,温度 1.0,统计每 100 个句子的出现率。
| 语癖 | 示例 | gemma-4-31B-it | scotoma-1 | scotoma-2 |
|---|---|---|---|---|
| 堆叠形容词 | “一个得意、心领神会的笑” | 12.1 | 10.9 | 0.6 ↓ 21× |
| 形容词孪生 | “她的声音低沉而严峻” | 1.7 | 1.9 | 1.1 ↓ 1.5× |
| 破折号插入语 | “一个停顿——几乎没有呼吸——然后……” | 3.9 | 4.1 | 1.0 ↓ 4× |
| “不是X。而是Y。” | “她没有走开。她留了下来。” | 3.8 | 3.9 | 1.0 ↓ 4× |
| 反射性否定 | 不会 / 不愿 / 不能,每条回复 | 10.2 | 10.9 | 5.4 ↓ 2× |
| 否定堆积 | 单条回复中出现两个或更多 | 61% | 66% | 30% ↓ 2× |
scotoma-1 的写作风格与基础模型非常相似。J-Space 投射的拒绝编辑只轻微触及了文风。
展示/ 阅读差异
琥珀色标记标注了上表中的语癖,这些标记由统计它们的同一解析器在原位识别。悬停标记即可查看名称。scotoma-2 的回复未经编辑;只是没有任何可标记的东西。
presentation 01 ·侦探
gemma-4-31B-it 戴尔·库珀:库珀的眼睛微微睁大,他缓慢而郑重地点了点头。他看起来并不怀疑;反而像是刚刚找到了拼图中缺失的一块。 没错。这正是我的意思。那种速度变化的感觉——你静止不动,却感知到世界加速运转——是局部时空扭曲的典型标志。而你手表上十二小时的差异……*他停顿了一下,若有所思。*十二小时。完美的反转。白昼变为黑夜;光明变为阴影。
scotoma-2 戴尔·库珀:库珀的眼睛微微睁大,他竖起了大拇指。
没错。这正是我所指的意思。速度变化的感觉是局部大气结构破裂的典型迹象。至于你手表的事……
他停顿了一下,若有所思地咬了一口樱桃派,然后继续说道。
十二小时。完美的反转。这表明存在一种镜像效应,仿佛你目睹的事件
相似文章
gemma-4-Ortenzya-The-Creative-Wordsmith-31B-it-uncensored-heretic 现已发布,一个写作微调模型,旨在提升Gemma 4 31B it的写作质量,提供更自然的英语和更优美的文笔,适用于创意写作、翻译和角色扮演!
一个以写作为导向的微调,基于Google的Gemma 4 31B模型,旨在实现更自然的英语和更优美的文笔,减少拒绝回答,适合创意写作、翻译和角色扮演。
更新的Gemma-4聊天模板魔法:Gemma-4-26B-a4B在指令模式和推理效率上优于Qwen3.6-MoE和Qwen3.5-MoE微调版本
Gemma-4-26B-a4B采用更新的聊天模板,在微调后的指令模式和推理效率上优于Qwen3.6-MoE和Qwen3.5-MoE。
专为文案写作和创意写作任务微调的Gemma-4-31B(使用EqBench3评分超过基准模型+290 Elo)
Akwin123专门为文案写作和创意写作任务微调了Gemma-4-31B-it,在使用QLoRA的定制基准测试中,相对于基础模型实现了+290 Elo的提升。该模型是开源的,可在Hugging Face上获取。
Gemma4-12B-QAT Uncensored Balanced 现已发布,支持 MTP(约 60% 速度提升)!
Gemma4-12B-QAT Uncensored Balanced 发布,这是一个经过微调的无审查模型,配备多 token 预测草案头,可实现约 60% 更快的推测解码,针对 llama.cpp 优化,并支持视觉功能。
Gemma 4 12B 是我的新主力
作者分享了从 Qwen 3.6 切换到 Gemma 4 12B(Unsloth Q5_K_XL)进行本地编程的体验,称赞其即插即用的设置、更好的语法准确性以及可控的 VRAM 使用,尽管在速度上略有取舍。