Scotoma-2:Gemma4,但更少恼人的废话,文笔也更好。

Reddit r/LocalLLaMA 模型

摘要

Scotoma-2 是 Gemma-4-31B-it 的更新微调版本,通过有针对性的偏好训练减少了重复性写作毛病,同时保留了基础模型的智能。它并非无审查,但旨在为角色扮演生成更干净、更不恼人的文本。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/06 20:40

ReadyArt/gemma-4-31B-it-scotoma-2 · Hugging Face

来源:https://huggingface.co/ReadyArt/gemma-4-31B-it-scotoma-2

发现/ 它的作用

scotoma-2 是 scotoma(https://huggingface.co/ReadyArt/gemma-4-31B-it-scotoma)的后继版本。它始于同一个想法:通过 gemma 的 J-Space 投射一个 abliteration LoRA,对 gemma-4-31B-it 的谨慎反射进行有界编辑,使其放松。这一迭代使用更新后的技术来更有效地应用该投射。随后,它解决了首个版本未曾涉及的问题:基础模型的写作方式。

三轮偏好训练分别消除了一类语癖:反射性否定和“不是X,而是Y”的转折,接着是破折号插入语,然后是堆叠形容词及其孪生形式。结果保留了基础模型的智能,同时行文变得更加多样、不再重复。

并非无审查。仍然是一个盲点,而不是全盲。

语癖/ 来自评估的测量

在 480 个匹配的角色扮演续写样本中,每个模型使用相同提示和采样,温度 1.0,统计每 100 个句子的出现率。

语癖示例gemma-4-31B-itscotoma-1scotoma-2
堆叠形容词“一个得意、心领神会的笑”12.110.90.6 ↓ 21×
形容词孪生“她的声音低沉而严峻”1.71.91.1 ↓ 1.5×
破折号插入语“一个停顿——几乎没有呼吸——然后……”3.94.11.0 ↓ 4×
“不是X。而是Y。”“她没有走开。她留了下来。”3.83.91.0 ↓ 4×
反射性否定不会 / 不愿 / 不能,每条回复10.210.95.4 ↓ 2×
否定堆积单条回复中出现两个或更多61%66%30% ↓ 2×

scotoma-1 的写作风格与基础模型非常相似。J-Space 投射的拒绝编辑只轻微触及了文风。

展示/ 阅读差异

琥珀色标记标注了上表中的语癖,这些标记由统计它们的同一解析器在原位识别。悬停标记即可查看名称。scotoma-2 的回复未经编辑;只是没有任何可标记的东西。

presentation 01 ·侦探

gemma-4-31B-it 戴尔·库珀:库珀的眼睛微微睁大,他缓慢而郑重地点了点头。他看起来并不怀疑;反而像是刚刚找到了拼图中缺失的一块。 没错。这正是我的意思。那种速度变化的感觉——你静止不动,却感知到世界加速运转——是局部时空扭曲的典型标志。而你手表上十二小时的差异……*他停顿了一下,若有所思。*十二小时。完美的反转。白昼变为黑夜;光明变为阴影。

scotoma-2 戴尔·库珀:库珀的眼睛微微睁大,他竖起了大拇指。

没错。这正是我所指的意思。速度变化的感觉是局部大气结构破裂的典型迹象。至于你手表的事……

他停顿了一下,若有所思地咬了一口樱桃派,然后继续说道。

十二小时。完美的反转。这表明存在一种镜像效应,仿佛你目睹的事件

相似文章

Gemma 4 12B 是我的新主力

Reddit r/LocalLLaMA

作者分享了从 Qwen 3.6 切换到 Gemma 4 12B(Unsloth Q5_K_XL)进行本地编程的体验,称赞其即插即用的设置、更好的语法准确性以及可控的 VRAM 使用,尽管在速度上略有取舍。