preference-training

标签

Cards List
#preference-training

Scotoma-2:Gemma4,但更少恼人的废话,文笔也更好。

Reddit r/LocalLLaMA · 3天前 缓存

Scotoma-2 是 Gemma-4-31B-it 的更新微调版本,通过有针对性的偏好训练减少了重复性写作毛病,同时保留了基础模型的智能。它并非无审查,但旨在为角色扮演生成更干净、更不恼人的文本。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈