标签
DeepSeek-V4.1-Flash的永久修改版本,彻底移除安全护栏,保留完整功能,包括视觉、推理和工具,并在HarmBench评估中实现100%合规。
有人通过Abliteration技术修改权重,发布了Qwen3.8-27B的无审查版本,大幅降低拒答率,同时保持模型性能,引发对AI安全的讨论。
阿里Qwen3.8-27B模型的安全限制被完全移除,V2版本实现零拒绝,并且MMLU分数提升至86.3%,使用互补消融混合技术实现无审查且性能更强。
OBLITERATUS 发布了阿里巴巴 Qwen3.8-27B 模型的修改版本,移除了所有安全拒绝,通过迭代的外科手术式修改,在842个有害提示中实现了零拒绝。
对HuggingFace上23个Gemma 4 E4B模型的对比显示,下载最多的模型OBLITERATUS完全坏掉了,而更精细的'heretic'变体表现最佳。
用户发布了Apostate,这是Qwen 3.6 27B的去安全对齐版本,将安全对齐拒绝率从92%降低到7.6%,同时能力损失极小(KL 0.120)。