refusal-filters

标签

Cards List
#refusal-filters

那么,模型究竟是如何学会制作冰毒的呢?

Reddit r/artificial · 2026-06-20

一篇评论文章认为,AI模型从训练数据中获取危险知识,而像Anthropic和OpenAI这样的公司依赖容易破解的拒绝过滤器,而非真正移除有害能力,优先考虑速度而非安全。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈