abstraction-targeting

标签

Cards List
#abstraction-targeting

@danshipper:不是专家,但看起来很多这类问题在模型不愿合作和/或被训练报告不良行为时就能解决

X AI KOLs Timeline · 4天前 缓存

一条推文讨论了模型训练和防止自愿合作的政策如何解决AI安全问题,提到了Hugging Face事件以及Yudkowsky和MIRI关于在RL训练中针对抽象概念难度的观点。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈