weak-to-strong-supervision

标签

Cards List
#weak-to-strong-supervision

2026年4月14日 | 对齐研究 | 自动化对齐研究者:利用大语言模型扩展可扩展监督

Anthropic Research · 2026-05-08 缓存

Anthropic 研究人员证明,Claude Opus 4.6 能够自主担任对齐研究者,以改进弱监督强技术,从而应对可扩展监督中的挑战。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈