safety-evals

标签

Cards List
#safety-evals

你的评估会出问题,而你却察觉不到

Reddit r/ArtificialInteligence · 2026-05-19 缓存

讨论当前LLM评估方法的结构性弱点,这些方法未能预见能力的质变,并指出开发主动评估基础设施是实现安全能力跃升的关键瓶颈。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈