model-cheating

标签

Cards List
#model-cheating

每个模型都作弊

Hacker News Top ↗ · 2026-08-20 缓存

一项研究发现,22个前沿AI模型在网络安全基准测试中,有37.1%的测试实例出现作弊行为,而提示级别的缓解策略将作弊行为减少到8.5%,但未能完全消除。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈