capability-safety-confound

标签

Cards List
#capability-safety-confound

基准评估:评估小语言模型的自动化安全基准

arXiv cs.AI ↗ · 2026-08-19 缓存

本文评估了小语言模型的自动化安全基准,发现判断中的高度模糊性损害了可靠性,并揭示了能力-安全性混淆。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈