skill-layer

标签

Cards List
#skill-layer

FORTIS:代理技能中的过度特权基准测试

Hugging Face Daily Papers · 2026-05-09 缓存

FORTIS 基准测试揭示了 LLM 代理在选择技能时频繁超出必要特权的情况,表明在十款前沿模型中过度特权是常态,并在真实用户交互场景下失效。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈