omni-llm

标签

Cards List
#omni-llm

MCBench: 面向全模态大语言模型的多语境安全评估基准

arXiv cs.CL · 2026-06-05 缓存

MCBench是一个新基准,用于评估全模态大语言模型在视觉、音频和文本模态下的安全性。它包含1196个场景,并发现当前模型难以进行跨模态安全推理。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈