cross-modal-reasoning

标签

Cards List
#cross-modal-reasoning

MCBench: 面向全模态大语言模型的多语境安全评估基准

arXiv cs.CL · 2026-06-05 缓存

MCBench是一个新基准,用于评估全模态大语言模型在视觉、音频和文本模态下的安全性。它包含1196个场景,并发现当前模型难以进行跨模态安全推理。

0 人收藏 0 人点赞
#cross-modal-reasoning

面向主体驱动生成的多模态大语言模型能力挖掘

Hugging Face Daily Papers · 2026-05-25 缓存

本文提出了一种新颖的方法,将扩散模型以多模态大语言模型(MLLMs)为条件,用于主体驱动图像生成,使用基于VAE的身份条件化和双层聚合模块,提高语义理解和身份保持,同时减轻复制粘贴伪影。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈