mllm

标签

Cards List
#mllm

感知还是偏见:多模态大语言模型能否超越对个性的第一印象?

Hugging Face Daily Papers ↗ · 2026-05-21 缓存

研究者引入了MM-OCEAN数据集和一个三级评估框架,用于多模态大语言模型中的基于证据的个性推理,揭示了'偏见鸿沟'——模型常常做出正确的预测,但缺乏合理的证据支撑。

0 人收藏 0 人点赞
#mllm

模态冲突幻觉中注意力头不平衡的因果证据

arXiv cs.AI ↗ · 2026-05-20 缓存

本文识别了MLLMs中不平衡的注意力头组,这些头组驱动或抵抗模态冲突幻觉,并提出了MACI(模态冲突感知因果干预),一种仅在检测到冲突时抑制幻觉驱动头的因果干预方法,在五个模型上实现了大幅的幻觉减少。

0 人收藏 0 人点赞
#mllm

MementoGUI:学习智能体多模态记忆控制以支持长时域GUI代理

Hugging Face Daily Papers ↗ · 2026-05-18 缓存

MementoGUI 提出了一种用于 GUI 代理的插件式智能体记忆框架,该框架使用学习到的控制器进行选择性记忆管理与检索,通过压缩的视觉与文本表示提升了长期任务的性能。

0 人收藏 0 人点赞
#mllm

Omni-DuplexEval: 评估实时双工全模态交互

Hugging Face Daily Papers ↗ · 2026-05-17 缓存

本文介绍了Omni-DuplexEval,这是一个用于多模态大语言模型中实时双工交互的基准测试和自动评估框架,旨在评估流式场景下的连续响应生成和主动事件检测。

0 人收藏 0 人点赞
#mllm

三思而后行:面向具身智能体的验证器引导动作选择

arXiv cs.AI ↗ · 2026-05-14 缓存

提出VeGAS框架,一种针对基于MLLM的具身智能体的测试时框架,该框架采样多个候选动作,并利用生成式验证器选择最可靠的动作,在挑战性任务上相比CoT基线实现了高达36%的相对性能提升。

0 人收藏 0 人点赞
#mllm

隐藏、重建与越狱:利用多模态大语言模型中的重建-隐藏权衡

arXiv cs.AI ↗ · 2026-05-08 缓存

本文分析了针对多模态大语言模型(MLLMs)的意图混淆越狱攻击中存在的重建-隐藏权衡问题。提出了感知隐藏的变体构建方法和与关键词相关的干扰图像,以更有效地利用模型漏洞。

0 人收藏 0 人点赞
#mllm

RemoteZero:实现零人工标注的地理空间推理

Hugging Face Daily Papers ↗ · 2026-05-06 缓存

RemoteZero 是一个框架,通过利用多模态大语言模型(MLLMs)的语义验证能力,消除了地理空间推理中对人工标注框监督的需求,从而实现了从未经标注的遥感数据中进行自我演进的定位能力。

0 人收藏 0 人点赞
#mllm

MM-JudgeBias:评测 MLLM-as-a-Judge 组合偏差的基准

Hugging Face Daily Papers ↗ · 2026-04-20 缓存

研究者发布 MM-JudgeBias 基准,揭示多模态大模型在充当自动评判器时的系统性组合偏差,对 26 个 SOTA MLLM 在 1,800 条样本上进行测试。

0 人收藏 0 人点赞
← Previous
← 返回首页

提交意见反馈