pattern-evaluation

标签

Cards List
#pattern-evaluation

超越正确性:混合思维多模态大语言模型的响应行为基准测试与对齐

Hugging Face Daily Papers · 2026-08-17 缓存

本文介绍了PatternEval,一个用于评估混合思维多模态大语言模型中响应模式故障的诊断基准,并提出了PatternRL,通过带有特定惩罚的强化学习来对齐这些模式。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈