multimodal-audit

标签

Cards List
#multimodal-audit

大型语言模型是否仔细审查其评审内容?对评分校准、错误检测和作者身份效应的多模态审计

arXiv cs.CL · 2天前 缓存

本研究评估了两个多模态大型语言模型作为ICLR 2026投稿的同行评审,发现评分校准高但错误检测低,作者身份无影响,而图表降低了错误检测。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈