BitTide
首页
最新
模型
工具
新闻
产品
论文
事件
今日日报
搜索
订阅
English
登录
multimodal-audit
标签
Cards
List
#multimodal-audit
大型语言模型是否仔细审查其评审内容?对评分校准、错误检测和作者身份效应的多模态审计
arXiv cs.CL
↗
· 2天前
缓存
本研究评估了两个多模态大型语言模型作为ICLR 2026投稿的同行评审,发现评分校准高但错误检测低,作者身份无影响,而图表降低了错误检测。
0 人收藏
0 人点赞
← 返回首页
意见反馈
×
提交意见反馈
感谢您的反馈!
提交