multimodal-feedback

标签

Cards List
#multimodal-feedback

VisEditBench:视觉语言模型能否根据多模态反馈编辑可视化代码?

arXiv cs.CL · 3天前 缓存

介绍了VisEditBench,这是一个包含1,395个人工标注的可视化代码编辑任务的基准,面向视觉语言模型,涵盖反馈引导的修复和参考引导的重新样式化。评估了20个VLM,并提出了VisEditAgent,一个基于渲染的编辑框架,将通过率从55.75%提升到67.99%。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈