video-text-alignment

标签

Cards List
#video-text-alignment

VTaMo: 用于手语翻译的视频-文本对齐模型

arXiv cs.CL · 2026-07-13 缓存

VTaMo 引入了显式的多粒度视频-文本对齐方法,通过最优传输和对比学习实现手语翻译,在四个基准测试上取得了最先进的性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈