video-text-alignment

Tag

Cards List
#video-text-alignment

VTaMo: Video-Text Alignment Model for Sign Language Translation

arXiv cs.CL · 2026-07-13 Cached

VTaMo introduces explicit multi-granularity video-text alignment for sign language translation using optimal transport and contrastive learning, achieving state-of-the-art performance on four benchmarks.

0 favorites 0 likes
← Back to home

Submit Feedback