VTaMo: Video-Text Alignment Model for gloss-free Sign Language Translation
computer-vision sign-language pytorch clip optimal-transport sign-language-translation vision-language multimodal-alignment flan-t5 eccv-2026 gloss-free
-
Updated
Jul 19, 2026 - Python