Shawon, J. A. B., Hasan, M. K., Mahmud, H. (2026). A comparative analysis of video vision transformers on word-level sign language datasets. PLoS ONE. https://doi.org/10.1371/journal.pone.0341909