Vision-language models for human motion understanding: Lessons from stroke rehabilitation

Victor Li1, Naveenraj Kamalakannan1,2, Avinash Parnandi3

  • 1Center for Data Science, New York University, New York, New York, United States of America.

PLOS Digital Health
|July 6, 2026
PubMed
Summary

Vision-language models (VLMs) show promise for stroke rehabilitation video analysis but currently lack fine-grained motion understanding for precise dose and impairment quantification. Future work may improve accuracy with optimized prompting and post-processing.

Related Concept Videos