A Multimodal Pipeline for Clinical Data Extraction: Applying Vision-Language Models to Scans of Transfusion Reaction

Summary

This study introduces an open-source pipeline for extracting checkbox data from scanned healthcare documents, reducing errors and administrative workload. The method uses advanced OCR and vision-language models for accurate data extraction from forms like transfusion reaction reports.

Related Concept Videos