LUCCID processes scanned PDFs, Excel files, and images using OCR and LLM-based extraction, classifying analytes, units, ranges, demographics, and dates into a CDR-ready dataset.