04:00
2026-08-24
arxiv.org
large-language-models
An ambiguity taxonomy for evaluating large language model performance on clinical registry abstraction: a multi-site prospective study
A multi-site prospective study evaluating large language models (LLMs) on unprocessed electronic medical record data for clinical registry abstraction found that LLM accuracy declined as question ambi…