Open access
Sep 2026
Performance, Failures, and Oversight of a Large Language Model Agent for Clinical Data Analysis: Evaluation Study
LLM agents perform reliably for question generation and SAP drafting but require expert verification of formula composition, cohort boundary logic, and concordance computation before results are reported.
Yi-Lan Wu, D. J. Fu, Yu-Kun Zhou et al.
· Journal of Medical Internet... · 0 citations