Review
Open access
Aug 2026
Confident but unsupported: auditing large language models against supplied evidence boundaries in drug-induced liver injury assessment
These findings identify unsupported reassurance as measurable evidence-boundary behavior in LLM drug-risk assessment and establish a reproducible framework for auditing adherence to an externally supplied evidence boundary, defined by PubMed evidence classification and enforced by prompt policy rather than inferred independently by the model.
Jinwan Shi, Yong Ma, Yinhui Liu et al.
· Frontiers in Public Health · 0 citations