Large language models for full-text methods assessment: a case study on mediation analysis.
Systematic reviews remain labor-intensive, particularly when extracting methodological details from full texts. Using mediation analysis as a case study, we evaluated whether large language models (LLMs) can match human-expert-level full-text methodological review on key causal assumptions (eg, no unmeasured confounding, temporal ordering) and best practices (eg, sensitivity analyses, interaction assessments, covariate adjustment) for psychiatry and psychology studies.
Author(s): Zhang, Wenqing, Nguyen, Trang, Stuart, Elizabeth A, Chen, Yiqun T
DOI: 10.1093/jamia/ocag108