Augmenting clinical decision-making with large language models: evaluation across general and specialty tasks.
Large language models (LLMs) have shown promise in clinical applications, yet prior studies mainly evaluated their standalone performance on benchmarks or examinations. This study assesses how LLMs support clinicians across specialties, disease contexts, experience levels and decision-making stages.
Author(s): Tao, Yuechen, Lin, Xiushi, Sun, He, Bao, Wenrui, Zhu, Xiaobo, Wu, Shiwei, Liu, Yixiao, Li, Ziang, Wu, Jialong, Zhao, Zhenkun, Qiu, Lei, Ni, Qianyang, Zhang, Song, Tang, Zhenchao, Ying, Zuobin, An, Yu, Tian, Jie, Liu, Zhenyu, Lu, Jian
DOI: 10.1093/jamia/ocag053