medRxiv 预印本· Rui, W., Ma, J., Stepanov, V., Bunnell, A., Lan, M., Chen, J., Patel, R. R., Novikov, D. S., Fieremans, E., Shen, Y. ·· 1 天前AI 评分22
多款大语言模型共识流程从脑MRI报告中构建研究队列:回顾性队列研究
Large language model consensus for reliable research cohort construction from radiology reports: a retrospective cohort study
AI 导读
一项基于6,718份脑MRI报告(5,856例患者)的回顾性研究显示,要求Qwen3/Kimi-Linear/GPT-5或Qwen3/Kimi-Linear/DeepSeek-R1多个大语言模型全体一致才自动判定正常或异常,两个共识集成在680份专家裁定参考集上均实现100%精确度,GPT-5单独使用时正常与异常精确度分别为98.9%和94.1%。
来源:medRxiv 预印本 · medrxiv.org