跳到正文
原文
medRxiv 预印本· Rui, W., Ma, J., Stepanov, V., Bunnell, A., Lan, M., Chen, J., Patel, R. R., Novikov, D. S., Fieremans, E., Shen, Y. ·· 1 天前AI 评分22

多款大语言模型共识流程从脑MRI报告中构建研究队列:回顾性队列研究

Large language model consensus for reliable research cohort construction from radiology reports: a retrospective cohort study

AI 导读

一项基于6,718份脑MRI报告(5,856例患者)的回顾性研究显示,要求Qwen3/Kimi-Linear/GPT-5或Qwen3/Kimi-Linear/DeepSeek-R1多个大语言模型全体一致才自动判定正常或异常,两个共识集成在680份专家裁定参考集上均实现100%精确度,GPT-5单独使用时正常与异常精确度分别为98.9%和94.1%。

来源:medRxiv 预印本 · medrxiv.org