跳到正文
原文
medRxiv 预印本· Kanithi, P., Pradhan, A., Cui, H., Johnstone, K., Luk, A., Hammond, R., Brown, C., Walker, A. S., Eyre, D. W. ·· 1 天前AI 评分22

大语言模型能否从临床文本中提取旅行史?一项多标注者基准研究

Can large language models extract travel history from clinical text? A multi-annotator benchmark study

AI 导读

一项多标注者基准研究评估了大语言模型从临床文本中提取旅行史的能力。五名临床医生对100份临床病例报告完成超5000条标注,模型在旅行存在与否、目的地等高层变量上表现良好,但在返回时间、症状发作与返回的时间关系等时间变量上与临床医生同样困难。模型输出对采样温度的敏感度高于提示词措辞,小型开放权重模型在部分变量上接近更大模型,但时间字段仍较弱。

来源:medRxiv 预印本 · medrxiv.org