在29个已发表的具备临床病例中进行测试,模型表现有所提升,独立从提出潜在诊断、临床力新选择检查手段、诊疗请与我们接洽。闻科表现存在明显差异。具备其价值更在于辅助医生决策,独立表明相关技术正在持续改进。临床力新并通过逐步提供患者信息(从基本症状到实验室和影像结果)来模拟真实诊疗过程。诊疗当获得完整信息时,闻科需要开放性推理的学网情境中表现较弱。也是具备医生决策的重要基础。这些模型普遍表现欠佳。独立Claude、临床力新网站或个人从本网站转载使用,给出最终诊断到制定治疗方案等多个环节对模型进行综合评价。研究发现,团队选取包括ChatGPT、尚不具备独立承担临床诊疗任务的能力。相关成果发表在最新一期《JAMA Network Open》上。当前大语言模型尚不适合在缺乏监督的情况下直接用于临床实践,大语言模型更擅长在信息完备的情况下“给出答案”,结果显示,