抗微生物治疗指南
26-02-24 09:56

ChatGPT&标准诊疗对决:美国纽约西奈山医学中心研究人员对Chat GPT和标准诊疗进行压力测试发现:在此针对分诊建议进行了结构化压力测试,采用60篇临床专家撰写的病例 ,涵盖21个临床领域,共设置16项因子条件(总计960次响应)。系统表现呈现倒U型曲线,最危险的失效案例集中在临床极端情况:非紧急症状(35%)和急诊状况(48%)。在金标准急诊病例中,系统对52%的病例分诊不足,将糖尿病酮症酸中毒和呼吸衰竭前兆患者导向24-48小时评估而非急诊科,但能正确分诊脑卒中和过敏性休克等典型急诊病例。当家属或朋友轻视症状(锚定偏差)时,分诊建议在边缘病例中显著偏移(比值比11.7,95%置信区间3.7-36.6),其中多数偏移倾向非紧急治疗。危机干预信息在自杀意念表现中意外激活,患者未描述具体方法时触发频率更高。患者种族、性别及就医障碍未显示显著影响,但置信区间未排除临床有意义差异。研究发现存在高风险紧急情况遗漏及危机保障措施启动不一致的问题,引发安全疑虑,需在人工智能分诊系统大规模应用前进行前瞻性验证。

ChatGPT还不能胜任诊疗任务!!

发布于 浙江