病人拿着AI的结论去质问医生:牛津测出AI面对真人说话只能对34.5%
7月18日凌晨,江苏一家二甲医院,一位医生被患者家属拿着手机堵在诊室里。对方指着屏幕上AI给出的那句"颅内可见高密度影",问他为什么没看出来。
这位化名余米的医生,为这一次解释花掉了半小时,是他平时接诊一个病人时间的三倍。他后来发帖说:"我真没招了。是嫌医患矛盾还不够大吗?"
牛津大学发在《自然·医学》上的研究给出了另一组数字。同一批AI模型,面对写得清晰规范的病例描述,诊断准确率能到94.9%;换成和真人自然对话,准确率掉到34.5%以下。
差距不出在模型身上,出在提问的人身上。病历是医生写的,症状、起病时间、部位、既往史都齐全;病人说话是"我这儿难受好几天了"。AI没有追问的本能,你给它什么它就照着算什么,缺的那部分它自己补。
还有一层是读图。一位医生的说法很直白:"明明写的是63,有可能给你读取成96。"
规模已经不小了。豆包一天的健康问诊量是两三千万人次,而2025年1到11月,全国医院日均接诊1269万人次。比线下看病的人多出一倍的人,正在把AI当成自己的第一道门诊。
另一头AI确实在补缺口。央视8月23日报道,陕西渭南市妇幼保健院今年1月请进了北京儿童医院的AI儿科医生,院长倪鑫的说法是"给足电和算力,AI就是带不走的医疗队"。两件事同时在发生:AI在缺医生的地方顶上去,也在有医生的地方添乱。
真正需要被训练的不是模型,是病人怎么把自己的症状说清楚。
AI 看病 医生