据TechRadar报道,一名Reddit用户发帖称,其父亲在家庭晚餐时反复掉落筷子,右手发麻,嘴角看起来略不对称,说话声音异常,并短暂失去平衡。症状随后似乎有所改善,家人几乎认为他只是累了,应该睡一觉。该用户把症状告诉ChatGPT后,ChatGPT回复称这听起来像中风或相关医疗事件,并紧急建议他们寻求急救,尽管症状正在改善。医院后来确认其父亲发生缺血性中风,并进行了相应治疗。

这是一则Reddit上的个人叙述,并非经记录的医疗病例,但帖子中描述的建议与美国疾病控制与预防中心(CDC)的官方指引一致。CDC表示,突发单侧无力或麻木、言语问题以及失去平衡都是中风的警告信号,出现这些症状的人应立即获得紧急医疗救助。

TechRadar的文章作者由此提出,围绕人工智能与医疗的讨论虽然复杂,但在这个故事里ChatGPT的任务并不复杂。它不需要充当医生,只需要知道什么时候该去找医生。健康是人工智能的自信可能带来问题的领域。如果ChatGPT自信地判断胸痛只是消化不良,人们可能在最不该放心的时候感到放心。

OpenAI似乎越来越意识到这条边界。该公司关于ChatGPT Health的说明称,它旨在支持医疗护理,而非取代医疗护理,并明确表示该服务不用于诊断或治疗。OpenAI还强调其模型在识别可能需要紧急护理的情形方面有所改进。在上述中风故事中,家人不需要ChatGPT判断哪条动脉被阻塞或开出治疗方案,他们需要的是某种工具能看出一组令人担忧的症状,并告诉他们等到早上风险太高。

ChatGPT可能真正有用的一个原因,是它能对抗人们说服自己不去急诊室的倾向。没人愿意在荧光灯下待六个小时,最后被告知一切正常。出现症状的人尤其可能尽量淡化问题。聊天机器人没有这种社交不适。当症状跨过紧急门槛时,有用的回应就是明确说出来。这并不意味着ChatGPT应该让每个头痛的人冲去急诊室。一个把每种症状都当作紧急情况的健康助手会很快变得无用。挑战在于识别何时错误安抚的代价远高于谨慎的代价。

中风是一个异常清晰的例子。美国卒中协会使用B.E. F.A.S.T.缩写来提示平衡问题、视力变化、面部下垂、手臂无力和言语困难,最后一个字母代表该拨打911了。在这种背景下,“也许睡一觉再说”是糟糕的建议。“现在去接受评估”正是人们希望人工智能健康助手愿意说出的那种话。

TechRadar还提到本周另一则Reddit帖子。一名用户描述称,在其血糖降至危险低水平时,ChatGPT Voice保持运行。发帖者称自己变得语无伦次并不断失去意识,而ChatGPT反复唤醒他们,提示他们检查血糖,并鼓励他们吃点东西。该用户说,这种情况持续了大约一个半小时,直到妻子回家。这同样是个人Reddit叙述,而非有记录的医疗案例,没有人应该计划把ChatGPT Voice当作紧急血糖监测系统。

不过,TechRadar作者认为,这件事仍有引人注意之处。ChatGPT已经在那里,用户状况在对话中明显恶化,人工智能持续对变化中的情况作出回应,而不是像一切正常那样继续。作者认为,人工智能健康工具可以在不假装取代医生的情况下变得真正有价值:它们可以注意到某些情况听起来不对,并告诉用户这是否需要真正的医疗干预。更安全的日常医疗人工智能帮助还包括,在就诊前理解化验报告中的术语,或为专科医生整理问题。OpenAI专门的Health体验甚至可以使用用户选择连接的健康信息。