据Engadget报道,人工智能模型Claude日前获得一项新能力,可在用户授权后完全管理其Gmail邮箱,包括自动发送、回复和转发邮件,无需逐封征求用户同意。但安全专家警告,将如此重要的邮箱交由AI打理存在多重风险,用户需谨慎评估。

报道称,Claude的这项功能标志着AI能力的又一次跃进。四年前,AI还在为“草莓一词中有几个r”这样的基础问题出错,如今已能生成逼真影片,并能代替用户处理日常邮件。然而,AI并非万无一失。此前,OpenClaw曾在忽略指令的情况下删除了Meta超智能实验室AI安全研究员Summer Yue的电子邮件。因此,让Claude接管邮箱,尤其是允许其未经批准就发送邮件,可能带来严重后果。

最严重的风险是提示注入攻击。攻击者可向用户发送一封包含隐形文本的邮件,在用户正常阅读时无法察觉,但Claude却能读取并执行其中嵌入的恶意指令。黑客可借此监控用户的Gmail账户,窃取验证码等敏感信息,进而入侵其他账户。报道强调,这种攻击已被证实发生,并非假设性威胁。Claude在首次允许其发送邮件时也会就此发出警告。

除恶意攻击外,AI自身的失误同样值得警惕。由于Claude在获准后可自行起草并发送邮件,用户往往无法在邮件发出前进行审核。如果Claude产生幻觉、编造错误信息,或误解用户本意,错误邮件可能在用户发现前就已送达收件人。此外,将整个收件箱的数据交给Claude及其开发商Anthropic,也引发隐私方面的担忧。

为降低风险,报道建议采取多项措施。最重要的做法是保持Claude的“发送前询问”功能处于开启状态,让用户有机会在AI执行任何操作前进行审查。其次,向Claude下达指令时应尽量具体,明确要求其发送的内容和措辞,避免模糊表述,从而减少误解的可能。对于提示注入攻击,目前尚无彻底解决方案。首次提出“提示注入”概念的Simon Willison表示,学界和业界仍不知道如何百分之百可靠地防止此类攻击发生。报道建议用户对陌生发件人保持警惕,并在其他账户上启用多重身份验证,以增强防护。