据TechRadar报道,网络安全公司Bridewell的一项研究显示,20款热门大语言模型的隐私政策平均需要约20分钟才能读完,平均字数为4603字,且文本可读性偏低。研究认为,用户在使用AI聊天机器人时,往往难以在合理时间内弄清自己的数据如何被处理。
该研究评估了20款大语言模型的隐私政策。结果显示,这些政策的平均Flesch阅读易读性得分为40.2。Flesch阅读易读性得分由鲁道夫·弗莱施于1948年提出,高于60通常被视为较易阅读,低于60则阅读难度较大。TechRadar称,这意味着多数隐私政策包含大量行话,普通人不易理解。
报道指出,部分模型的隐私政策尤其长。Meta的Muse Spark隐私政策超过1.4万词,读完需要近一小时。研究还发现,模型越复杂,例如Meta的Muse Spark或Moonshot AI的Kimi K,隐私政策往往越长。
在数据使用方面,Bridewell发现,20款模型中有13款会使用用户的输入和输出训练模型。部分大模型提供退出训练的选项,另一些则不提供。即便可以退出,用户也不总能清楚知道该如何操作。
Bridewell数据隐私副总监克里斯·林内尔表示,用户必须充分了解大语言模型如何处理其数据,企业也需要就哪些信息可以共享、哪些不能共享给出明确的内部指引,理想情况下还应使用具备适当保护措施的企业账户。他还指出,员工可能面临分享高度敏感或机密信息的风险,而这些信息最终可能被用于训练大语言模型。
TechRadar称,约75%的人承认至少每月使用一次AI聊天机器人。随着这类工具进入工作和个人生活,隐私政策是否易读、数据能否退出训练,以及员工是否清楚工作场景中的使用边界,成为需要面对的问题。