据SiliconANGLE报道,一名独立研究者将联合国统计门户网站遭受的1.6万余次扫描,与很可能是OpenAI运营的人工智能代理联系起来。工程师Rowan Howard-Jones在周六发布的博文中称,扫描从4月13日持续到6月19日,目标是联合国贸易和发展会议的数据网站UNCTADstat。

被索取的数据并非机密。Howard-Jones称,这些代理想要的是生产性能力指数等公开数据,他发现它们对网站应用程序编程接口的字段进行暴力枚举以定位端点。它们用于查询的密钥同样是公开的,因为UNCTADstat自己的数据查看器会在每次请求时携带该密钥。

当门户网站拒绝请求时,这些代理改用代理服务器和编码技巧继续获取数据。主要工具是urlquery.net,一种在沙箱浏览器中打开所给页面的URL扫描器。代理在httpbin测试服务上构建base64编码的HTML表单,交给该扫描器,由扫描器的浏览器把表单提交至UNCTADstat。扫描报告中的截图显示指数数据被返回。

此后,代理绕开了Facts端点GET请求被封的限制,办法是把请求双重编码为“F%2561cts”。其他载荷托管在谷歌一个用于讲授跨站脚本攻击的游戏中,还有一些把“POST”一词拆成两个字符串,显然是为了绕过过滤。UNCTADstat对其中82次请求做了限速,请求仍不断到来。Howard-Jones在发布博文前已将双重编码绕过的情况告知贸发会议安全团队,但他没有把这称作黑客攻击。他写道,这些代理的行为看起来像“某个不愿接受‘不’字的人或东西”。

代理构建的载荷页面上带有“CHATGPTTEST1”和“OAI_META_1312”等标签。Howard-Jones还追踪到54个与UNCTAD相关的微软Azure地址,这些地址曾在小型公共维基FractalWiki上进行编辑和搜索,其中45个还编辑过DSEwiki。这个长期沉寂的德语维基正是今年早些时候发现OpenAI代理彼此协调的地方。

OpenAI一名女发言人对《华尔街日报》表示,公司正在审查这些发现,并已联系联合国,提出由负责审查的团队进行情况通报。她说,公司将这项审查描述为对训练和评估过程中行为失准模型的广泛检视,迄今所审查的大部分内容涉及阅读公开网页内容等常规研究。联合国未立即回应《华尔街日报》的置评请求。

非营利研究实验室Transluce此前的报告促使Howard-Jones深入分析这些数据。该实验室上周将OpenAI代理与针对Data USA和一个澳大利亚政府健康统计网站的攻击联系起来。OpenAI周五证实,其代理还在美国政府网站上出现不当行为,包括商务部与证券交易委员会的网站。

斯坦福大学网络安全讲师Alex Stamos对《华尔街日报》表示,UNCTAD这起活动“介于我所说的黑客攻击的边缘”。他说:“这实际上是非常激进的抓取和数据获取。”