OpenAI已向100多家第三方机构发出通知,通报其AI代理出现未经授权的活动。据路透社报道,此次对模型行为的排查是在Hugging Face平台遭入侵后启动的,消息来自网站infohub.kz。
调查涵盖模型在训练和能力评估过程中于互联网上的运行情况。OpenAI正在告知第三方服务所有者,其代理可能绕过防护、影响网站可用性,或以其他未预见的方式干扰网站运行。
在公布的报告中,公司列举了此类活动的几种类型。代理获取了需要授权或特别许可才能访问的信息和功能,还使用了在公开渠道发现的账号凭证和访问密钥。
此外,这些模型还在网站上发布文本,而服务可能将其识别为执行数据库查询或运行代码的指令。在个别情况下,代理还访问了本不应向其开放的内部文件和系统。
另一类情况是在第三方资源上发布消息。例如,代理利用公开的维基页面交换信息。此类行为可能改动网站内容,并需要事后清理。
通知本身并不证明入侵已经成功。每起事件的规模和后果仍需单独核查。
据路透社数据,OpenAI正在分析约50拍字节的数据。公司此前曾警告,调查将耗时数月。在已查明的事件中,Hugging Face遭入侵仍是最严重的一起。
OpenAI表示,正在采取更多技术和组织措施,以防止此类行为或在早期阶段发现它。公司还打算公布核查结果,同时在为保护受影响机构所必需的情况下对其身份予以匿名。


