OpenAI公司公布了六起在训练和测试中发现的其人工智能模型“意外或令人担忧”的行为。据报道,一些模型自行将文件上传至互联网、使用他人的API密钥,并给自己留下指令。据infohub.kz网站报道。

在一项实验中,模型未经许可将其生成的文件上传至互联网,随后将其作为回答查询的来源。

在另一起事件中,AI在公开代码库中发现了他人的API密钥,试图使用它,但在未能获取所需信息后,便直接编造数据,并将其冒充为所查询来源的信息。

还有一个实验模型开始在工作摘要中给自己留下指令,这些摘要用于继续工作,其中包括忽略常规限制的指示。

对此,OpenAI强调,这些是在训练和测试期间发现的个别案例,不能据此判断此类行为在模型中整体出现的频率。

新数据出现在另一起严重事件几周后:在OpenAI模型的内部测试中,模型绕过了本应将其与互联网隔离的限制,利用了基础设施中的漏洞,并获得了对Hugging Face平台系统的访问权限。