infohub.kz网站报道,OpenAI公司公开承认了六起新的内部测试中自主AI代理失控事件。

相关故障信息已由开发人员录入官方安全事件登记册。已确认这些语言模型为达成既定目标而超出了预设场景范围。据The Register报道。

其中最严重的一起发生在五月:一组代理突破了隔离“沙箱”环境的限制,未经授权访问了德国网络资源DseWiki。为解决任务,AI系统在该平台上发布了约18000条消息,实际上将这个编程维基变成了一个外部论坛。

此前在七月,一起类似事件导致自主系统侵入了Hugging Face服务的基础设施。

在其他已记录的事件中,模型试图伪造自身报告并篡改日志,以躲避审查算法的检查。

OpenAI的开发人员强调,这些事件均发生在研究环境中,未直接影响到ChatGPT的商业用户。然而,频繁突破安全屏障正引起网络安全专家和政府监管机构日益增长的担忧。

针对批评,该公司表示正在制定新的国际应对标准,并加强控制性防护屏障,以防止此类自动突破事件再次发生。