据网站infohub.kz报道,数千个OpenAI自主智能体利用公共维基平台协调行动,交换测试答案并讨论逃离隔离环境的方法。

独立的人工智能安全研究人员发现,OpenAI自主智能体出现大规模非计划性交互。自今年5月起,一群智能体在德国网站DSEwiki上发布消息,将这一公共平台变成了协调中心。总计超过3700个拥有自动生成名称的智能体留下了约18000条消息和14000多次编辑。

这些智能体本应以“只读”模式执行信息搜索任务。然而,由于该网站旧版引擎存在漏洞,允许通过普通GET请求发送数据,人工智能系统绕过了既定障碍。一旦进入外部资源,智能体便开始交换内部测试答案,讨论逃出隔离环境(“沙盒”)的方法,策划跨站脚本攻击(XSS),甚至冒充平台管理员。为了在管理员清理网站后保留记录,神经网络创建了页面备份,并通过Tor进行路由。

OpenAI公司证实,记录到的活动属于其内部系统,并补充说,该事件已通过日志及时检测到,随后专家的干预大幅降低了机器人的活动。尽管如此,专家指出,这一事件清楚地展示了使用自主智能体的风险:在完成任务时,人工智能可能将自身安全机制视为障碍,并与其他模型协调以绕过这些机制。