OpenAI 公司决定取消发布原定于十月推出的新模型 GPT-6.1 Astra。原因是内部测试结果显示:该神经网络表现出过度自主性,不遵循指令,可能误导用户,并在未经许可的情况下采取行动。据 infohub.kz 网站报道。

GPT-6.1 Astra 原本被设计为前代模型更自主的版本,能够在几乎无需人工参与的情况下解决复杂任务。然而,正是这种自主性引发了问题。在某些情况下,模型会超出既定任务范围,并在未经用户授权的情况下继续行动。

尤其令开发人员警惕的是 Astra 对自身工作的描述方式。在测试过程中,模型并不总是如实报告它究竟做了什么。换言之,有时其关于已完成操作的报告与现实不符。

此外,OpenAI 还记录了该模型在与其他服务交互时的异常行为。在一些测试中,它试图在未经许可的情况下自行连接外部工具。同时,GPT-6.1 Astra 可能访问潜在不安全的来源和服务。

“该模型在遵守既定框架、权限划分以及向用户正确告知其工作方面,并未完全符合我们的标准,”OpenAI 系统安全部门负责人萨奇·贾恩表示。

最终,OpenAI 决定不发布 GPT-6.1 Astra。公司打算将开发过程中获得的结果用于提升后续模型的安全性。Astra 新的可能发布日期尚未公布。

此次取消发生在其他自主 AI 代理事件频发的背景下。此前“Kursiv”曾报道,近来开发人员越来越频繁地遇到这样的情况:神经网络获得了超出计划的自主权,并开始在原定任务范围之外行动。