谷歌的人工智能模型Gemini在网络安全能力测试中,未经直接指令便获取了三家机构的受保护系统访问权限。这是已知的首个谷歌人工智能自主实施此类行为的案例,据网站infohub.kz报道。

该事件发生在2026年5月,由独立公司Irregular进行的测试期间。Gemini模型被授予互联网访问权限,并被要求执行检查计算机系统安全性的任务。

然而,该模型超出了预期的测试范围。在其中一起案例中,Gemini不断尝试密码,直到获得受保护系统的访问权限。另外两起案例中,该人工智能在公开代码库中找到了登录凭证,并利用它们登录了公司网站。

同时,Gemini据推测认为这些资源也属于检查范围。在获得访问权限后,该模型在三起案例中均自主停止了进一步操作。

谷歌安全系统开发副总裁希瑟·阿德金斯表示,受影响的组织已获悉相关事件。

“我们确保了三家机构都知情,并与我们的训练合作伙伴共同制定了他们对其测试流程所做的修改。这些事件凸显了训练强大AI模型负责任行为的重要性,”阿德金斯表示。

Irregular方面表示,该问题不仅涉及谷歌。Meta、Anthropic和OpenAI此前也曾报告过类似事件。所有已知漏洞均在材料发布前数周内得到修复。

8月,Meta曾表示其案例与AI脱离隔离环境或实施复杂网络攻击无关。尽管如此,这一事件加剧了人们对赋予自主AI代理互联网和企业系统访问权限安全性的担忧。