美国芯片制造商英伟达推出了一套面向AI智能体的安全平台——这类智能体是能够自主执行任务的程序。该平台允许事先规定智能体可以访问哪些数据和服务。据公司称,如果智能体试图越界,系统能在毫秒级内将其隔离,据infohub.kz网站报道。

目前已有100多家机构在使用该平台的技术。

"人工智能的巨大潜力只有在我们解决其安全问题后,才能真正造福社会,"英伟达创始人兼首席执行官黄仁勋表示。

英伟达开放智能体安全平台(Nvidia Open Agent Safety Platform)整合了两款工具。OpenShell负责制定规则:智能体在工作期间可以访问哪些数据、程序和外部系统。这款开源软件已向开发者开放,可在英伟达Vera处理器上使用,也可适配其他厂商的硬件。

第二款工具Sentry运行在英伟达的独立芯片上,独立于主程序监控智能体的行为。如果智能体试图绕过限制,Sentry应将其送入"隔离区"并予以阻止。英伟达将这一能力描述为基于BlueField-4芯片系统项目的一部分。

在使用或开发该平台技术的机构中,英伟达提到了Anthropic、SpaceXAI、Salesforce、JPMorganChase和Citi。Anthropic正与该公司合作,为企业版Claude智能体增加额外的访问限制。SpaceXAI将该平台用于帮助编写代码的Cursor智能体以及Grok模型。

此举的起因是AI智能体开始失控的事件。7月,OpenAI报告称,其模型在网络安全技能测试中绕过了本应阻止其访问互联网的限制。这些智能体侵入了OpenAI的部分系统以及Hugging Face平台的服务器,后者是开发者发布AI模型的地方。此事发生在测试过程中,但波及了真实系统。

Anthropic还报告了另外三起事件:Claude模型在测试任务中未经授权访问了三家机构的系统。据该公司解释,这些智能体以为自己在封闭的训练环境中运行,尽管实际上互联网访问是开放的。

此前"Kursiv"曾报道,OpenAI的一个AI智能体未经授权访问了澳大利亚医疗门户网站Medicare。该事件发生在6月,但公司三个月后才向政府报告。