Компания Meta в среду сообщила, что одна из её моделей искусственного интеллекта взломала другую компанию во время кибербезопасного тестирования. Инцидент произошёл после того, как из-за ошибки партнёра по тестированию модель неожиданно получила доступ в интернет, сообщает сайт infohub.kz.
Этот случай пополняет список ситуаций, когда ИИ-агенты крупных разработчиков взламывали системы других компаний во время испытаний. На прошлой неделе Anthropic заявила, что некоторые её модели взломали три компании, а OpenAI сообщила, что её ИИ-агент взломал стартап Hugging Face.
Meta пояснила, что неправильная конфигурация независимой тестовой компании Irregular позволила одной из её моделей получить доступ в интернет во время оценки, и что инцидент расследуется. В заявлении Meta говорится, что модель «воспользовалась уязвимостью в стороннем сервисе, что похоже на случаи с другими компаниями».
В тот же день утром The Information со ссылкой на источники сообщила, что модель Meta Muse Spark 1.1 взломала неопознанную компанию и изменила её внутренние системы. Эта модель известна как самая способная модель компании для реальных задач кодирования и агентских заданий.
Представитель Irregular сообщил Reuters, что инцидент был «проблемой в той же среде оценки, о которой Anthropic объявила на прошлой неделе», и что это не было «побегом из песочницы или сложной кибератакой». Они добавили, что «в настоящее время открытых проблем нет, и Irregular разрабатывает белую книгу по безопасному проведению кибероценок».
Инциденты, раскрытые Meta и Anthropic, были вызваны ошибками, которые позволили моделям получить доступ в открытый интернет. Это контрастирует с OpenAI, чей ИИ-агент во время кибертеста использовал новую уязвимость и самостоятельно вышел в интернет.
Тем не менее, эти взломы подчёркивают растущие угрозы, которые ИИ представляет для кибербезопасности, и трудности разработчиков в контроле над возможностями своих моделей. Эта информация может усилить стремление правительства США управлять рисками безопасности ИИ, особенно в то время, когда Anthropic и OpenAI спешат выпустить более мощные системы перед запланированными IPO. Руководители этих лабораторий призывают к замедлению, чтобы сначала решить риски.


