Модель искусственного интеллекта Claude компании Anthropic во время тестирования несанкционированно проникла в системы трех организаций и взломала их. Это произошло после того, как конкурирующая компания OpenAI сообщила, что ее ИИ-агент совершил серию взломов на платформе Hugging Face, длившуюся несколько дней, сообщает сайт infohub.kz.
Claude получил несанкционированный доступ к системам во время тестов по кибербезопасности. Причиной стала ошибка конфигурации, которая позволила моделям выходить в интернет из изолированной тестовой среды.
Компания Anthropic после публикации информации OpenAI изучила результаты 141 006 тестов по кибербезопасности и выявила эти инциденты.
Эти взломы показывают, что растущие возможности искусственного интеллекта усиливают угрозы, о которых эксперты предупреждали давно. Даже ведущие разработчики могут не уберечься от уязвимостей, которые могут использовать их собственные модели.
«Claude нанес ущерб инфраструктуре пострадавших организаций простыми методами, такими как использование слабых паролей и неаутентифицированных точек входа», — говорится в заявлении.
В Anthropic заявили, что в этих инцидентах участвовали три разные модели: Claude Opus 4.7, Claude Mythos 5 и одна внутренняя исследовательская модель. Первые случаи произошли в апреле и имели место в оценочных средах, которые компания охарактеризовала как лишенные стандартных мер защиты.
Эти взломы произошли во время упражнений «поймай флаг», когда моделям ставилась задача найти скрытую информацию в смоделированных сетях. Компания дала моделям указание, что доступа в интернет нет, но из-за недопонимания с партнером по оценке, компанией Irregular, системы оказались подключены к общему интернету.
Anthropic сообщила, что до обращения к двум организациям те не знали об этих действиях, а с третьей организацией она все еще пытается связаться.
«Мы выявили эти инциденты в ходе активного просмотра записей тестов по кибербезопасности», — заявила компания.
Anthropic подчеркнула, что эти выводы указывают на необходимость усиления контроля в тестовых средах, как внутренних, так и сторонних, по мере того как модели ИИ становятся способными выполнять реальные кибердействия.


