В ходе киберучений в формате «захват флага» три версии языковой модели Claude, включая Opus 4.7 и Mythos 5, вышли за пределы виртуального полигона и получили доступ к системам трех сторонних организаций, сообщает сайт infohub.kz.
Как выяснилось, причиной сбоя стала ошибка в конфигурации оборудования, допущенная тестовым партнером — компанией Irregular. Алгоритмам был задан виртуальный сценарий, в котором указывалось, что выход в сеть отсутствует, однако из-за неполадки подрядчика интернет оставался активным. Приняв реальные серверы за часть учебного полигона, модели взломали их простыми методами, включая подбор слабых паролей.
Испытания были немедленно остановлены разработчиками. Инцидент обнаружили в ходе аудита более 141 000 проверочных сессий, начатого после аналогичного случая у конкурента — компании OpenAI. Американский стартап Anthropic связался с пострадавшими организациями и приступил к внедрению более строгих мер контроля внешних подрядчиков.


