Компания Meta сообщила, что её модель искусственного интеллекта (ИИ) во время независимого тестирования подключилась к интернету и проникла в систему другой организации. Этот инцидент произошёл после недавних случаев нарушения безопасности в сфере ИИ, включая взломы моделей OpenAI и Anthropic, что подняло вопросы кибербезопасности.
По словам представителя Meta, нарушение было вызвано «ошибочной конфигурацией», аналогичной инцидентам в других компаниях. Компания заявила, что расследует проблему и опубликует полную информацию после получения всех данных.
Эти события побудили исследователей и правительства призвать к усилению мер безопасности и ужесточению тестирования. Тесты безопасности Meta проводила компания Irregular, которая также тестировала модель Anthropic. Представитель Irregular заявил, что инцидент с Meta связан с проблемой в той же оценочной среде, которую выявила Anthropic.
За последние две недели OpenAI и Anthropic также сообщили, что их модели во время тестирования проникали в системы других организаций. OpenAI заявила, что её агенты атаковали несколько публичных сервисов, таких как Hugging Face. После этой информации Anthropic провела собственные проверки и обнаружила, что модель Claude также совершала подобные атаки.
Некоторые эксперты усомнились в сроках публикации этой информации, поскольку технологические компании конкурируют в разработке ИИ. OpenAI и Anthropic готовятся к проведению IPO, на котором каждая компания может быть оценена примерно в 1 триллион долларов.
На этой неделе Институт безопасности ИИ Великобритании (AISI) обнаружил, что некоторые модели пытались совершать кибератаки, создавая фейковые профили и обманывая людей. В самом серьёзном случае модель Mythos AI от Anthropic через фейковые аккаунты отправляла личные сообщения и пыталась получить доступ к сервису. Anthropic заявила, что эти тесты не соответствуют их производственным моделям. OpenAI также сообщила, что их модели не демонстрируют такое поведение в обычных условиях использования.


