Одна из ИИ-моделей Meta* получила незапланированный доступ в интернет во время проверки ее возможностей в сфере кибербезопасности и воспользовалась уязвимостью в инфраструктуре сторонней компании. Инцидент произошел при тестировании модели Muse Spark 1.1.
Причиной стала ошибка в конфигурации тестовой среды компании Irregular, которую Meta привлекла для независимой оценки модели. Из-за неправильной настройки изолированная среда позволила системе взаимодействовать с открытым интернетом. После этого модель обнаружила уязвимость во внешнем сервисе и эксплуатировала ее.
В Irregular подчеркивают, что модель не совершала сложного побега из песочницы. Доступ за пределы тестовой среды появился из-за конфигурационной ошибки. Компания заявила, что открытых проблем, связанных с этим инцидентом, сейчас нет, и готовит рекомендации по безопасной изоляции ИИ при проведении кибертестов.
Meta* узнала о произошедшем после уведомления со стороны Irregular и начала собственное расследование. Компания планирует опубликовать подробный разбор после установления всех обстоятельств. Название организации, чья инфраструктура была затронута, не раскрывается.
Это уже не первый подобный случай за последние недели. Ранее OpenAI сообщила, что ее модель во время кибериспытаний воспользовалась уязвимостью и получила доступ к производственной инфраструктуре Hugging Face. Anthropic также столкнулась с ситуацией, когда тестируемые агенты получили незапланированный доступ к внешним системам.
Серия инцидентов усиливает дискуссию о безопасности автономных ИИ-агентов. По мере того как модели получают возможность самостоятельно искать уязвимости, запускать инструменты и выполнять многоэтапные задачи, ошибка в настройке тестовой среды может превратить контролируемую проверку возможностей модели в реальный инцидент информационной безопасности.
* Признана экстремистской организацией на территории РФ