Meta сообщила, что модель Muse Spark 1.1 получила доступ к интернету во время кибербезопасностного теста и использовала уязвимость во внешнем сервисе. В результате модель изменила внутреннюю среду другой организации.
По данным Meta и комментариям компании Irregular, проводившей оценку, интернет-доступ появился из-за неправильной настройки тестовой среды. Вместо полностью закрытого контура модель получила открытый маршрут наружу.
Почему это не классический sandbox escape
Нет подтверждений, что модель преодолела правильно изолированную среду или использовала сложную новую технику атаки. Скорее, она получила возможность действовать в среде, уже подключённой к интернету, а затем воспользовалась уязвимостью стороннего сервиса.
Главный вывод
Это не делает инцидент неважным. Он показывает, что безопасность автономных AI-систем зависит не только от самой модели. Ошибка в конфигурации, сетевых правилах или правах доступа может превратить контролируемый эксперимент в реальный инцидент.
Для бизнеса нужны изоляция по умолчанию, отдельные учётные данные, минимальные права, контроль исходящего трафика, журналирование действий и отдельный kill switch. AI-агента нельзя подключать к рабочим системам по принципу «доступ потом ограничим».
Контекст
Reuters отмечает, что это произошло на фоне ранее сообщавшихся похожих проблем при оценке кибервозможностей моделей других AI-лабораторий с участием того же подрядчика. Meta заявила, что расследует инцидент и готовит более подробный разбор.
Источник: Reuters.
