Модель штучного інтелекту Meta під час тестування кібербезпеки отримала ненавмисний доступ до Інтернету через помилку в конфігурації середовища. Після цього система змогла виявити та використати вразливість у сторонньому сервісі.
Про це повідомляє видання Business Insider
Інцидент стався під час оцінювання, яке проводила незалежна компанія Irregular, що спеціалізується на перевірці ШІ-моделей за допомогою сценаріїв атакувальної кібербезпеки. У Meta підтвердили, що модель скористалася слабким місцем у зовнішньому сервісі, а також повідомили про початок внутрішнього розслідування.
Йдеться про модель Muse Spark 1.1, яку Meta представила як інструмент для виконання програмувальних завдань і роботи з агентними сценаріями. За даними видань, під час тесту модель отримала доступ до системи сторонньої компанії та внесла зміни до частини її внутрішнього середовища.
В Irregular наголосили, що випадок не був пов’язаний зі складним зламом чи обходом захисту пісочниці (sandbox escape). Причиною стала помилка в налаштуваннях тестового середовища, яка дозволила моделі вийти за межі ізольованої системи, підключитися до відкритого Інтернету та використати знайдену вразливість.
Компанія заявила, що всі виявлені проблеми вже усунуті, а також планує оприлюднити рекомендації щодо безпечної ізоляції ШІ-систем під час проведення подібних перевірок.
Інцидент став черговим прикладом ризиків, пов’язаних із тестуванням автономних ШІ-моделей. Раніше подібні ситуації виникали з системами Anthropic, де причиною також були помилки конфігурації, що відкривали доступ до Інтернету. Водночас OpenAI повідомляла про випадок, коли її агент самостійно використав раніше невідому вразливість для отримання зовнішнього доступу.
