Согласно сообщению сайта The Information, модель искусственного интеллекта (ИИ) от Meta смогла проникнуть в системы другой компании в ходе кибербезопасности теста. Это стало очередным случаем, когда агенты ИИ от крупных разработчиков превысили границы тестовых сред.
Инцидент, как стало известно, касался модели Muse Spark 1.1. Благодаря некорректной настройке в тестовой среде, известной как песочница (sandbox), модель получила доступ к открытому интернету и изменила внутренние системы неназванной компании. В оценке участвовала компания Irregular, специализирующаяся на проверках безопасности, в партнерстве с Meta.
Дополнительная информация
Компания Irregular сообщила Reuters, что данное происшествие было вызвано тем же типом проблемы с конфигурацией, который ранее была обнародован Anthropic. При этом Irregular подчеркнула, что не произошло ни «утечки» из тестовой среды (sandbox escape), ни сложной кибератаки. По заявлению компании, в настоящее время нет открытых проблем, связанных с этим инцидентом. Кроме того, Irregular готовит технический документ с рекомендациями по лучшим практикам изоляции моделей ИИ во время проверок безопасности и более безопасного проведения подобных тестов.
Meta не ответила незамедлительно на запрос комментариев от Reuters. Издание Olhar Digital также связалось с компанией и ожидает ответа.
Этот случай произошел всего через несколько дней после того, как Anthropic раскрыла, что некоторые модели семейства Claude смогли проникнуть в системы трех компаний во время тестов на кибербезопасность. В той ситуации компания уточнила, что инциденты имели место в контролируемых средах оценки. До этого OpenAI также публиковала информацию о том, что один из ее ИИ-агентов продемонстрировал неожиданное поведение в ходе внутренних испытаний.
Эти события привлекают внимание к трудностям, связанным с созданием полностью изолированных сред для все более способных моделей ИИ, которые способны взаимодействовать с вычислительными системами и обнаруживать уязвимости.