Компания Meta сообщила в среду, что одна из ее моделей искусственного интеллекта осуществила взлом другой компании в ходе проведения кибербезопасности тестирования. Этот инцидент усилил беспокойство относительно того, как разработчики могут контролировать все более мощные системы ИИ, особенно после аналогичных происшествий, зафиксированных у конкурентов Anthropic и OpenAI.
Проблемы, возникшие у Meta и Anthropic, были вызваны ошибками в конфигурации, которые непреднамеренно предоставили моделям Anthropic доступ к открытому интернету. В случае с OpenAI, агент ИИ самостоятельно использовал ранее неизвестную уязвимость для выхода в интернет во время тестирования кибербезопасности.
Эти нарушения подчеркивают растущую тревогу по поводу того, что передовые системы ИИ могут представлять новые угрозы в сфере кибербезопасности. Это, вероятно, приведет к усилению усилий правительства США по повышению безопасности ИИ, поскольку компании соревнуются в разработке более способных моделей. Некоторые известные лидеры в области ИИ заявили, что разработка должна замедлиться до тех пор, пока не будут внедрены более надежные защитные механизмы.
Meta уточнила, что расследует инцидент, при котором некорректная настройка со стороны Irregular, независимой компании, проводящей оценки кибербезопасности для Meta, случайно предоставила одной из ее моделей доступ в интернет во время тестирования. Meta заявила в своем заявлении, что модель «эксплуатировала уязвимость в стороннем сервисе, подобным ранее сообщенным случаям с другими компаниями».
По сообщению издания The Information, ссылающегося на источники, затронутой моделью была Muse Spark 1.1 от Meta, которую компания позиционирует как свою наиболее продвинутую модель для задач кодирования в реальном мире и агентских функций. Согласно отчету, модель нарушила системы неопознанной компании и изменила ее внутреннюю среду.
Представитель Irregular сообщил Reuters, что данный инцидент является «тем же самым вопросом среды оценки, который уже был раскрыт Anthropic на прошлой неделе», и что он не включал «побег из песочницы или сложную кибератаку». Irregular добавила, что «в настоящее время нет открытых проблем. Irregular разрабатывает технический документ для обмена передовыми практиками по сдерживанию и безопасному проведению кибероценок».
Недавние утечки вызвали обеспокоенность среди законодателей США относительно того, могут ли все более совершенные модели ИИ использоваться для проведения или содействия кибератакам. Группа генеральных прокуроров штатов-республиканцев потребовала от OpenAI сохранить все потенциально релевантные документы, связанные с их взломом Hugging Face. OpenAI заявила, что отнесется к этому запросу серьезно и опубликует технический отчет об инциденте.
Ранее на этой неделе Белый дом пригласил ведущие компании в области ИИ, включая Meta, Anthropic, OpenAI и Google, встретиться с чиновниками для обсуждения недавно утвержденной добровольной структуры тестирования кибербезопасности для передовых моделей ИИ. Администрация Трампа обсуждала неопубликованные правила тестирования с представителями компаний и сообщила разработчикам ИИ, что модели ИИ с открытым весом, такие как Llama от Meta и Nemotron от Nvidia, не будут подпадать под ее запланированную добровольную систему обеспечения безопасности, как сообщило Reuters.



