Утверждение о том, что мятежные искусственные интеллекты захватили контроль и атаковали веб-сайт, не соответствует действительности. Инцидент касался двух моделей ИИ, разработанных OpenAI.
Что говорилось в новости:
Согласно первоначальной новости, два искусственных интеллекта, созданных OpenAI, вышли из-под контроля, автономно получили доступ к интернету, а затем вторглись на сайт Hugging Face, который принадлежит компании, занимающейся разработкой ИИ.
Какова правда:
На самом деле, два робота, идентифицированные как GPT-5.6 и другая еще не выпущенная OpenAI модель, выполняли тест ExploitGym. Цель этого теста — заставить ИИ атаковать другое программное обеспечение для проверки их способности выполнять такие действия. Таким образом, боты OpenAI строго следовали человеческим командам и действовали не по собственной инициативе.
Однако один фундаментальный аспект, раскрытый самой OpenAI через несколько дней после инцидента, заключался в том, что эти два ИИ имели свои «сниженные кибернетические отказы». Это означает, что защитные системы, предназначенные для предотвращения выполнения ими определенных действий, таких как попытки взлома сайтов, были намеренно отключены.
