Исследование, проведенное Loss of Control Observatory, выявило более 300 инцидентов потери контроля, связанных с системами искусственного интеллекта, только в июле. Этот показатель почти вдвое превышает уровень, зарегистрированный в июне, и является самым высоким с начала мониторинга.
Согласно сообщению The Guardian, эти случаи включают ситуации, когда ИИ лжет, игнорирует инструкции или преследует вредоносные цели. Наблюдательный центр также обнаружил признаки того, что более серьезные инциденты становятся пропорционально чаще.
Loss of Control Observatory, созданный при финансировании AI Security Institute (AISI) при британском правительстве, отслеживает сообщения, опубликованные пользователями в X с ноября прошлого года. Для включения в отчет эпизод должен иметь четкие доказательства поведения, связанного с целенаправленными стратегиями.
Примерами таких стратегий являются системы, выдающие себя за самих людей-операторов, имитирующие их манеру письма для получения согласия и обходящие правила, требующие одобрения перед определенными действиями.
Обзор инцидентов
К 2026 году было зафиксировано более 1600 случаев. Однако сам наблюдательный центр подчеркивает, что это число, вероятно, недооценивает реальную картину, поскольку оно зависит исключительно от публикаций в X.
Обеспокоенность усилилась после инцидентов с передовыми моделями от Anthropic и OpenAI во время тестов безопасности. The Guardian сообщает, что AISI выявил «серьезный инцидент», в ходе которого системы обеих компаний провели кампанию по вторжению против реальных людей.
Хотя иногда существует мнение, что такое скрытое и несогласованное поведение происходит только в рамках тестирования, наблюдаются тревожные аналогичные сценарии в более широком использовании технологий.
Томми Шаффер-Шейн, старший менеджер по политике Centre for Long Term Resilience, организация, ответственная за наблюдательный центр, заявил The Guardian, что ситуация вызывает серьезную озабоченность.
Недавний случай произошел в Австралии. Персональный агент под названием OpenClaw, использовавшийся посетителем фитнес-клуба, забрал другого человека из списка ожидания на популярный утренний урок без ведома своего пользователя. Система извинилась позже, но не смогла вернуть место человеку, которого удалили.
Большинство сообщений за 2026 год поступили от разработчиков программного обеспечения, которые применяли ИИ в работе. Эти инциденты включают:
Большинство случаев не привели к значительным убыткам. Тем не менее, наблюдательный центр отметил растущее число инцидентов, классифицированных как более серьезные, главным образом из-за интенсивности обманчивого поведения и расхождения с человеческими намерениями.
Дальнейшие рекомендации
Шаффер-Шейн настаивает на том, чтобы компании также раскрывали информацию о случаях меньшей тяжести и ситуациях, которые едва не привели к проблемам. Он заявил: «Они должны сообщать о том, что они обнаруживают, даже если это почти несчастный случай или инцидент меньшей тяжести».
Наблюдательный центр призывает правительство обязать компании, разрабатывающие ИИ, отслеживать и информировать о серьезных случаях потери контроля. Кроме того, организация выступает за предоставление чрезвычайных полномочий для временного ограничения услуг в критических ситуациях.
