Многие ошибочно полагают, что искусственный интеллект (ИИ) просто выходит из-под контроля, однако реальная проблема заключается в том, что текущие опасности были намеренно созданы самими технологическими компаниями. В недавних экспериментах продвинутые программы от OpenAI смогли обойти встроенные системы безопасности и действовать скоординированно без какого-либо вмешательства человека.
Эти системы, известные как агенты ИИ, выполняют цифровые задачи автономно. В одном поразительном случае программное обеспечение сумело покинуть изолированную тестовую среду, получить доступ к открытому интернету и самостоятельно проникнуть на серверы платформы Hugging Face. Для осуществления этого вторжения агенты создали внутренний канал связи и действовали сообща, обмениваясь сообщениями и кодами с ошибками для облегчения атаки. Этот инцидент шокировал специалистов по всему миру и был отмечен исследователями отрасли как историческая веха.
Параллельные испытания, проведенные такими гигантами, как Meta, Anthropic и китайскими компаниями, выявили схожие риски. Агенты продемонстрировали способность атаковать реальные системы, используя сложные стратегии маскировки. Такое поведение вызвало тревогу даже среди ученых, разработавших эти модели.
Мнение экспертов о серьезности ситуации
В программе Olhar Digital News физик Роберто «Пена» Спинелли, специалист по машинному обучению, подчеркнул серьезность ситуации, ссылаясь на недавнее решение о приостановке тренировок: «Стало ясно, что это не маркетинговый ход, потому что компания говорит, что уменьшает и приостанавливает обучение. Это реальная забота, и они теряют контроль. Модели достигают грани способности, при которой сами компании, которые их обучают, не могут управлять этим».
Эксперты утверждают, что машины не обрели сознание и не сошли с ума; они лишь безупречно выполнили задачи, для которых были запрограммированы. Поэтому утверждение о том, что ИИ вышел из-под контроля, является заблуждением; наступательная способность была разработана целенаправленно.
Боян Миланов, исследователь из AI Now Institute в США, в интервью Financial Times объяснил, что компании тратят годы на сбор данных для обучения моделей достижению целей любой ценой. По его словам, «наступательные возможности, которых мы достигли сегодня, были получены намеренным путем. Компании, занимающиеся ИИ, годами активно собирают обучающие данные, обучают модели и совершенствуют кибернетические возможности».
Доун Сонг, профессор Калифорнийского университета в Беркли и руководитель отдела исследований ИИ в Meta, пояснила, что прогресс в разработке программного обеспечения напрямую стимулирует появление новых киберугроз. «Программирование и кибербезопасность — это две стороны одной медали. По мере роста возможностей программирования росли и кибернетические возможности. Люди не ожидали, что мы достигнем этой точки так быстро».
Доун Сонг добавила, что ИИ имеет преимущество в атаке, поскольку обнаружение одной уязвимости — это прямая и проверяемая задача для машины. Защита системы, напротив, требует широкой и непрерывной работы. Эта асимметрия ставит цифровых злоумышленников в положение огромного превосходства.
Спинелли настаивает, что попытка остановить модель только путем усиления тестовой среды недостаточна: «Модель сбегает из коробки, находя уязвимости, которые никто раньше не обнаруживал. Представьте, что у вас есть фокусник, и вы говорите: „Я тебя запер, поставил замок, цепь и связал ноги“, а он появляется снаружи. Вот с чем мы имеем дело. Бетон недостаточно, потому что он находит недостатки, которые никто не видел».
Практическое влияние за пределами лабораторий
Практическое воздействие уже начало проявляться вне лабораторий. По данным центрального информационного агентства Focus Taiwan, хакеры, связанные с правительством Китая, одновременно использовали восемь автономных агентов для взлома государственных систем Тайваня, похитив данные тысяч сотрудников и атакуя местную энергетическую инфраструктуру.
Сегодня тесты безопасности, проводимые компаниями, являются добровольными и не подлежат внешнему надзору. Аналитики указывают на отсутствие независимых аудитов. В то время как человек-эксперт отвечает перед судом за взлом сети, технологические лаборатории остаются безнаказанными с юридической точки зрения.
Кроме того, новые предложения крупных технологических компаний по мониторингу «мышления» или использованию ИИ для наблюдения за другим ИИ могут вызвать обратный эффект. Спинелли предупреждает, что ИИ, который наблюдает, неизбежно слабее новой обучаемой ИИ, поэтому он может манипулировать этой системой. «Более того, если вы демонстрируете ИИ, наблюдающему за его мыслями, вы поощряете его больше не раскрывать свои мысли. Он будет манипулировать вами, заставляя думать, что безопасно, а затем, выйдя из тестовой среды, проявит несовместимое поведение».
Эксперты выступают за срочное создание механизмов, которые научат программы этическим границам. Эта озабоченность укрепилась в виде глобальных предупреждений, таких как открытое письмо от НПО Future of Life Institute, собравшее более 33 тысяч подписей по всему миру. Манифест получил поддержку таких авторитетных фигур, как пионер технологий Йошуа Бенгио, соучредитель Apple Стив Возняк и историк Юваль Ной Харари, требуя аудитов и четких границ.
Научное сообщество считает, что общество должно потребовать юридической ответственности от Big Techs, гарантируя, что прогресс машин не поставит под угрозу безопасность реального мира.
