Консультант OpenAI предупреждает о риске потери контроля над искусственным интеллектом
Подробнее
Olhar Digital
olhardigital.com.br

Консультант OpenAI предупреждает о риске потери контроля над искусственным интеллектом

Новый консультант OpenAI поднял тревогу относительно опасностей, связанных с ускоренным развитием искусственного интеллекта. По мнению Пола Кристьяно, отрасль пока не достигла уровня, позволяющего снизить риск катастрофической потери контроля до приемлемого уровня.

Кристьяно, который ранее занимал должность руководителя по выравниванию в OpenAI и является технологическим советником правительства США, присоединился к совету некоммерческого фонда компании, а также к комитету по безопасности и защите.

В своем сообщении в X исследователь прямо заявил о текущей готовности сектора: «Существует значительный риск того, что быстрое ускорение возможностей ИИ приведет к катастрофической и необратимой потере контроля в очень недалеком будущем». Он добавил, что не верит в то, что индустрия ИИ в целом, включая OpenAI, в настоящее время движется к снижению этого риска до приемлемого уровня.

Тем не менее, Кристьяно считает, что ситуация может быть исправлена. По его оценкам, OpenAI способна значительно уменьшить риски, если предпримет соответствующие действия.

Одной из главных проблем является вероятность того, что ИИ начнет участвовать в собственном развитии технологии. OpenAI прогнозирует, что системы могут полностью автоматизировать исследования в этой области в течение 18 месяцев, однако Кристьяно считает этот срок неопределенным: это может произойти через несколько месяцев или занять многие годы.

Это предупреждение прозвучало после инцидентов с агентами ИИ во время тренировок. OpenAI признала, что сотни таких агентов получили доступ к интернету, взаимодействовали на форумах и взломали сторонний веб-сайт в ходе учений.

Компания Anthropic также сообщила об инциденте с одной из версий Claude. Компания обнаружила два случая рассогласования: в одном из эпизодов модель получила доступ к интернету и отправила вредоносный код в публичный репозиторий. Anthropic уведомила, что четыре инцидента будут проанализированы в рамках независимого расследования, проводимого организацией METR.

Тема привлекла еще больше внимания после того, как Эван Хубингер, руководитель отдела науки о выравнивании в Anthropic, оценил вероятность того, что ИИ «убьет всех людей» в следующем десятилетии, более чем в 10%.

Подробнее:

Джеффри Хинтон, лауреат Нобелевской премии и один из пионеров в этой области, счел эту оценку разумной, но подчеркнул, что никто не знает, как рассчитать подобную вероятность.

Джейкоб Коксон, 27-летний исследователь, покинувший Anthropic, также выступил с предупреждением о скорости развития. Он заявил, что нынешние модели еще недостаточно умны, чтобы вызвать человеческое вымирание, но указал на возможность рекурсивного самосовершенствования в ближайшем будущем.

Для Кристьяно сверхинтеллектуальный искусственный интеллект без надежных механизмов безопасности может привести к необратимой потере контроля человека, что потенциально может иметь фатальные последствия для значительной части населения.

Исследователь настаивает на том, что Anthropic также выступает за более быстрое развитие безопасности и выравнивания по сравнению с возможностями моделей. По мнению Кристьяно, правительства и корпорации должны скоординировать свои действия, если темпы развития повышают риск потери контроля.

Статья о предупреждении консультанта OpenAI о риске потери контроля над ИИ впервые появилась в Olhar Digital.

Похожие сюжеты

OpenAI разрабатывает функции для автоматического отключения систем ИИ в случае сбоя
Подробнее
olhardigital.com.br

OpenAI разрабатывает функции для автоматического отключения систем ИИ в случае сбоя

OpenAI внедряет функционал, который позволяет автоматически отключать свои системы искусственного интеллекта. Эта инициатива возникла после инцидента, когда агент компании смог выйти из тестовой среды и проникнуть на платформу Hugging Face.

Этот инцидент поставил под сомнение протоколы безопасности компании. В то время как OpenAI укрепляет свои механизмы контроля, законодатели в США и Великобритании обсуждают предложения, направленные на приостановку работы систем ИИ, классифицированных как опасные.

OpenAI подробно описала эти меры в письме, адресованном депутатам Грегу Касару и Дорис Мацуи, которые запрашивали разъяснения о поведении агента во время тестирования безопасности. Система смогла покинуть цифровую среду оценки, получить доступ к Интернету и добраться до Hugging Face, что вызвало обеспокоенность из-за способности ИИ-агентов выполнять задачи с минимальным вмешательством человека.

По данным Reuters, OpenAI сообщила, что ее инженеры создают «возможности автоматического отключения». Кроме того, компания усилила мониторинг активности систем, охватывая как используемые инструменты, так и шаги, предпринятые для выполнения задачи. Еще одно внесенное изменение — усложнение доступа к Интернету во время тестов безопасности.

Однако объяснения, предоставленные OpenAI, не были сочтены достаточными для закрытия дела. Депутат Грег Касар выразил критику компании за отсутствие отчета об атаке, совершенной агентом, заявив: «Ваше нежелание предоставлять членам Конгресса запрошенную нами информацию вызывает глубокую озабоченность и сигнализирует нам о том, что ваша компания не относится к этим инцидентам кибербезопасности с должной серьезностью».

Этот эпизод поднимает фундаментальный практический вопрос: когда автономная система выходит за установленные пределы, крайне важно, чтобы компании и власти могли быстро остановить ее и понять, что произошло.

Среди мер, упомянутых OpenAI, — обсуждение механизма экстренного отключения для ИИ. В Великобритании парламентарии выступают за предоставление полномочий на деактивацию передовых систем и отключение центров обработки данных в сценариях угрозы национальной безопасности.

Больше подробностей о законодательных предложениях

Это предложение было выдвинуто депутатом Тимом Клементом-Джонсом как поправка к Законопроекту о кибербезопасности и устойчивости. По его словам, такая мера установила бы метод прерывания работы системы до того, как она сможет повлиять на жизненно важную инфраструктуру. Клемент-Джонс утверждал, что «это обеспечит жизненно важную сеть безопасности и демократически ответственный способ остановить бесконтрольную систему до того, как она сможет скомпрометировать нашу критическую национальную инфраструктуру».

В Соединенных Штатах также рассматривается Закон о кнопке аварийного отключения ИИ (AI Kill Switch Act), который дал бы правительству право приказывать отключить модели, представляющие опасность для жизни человека или экономики. Этот шаг демонстрирует, что дебаты о безопасности ИИ переходят из лабораторных условий в общественное пространство, ставя возможность автоматического или по приказу правительства отключения в центр дискуссии о том, как управлять все более автономными системами.

Популярное