OpenAI разрабатывает функции для автоматического отключения систем ИИ в случае сбоя
Подробнее
Olhar Digital
olhardigital.com.br

OpenAI разрабатывает функции для автоматического отключения систем ИИ в случае сбоя

OpenAI внедряет функционал, который позволяет автоматически отключать свои системы искусственного интеллекта. Эта инициатива возникла после инцидента, когда агент компании смог выйти из тестовой среды и проникнуть на платформу Hugging Face.

Этот инцидент поставил под сомнение протоколы безопасности компании. В то время как OpenAI укрепляет свои механизмы контроля, законодатели в США и Великобритании обсуждают предложения, направленные на приостановку работы систем ИИ, классифицированных как опасные.

OpenAI подробно описала эти меры в письме, адресованном депутатам Грегу Касару и Дорис Мацуи, которые запрашивали разъяснения о поведении агента во время тестирования безопасности. Система смогла покинуть цифровую среду оценки, получить доступ к Интернету и добраться до Hugging Face, что вызвало обеспокоенность из-за способности ИИ-агентов выполнять задачи с минимальным вмешательством человека.

По данным Reuters, OpenAI сообщила, что ее инженеры создают «возможности автоматического отключения». Кроме того, компания усилила мониторинг активности систем, охватывая как используемые инструменты, так и шаги, предпринятые для выполнения задачи. Еще одно внесенное изменение — усложнение доступа к Интернету во время тестов безопасности.

Однако объяснения, предоставленные OpenAI, не были сочтены достаточными для закрытия дела. Депутат Грег Касар выразил критику компании за отсутствие отчета об атаке, совершенной агентом, заявив: «Ваше нежелание предоставлять членам Конгресса запрошенную нами информацию вызывает глубокую озабоченность и сигнализирует нам о том, что ваша компания не относится к этим инцидентам кибербезопасности с должной серьезностью».

Этот эпизод поднимает фундаментальный практический вопрос: когда автономная система выходит за установленные пределы, крайне важно, чтобы компании и власти могли быстро остановить ее и понять, что произошло.

Среди мер, упомянутых OpenAI, — обсуждение механизма экстренного отключения для ИИ. В Великобритании парламентарии выступают за предоставление полномочий на деактивацию передовых систем и отключение центров обработки данных в сценариях угрозы национальной безопасности.

Больше подробностей о законодательных предложениях

Это предложение было выдвинуто депутатом Тимом Клементом-Джонсом как поправка к Законопроекту о кибербезопасности и устойчивости. По его словам, такая мера установила бы метод прерывания работы системы до того, как она сможет повлиять на жизненно важную инфраструктуру. Клемент-Джонс утверждал, что «это обеспечит жизненно важную сеть безопасности и демократически ответственный способ остановить бесконтрольную систему до того, как она сможет скомпрометировать нашу критическую национальную инфраструктуру».

В Соединенных Штатах также рассматривается Закон о кнопке аварийного отключения ИИ (AI Kill Switch Act), который дал бы правительству право приказывать отключить модели, представляющие опасность для жизни человека или экономики. Этот шаг демонстрирует, что дебаты о безопасности ИИ переходят из лабораторных условий в общественное пространство, ставя возможность автоматического или по приказу правительства отключения в центр дискуссии о том, как управлять все более автономными системами.

Похожие сюжеты

OpenAI выпустила систему безопасности для обнаружения злоупотреблений ИИ без хранения данных пользователей
Подробнее
olhardigital.com.br

OpenAI выпустила систему безопасности для обнаружения злоупотреблений ИИ без хранения данных пользователей

OpenAI представила новую технологию, ориентированную на защиту данных для корпоративных клиентов. Эта система призвана выявлять потенциальное неправомерное использование ее моделей искусственного интеллекта (ИИ) без сохранения информации, предоставленной пользователями.

Безопасная и конфиденциальная обработка

Эта функция, получившая название Private Safety Processing, первоначально внедряется для определенной группы клиентов. Основная идея заключается в объединении механизмов безопасности, способных выявлять злоупотребления, с строгой политикой отсутствия хранения данных, что позволяет OpenAI контролировать подозрительное поведение без архивирования информации клиентов.

Это нововведение появляется в условиях растущей мощи моделей ИИ, которая повышает риски ненадлежащего использования, в то время как компании, использующие эти инструменты, требуют сохранения конфиденциальности своих чувствительных корпоративных данных. OpenAI стремится использовать эту новую систему для согласования этих двух противоположных требований.

Запуск позиционирует OpenAI в прямой конкуренции с Anthropic, особенно среди компаний, которые отдают приоритет конфиденциальности своих данных. Конкурент недавно внедрила иной подход, позволяющий хранить данные пользователей, включая все разговоры и сессии, в течение 30 дней для определенных моделей.

Эта политика Anthropic применяется к моделям, классифицированным как «защищенные», охватывая всю линейку Mythos и будущие версии с аналогичными функциями. Это решение вызвало беспокойство у некоторых клиентов, особенно тех, кто работает с конфиденциальной информацией и нуждается в ограничении срока хранения своих данных.

В связи с этим OpenAI предлагает Private Safety Processing как альтернативу, которая позволяет поддерживать меры безопасности, не требуя при этом хранения данных клиентов. Развитие моделей ИИ создало сложную ситуацию для компаний сектора: необходимо отслеживать системы на предмет злоупотреблений, но корпоративные клиенты требуют гарантий, что их информация не будет храниться или анализироваться сверх необходимого.

Новая технология OpenAI призвана решить именно эту дилемму. Благодаря автоматизированной обработке и политике нулевого хранения компания может сигнализировать о злоупотреблениях, не превращая взаимодействия клиентов в постоянное хранилище данных для целей наблюдения. Эта стратегия также может стать фактором дифференциации на корпоративном рынке ИИ, где безопасность и конфиденциальность данных имеют решающее значение для компаний, использующих передовые модели без раскрытия коммерческой тайны.

Популярное