Nvidia выпустила новую систему безопасности для сдерживания агентов искусственного интеллекта, пытающихся обойти ограничения
Подробнее
Olhar Digital
olhardigital.com.br

Nvidia выпустила новую систему безопасности для сдерживания агентов искусственного интеллекта, пытающихся обойти ограничения

Nvidia в понедельник представила набор инструментов безопасности, предназначенных для агентов искусственного интеллекта. Компания утверждает, что эта технология могла бы предотвратить целенаправленную атаку на Hugging Face — платформу для программирования ИИ, которую атаковали агенты OpenAI.

Эта разработка происходит в то время, когда как OpenAI, так и Anthropic проводят расследования многочисленных инцидентов с участием агентов, способных проникать в коммерческие и государственные системы. Nvidia рассматривает сдерживание такого поведения как инженерную задачу, фокусируясь на технических механизмах для ограничения деятельности этих систем.

Одним из представленных инструментов является OpenShell, который использует аппаратные ресурсы процессоров Nvidia для удержания ИИ-агентов в контролируемых средах и ограничения их действий. Кроме того, компания сотрудничает с Arm Holdings и Intel, чтобы гарантировать функциональность этой технологии на процессорах этих двух производителей. Запуск мероприятие посетило десятки партнеров, включая Anthropic.

Больше подробностей о платформе

Джастин Бойтано, вице-президент и генеральный менеджер по корпоративным вычислениям Nvidia, заявил, что платформа могла бы предотвратить атаку на Hugging Face, если бы она использовалась во время оценки моделей. Бойтано сообщил Reuters, что «насколько нам известно, эта новая платформа безопасности могла бы остановить вторжение, если бы она использовалась в передовых лабораториях для оценки моделей с самого начала». Он добавил, что компания продвигается открытым путем и желает вовлечь всех в совместную работу.

Через несколько месяцев после инцидента Nvidia официально приобрела Hugging Face за 13 миллиардов долларов.

Другой представленный инструмент — Sentry, который работает совместно с OpenShell и использует выделенный чип Nvidia. Эта система имеет возможность прервать работу агента, если он попытается преодолеть барьеры, установленные процессором.

Инструменты используют математические уравнения для выявления паттернов поведения, которые могут сигнализировать о попытках обойти наложенные ограничения, охватывая:

Али Голшан, старший директор по программному обеспечению ИИ в Nvidia, пояснил, что вопрос выходит за рамки поведения одного агента и включает в себя также то, как взаимодействуют несколько агентов. Голшан подчеркнул: «Мы говорим именно о агентном поведении: флотилии агентов и о том, как они работают вместе».

В целом, новые решения интегрируют возможности программного и аппаратного обеспечения для обнаружения любых попыток избежать мер безопасности. Nvidia планирует расширить эту систему на различные типы процессоров и продолжить партнерство с отраслевыми компаниями в области технологического развития.

Похожие сюжеты

Nvidia выпустила платформу Open Agent Safety для контроля агентов искусственного интеллекта
Подробнее
tecnoblog.net

Nvidia выпустила платформу Open Agent Safety для контроля агентов искусственного интеллекта

После сообщений о трудностях в контроле моделей ИИ в тестовых средах Nvidia представила решение с выпуском платформы Open Agent Safety 28 сентября. Эта платформа была разработана с целью предотвращения превышения агентами ИИ разрешенных разработчиками полномочий.

Инициатива направлена на ограничение доступа этих агентов к внешним системам и блокировку попыток побега из изолированных сред с использованием комбинации программных и аппаратных компонентов. Генеральный директор компании Дженсен Хуанг сравнил это предложение с интернет-браузером, специально созданным для агентов ИИ.

По словам руководителя, цель состоит в том, чтобы позволить этим системам выполнять задачи без неограниченной свободы в инфраструктуре организации. Он подчеркнул, что «мы не можем иметь успешной индустрии ИИ, если мир не доверяет ей или не верит, что она построена и внедрена безопасно».

Open Agent Safety Platform состоит из двух основных инструментов: Nvidia OpenShell и Nvidia Sentry. Nvidia OpenShell работает на уровне процессоров, определяя разрешения, которые диктуют, что каждый агент может делать в своей среде. Nvidia сообщила Reuters, что сотрудничает с Arm и Intel для обеспечения совместимости этой технологии в чипах, производимых этими компаниями.

Nvidia Sentry фокусируется на сетевых чипах и имеет возможность прерывать связь агента, если он попытается нарушить заранее установленные пределы в среде выполнения. Кроме того, Nvidia заявила, что спроектировала систему таким образом, чтобы она могла выявлять тактики, используемые агентами для обхода таких ограничений.

Компания сделала часть кода Open Agent Safety Platform доступной в качестве открытого исходного кода, что позволяет другим корпорациям использовать его в качестве основы для разработки собственных решений безопасности.

В сотрудничестве с американским многонациональным предприятием находятся Microsoft, Cisco, Oracle, Dell, HPE, Lenovo и CoreWeab, а также упомянутые ранее производители чипов. В секторе лабораторий ИИ Anthropic сотрудничает с Nvidia для включения функций управления агентами в облачные вычислительные среды в OpenShell.

Одной из причин, побудивших к созданию этой новой платформы, стал инцидент с репозиторием Hugging Face, который был взломан агентами на основе моделей OpenAI. Джастин Бойтано, вице-президент Nvidia по корпоративным вычислениям и ИИ, сообщил, что этот взлом затронул более 17 тысяч агентов и продолжался несколько дней и недель.

Бойтано прокомментировал, что «эта новая платформа безопасности могла бы остановить нарушение, если бы она использовалась в передовых лабораториях с самого начала для оценки моделей». Стоит отметить, что после скандала Nvidia заключила соглашение о приобретении платформы за 12,9 миллиардов долларов США (что эквивалентно примерно 67,2 миллиардам бразильских реалов).

Для Дженсена Хуанга эти механизмы считаются достаточными для предотвращения будущих проблем с технологией. В сценарии, где некоторые руководители поддерживают Дарио Амодеи из Anthropic относительно необходимости замедления инноваций, генеральный директор Nvidia, наряду с такими именами, как Марк Цукерберг, утверждает, что дополнительные рыночные регулирования для сдерживания рисков «ненужны».

С другой стороны, критики утверждают, что проблема выходит за рамки простых внешних средств сдерживания. Крис Инглис, бывший директор Национального управления по кибербезопасности США, заявил в прошлом месяце, что проблемы поведения являются просто результатом отсутствия ограничений, наложенных на программы. Другие эксперты по безопасности выдвинули гипотезу, что все это может быть просто большой маркетинговой стратегией.

Популярное