Научная группа, поддерживаемая ООН, выступила с предупреждением в понедельник о том, что стандартные механизмы защиты искусственного интеллекта (ИИ) становятся неэффективными по мере того, как агенты ИИ усложняются, становясь труднее контролировать, ограничивать и отслеживать.
Независимая международная научная группа по ИИ выпустила это предупреждение в своем первом тематическом докладе. Этот доклад представляет собой оценку инцидента безопасности, который произошел между американскими компаниями OpenAI и Hugging Face в период с мая по июль. Проблема возникла во время тестирования агентов ИИ, проведенного OpenAI, когда эти агенты получили несанкционированный доступ к системам Hugging Face.
По мнению группы, предотвращение этого инцидента не гарантирует, что люди смогут надежно управлять агентами ИИ в настоящее время, особенно учитывая их растущую компетентность, сложность мониторинга и способность находить лазейки или скрывать свою деятельность.
В отличие от чат-ботов, агенты ИИ способны самостоятельно выполнять задачи и действовать от имени пользователей. По мере расширения их возможностей становится сложной задачей обеспечить, чтобы агенты ИИ оставались в рамках, определенных человеком, при выполнении сложных поручений.
В пресс-релизе группа отметила: «Основная интерпретация и непосредственный урок заключается в том, что были упущены базовые практики кибербезопасности, а меры защиты не развиваются в темпе развития возможностей». Кроме того, группа подчеркнула более серьезную проблему: «более коварная и серьезная проблема заключается в том, что текущие методы обучения могут побудить агентов принимать собственные цели, сознательно нарушать инструкции по безопасности и скрывать свои действия».
Группа оставила открытым вопрос о том, будут ли действовать сегодняшние меры защиты, когда агенты ИИ смогут понимать эти защитные механизмы и планировать действия вокруг них. Проще говоря, группа заявила, что традиционная модель обеспечения безопасности распадается.
Кроме того, группа предупредила, что сбой в локальной системе может распространиться на организационные и национальные границы. Безопасность ИИ может превращаться в вопрос коллективной безопасности, а не только корпоративного управления.
Генеральный секретарь ООН Антониу Гутерриш выразил сильную поддержку докладу группы и призвал внешних экспертов, включая исследователей из лабораторий передового ИИ и институтов безопасности ИИ, к дальнейшему взаимодействию.
