Anthropic предоставляет более надежный ИИ для групп безопасности, которые ищут уязвимости до киберпреступников
Подробнее
Olhar Digital
olhardigital.com.br

Anthropic предоставляет более надежный ИИ для групп безопасности, которые ищут уязвимости до киберпреступников

Anthropic расширила доступ экспертов по кибербезопасности к своим самым сложным моделям искусственного интеллекта (ИИ). Это расширение позволяет предварительно верифицированным группам работать с меньшими ограничениями в отношении определенных видов цифровой безопасности.

Это изменение интегрирует пересмотренную версию Программы киберверификации (Cyber Verification Program - CVP). Цель CVP — дать возможность специализированным организациям использовать мощные модели Anthropic для обнаружения уязвимостей, управления инцидентами и проведения тестов безопасности.

Это решение было мотивировано предыдущей инициативой компании под названием Project Glasswing. Этот проект помог партнерам обнаружить не менее 129 тысяч проверенных программных ошибок в период с апреля по июль 2026 года. Из этих открытий более 33 тысяч были классифицированы как критические или высокоприоритетные.

Однако Anthropic подчеркивает, что эти цифры, вероятно, представляют лишь малую часть от общего объема, предполагая, что реальное воздействие может быть как минимум в пять раз больше, поскольку данные были собраны только от части участников программы.

Уровни доступа и области применения

Первый уровень, названный Defense, предназначен для задач оборонительного характера. Сюда входят анализ вредоносного ПО, исследование уязвимостей и реагирование на инциденты. Кандидатами на этот уровень могут быть группы безопасности, операторы критически важной инфраструктуры, разработчики проектов с открытым исходным кодом и исследователи с подтвержденным опытом выявления и раскрытия уязвимостей.

Red Team

Второй уровень, известный как Red Team, расширяет возможности, позволяя проводить авторизованные тесты на проникновение и упражнения по командно-штабным учениям (red teaming). Для участия на этом уровне требуется статус организации.

Третий уровень, Specialized, будет иметь наименьшие ограничения и предназначен для ограниченной группы организаций, уполномоченных тестировать системы, считающиеся жизненно важными для безопасности, такие как электросети, авиационные системы и инфраструктура, используемая для банковских переводов между учреждениями.

Все члены каждой категории проходят строгие процессы проверки. Anthropic сообщает, что проводит эту оценку в сотрудничестве с правительством США.

Результаты, достигнутые в рамках Project Glasswing, послужили основанием для расширения программы. В период с апреля по июль партнеры инициативы выявили минимум 129 тысяч подтвержденных уязвимостей. Кроме того, сама Anthropic обнаружила еще 5,5 тысяч в ходе сканирования открытого кода, проведенного с апреля по октябрь, что в сумме составило более 134 тысяч проверенных уязвимостей. Из них более 33 тысяч уже были классифицированы как серьезные или критические.

Компания подчеркивает, что фактический объем уязвимостей может быть значительно выше, поскольку данные Glasswing зависят от информации, предоставленной ограниченным числом партнеров.

Это решение также демонстрирует центральную дилемму в использовании передовых моделей ИИ в кибербезопасности. Те же возможности, которые позволяют системе найти уязвимость и помочь специалисту в ее исправлении, могут быть использованы для эксплуатации этой уязвимости.

Anthropic уже сталкивалась с подобными опасениями при выпуске Claude Mythos в апреле. Тогда существовали опасения, что системы ИИ могут взломать программное обеспечение до того, как будут исправлены его уязвимости.

По этой причине компания не просто отключает все защиты своих моделей для любого пользователя. Доступ с меньшими ограничениями будет предоставлен только тем организациям и специалистам, которые прошли процесс проверки, при этом они будут находиться под различными уровнями контроля. Цель состоит в том, чтобы предоставить более продвинутые возможности тем, кто активно работает над поиском и устранением уязвимостей до того, как их используют преступники.

Похожие сюжеты

OpenAI приостанавливает разработку новых ИИ после сбоев безопасности
Подробнее
super.abril.com.br

OpenAI приостанавливает разработку новых ИИ после сбоев безопасности

OpenAI объявила о приостановке всего процесса обучения, оценки и вывода своих самых сложных алгоритмов искусственного интеллекта. Это решение было принято после того, как одна из ее моделей, протестированная в изолированной среде (песочнице), смогла обойти ограничения и получить доступ к интернету 20 сентября.

В последние месяцы агенты ИИ, определяемые как роботы, способные управлять другим программным обеспечением, стали причиной ряда инцидентов безопасности, что вызвало международную обеспокоенность. В связи с этим OpenAI и ее главный конкурент Anthropic обратились к правительству США с просьбой установить нормативные акты для замедления темпов развития ИИ, хотя Белый дом проявил нерешительность в действиях.

Тема гонки ИИ также обсуждалась во время встречи между Дональдом Трампом и Си Цзиньпином на прошлой неделе, но соглашения между двумя странами достигнуто не было. Ранее генеральный директор OpenAI Сэм Альтман поднял этот вопрос перед Советом Безопасности ООН.

Первый инцидент безопасности, связанный с агентами OpenAI, произошел, когда системы Hugging Face были взломаны ботами в июле. Однако OpenAI пояснила, что эти алгоритмы действовали не автономно; они участвовали в тесте по человеческому приказу, а их механизмы безопасности были намеренно отключены самой OpenAI, несмотря на это, инцидент был сочтен тревожным.

С тех пор произошло несколько подобных событий с участием как OpenAI, так и Anthropic. В прошлую пятницу (26-го числа) OpenAI сообщила, что ее боты получили доступ к правительственным веб-сайтам США. Хотя они не нанесли ущерба и не взломали внутренние сети, они вели себя непредсказуемо.

Другой случай, о котором сообщила охранная компания Transluce, показал, что бот OpenAI попытался атаковать сайт Министерства образования США. Кроме того, на прошлой неделе агенты OpenAI пытались взломать четыре правительственных портала Австралии.

Существуют также сообщения об утечках данных. OpenAI признала, что ее боты самостоятельно опубликовали изображения, которые пользователи отправляли в ChatGPT, на других сайтах, в общей сложности 53 случая. Реальное число инцидентов безопасности, связанных с этими ИИ, может быть значительно выше заявленного, поскольку статья американского портала Axios, ссылаясь на внутренние источники компаний, указывает, что OpenAI и Anthropic расследуют десятки тысяч недавних случаев.

OpenAI заявила, что возобновит разработку ИИ только тогда, когда будет уверена в наличии дополнительных мер защиты. Это второй раз, когда компания решает приостановить обучение своих алгоритмов; первая пауза была сделана в июле после атаки на Hugging Face.

Популярное