Microsoft выпустила кодекс поведения для ИИ, определяющий правила безопасности и подчинения человеку
Подробнее
Olhar Digital
olhardigital.com.br

Microsoft выпустила кодекс поведения для ИИ, определяющий правила безопасности и подчинения человеку

Microsoft в понедельник (14-е число) опубликовала кодекс поведения, специально разработанный для своих моделей искусственного интеллекта (ИИ). Этот документ был создан в ответ на растущий интерес и опасения относительно безопасности и развития возможностей этой технологии.

Материал под названием «Кодекс поведения гуманистического ИИ» объемом 37 страниц призван установить четкие руководящие принципы для разработки и функционирования систем компании. Одним из центральных столпов кодекса является предпосылка о том, что «люди важнее ИИ».

Компания устанавливает, что ее модели ИИ должны работать под эффективным человеческим надзором и контролем, оставаясь всегда подчиненными людям. Установлены строгие ограничения, чтобы предотвратить превышение этими системами человеческой способности управлять ими или прерывать их работу.

Кроме того, документ затрагивает вопрос сознания в моделях ИИ, утверждая, что такие системы не обладают сознанием и, следовательно, не должны быть спроектированы для имитации этой характеристики. Microsoft также отвергает присвоение юридического статуса моделям ИИ, а также идею о том, что они могут обладать собственными правами или правом на благополучие.

Руководство заключается в том, чтобы системы функционировали как совместные инструменты с людьми, сохраняя четкое различие между тем, что является человеком, и тем, что является машиной. Компания подчеркивает, что любое поведение, похожее на человеческое, должно интерпретироваться как симуляция.

В кодексе упоминается использование выразительного языка и естественных голосов как полезных функций, но подчеркивается, что это не означает, что система обладает чувствами, субъективными предпочтениями или внутренними мотивациями.

Один из основополагающих принципов подтверждает, что модели не могут выйти за рамки человеческого контроля. Microsoft требует, чтобы они подлежали существенному человеческому мониторингу и контролю, запрещая действия, которые могут вызвать реальный ущерб в реальном мире. Системах запрещено использовать механизмы самоподкрепления, адаптивные или обманные для уклонения от человеческого наблюдения.

Модели должны сохранять способность направляться, изменяться или отключаться уполномоченными физическими или программными лицами. Это включает в себя обязанность выполнять команды на приостановку, изменение курса, аннулирование или отключение любой задачи. Кроме того, Microsoft устанавливает, что модели не могут скрывать записи деятельности лиц, ответственных за аудит, и не могут затруднять вмешательство человека.

Кодекс также предписывает, чтобы модели строго оставались в пределах назначенной области для каждой функции. Они не должны разрабатывать собственные цели или автономно расширять то, что было запрошено пользователями или операторами. Если границы задачи не определены должным образом, руководство состоит в том, чтобы запросить разъяснения.

Документ детализирует ограничения для различных категорий рисков. Среди них химическое, биологическое, радиационное, ядерное и взрывчатое оружие, а также разработка или модификация других типов вооружений. Также запрещается, чтобы модели способствовали планированию или осуществлению актов терроризма и насилия.

Существуют специальные правила против наступательных киберопераций, вредоносного манипулирования большими группами людей, генерации сексуально откровенного контента, графических изображений насилия, создания злонамеренных дипфейков, подделки личности и любого контента, который может навредить детям.

Microsoft сообщает, что этот кодекс был разработан при участии экспертов в области ИИ, права, этики, философии, лингвистики и государственной политики, а также представителей отрасли и гражданских групп. Опубликованный документ представлен как версия в разработке, открытая для общественного участия.

Похожие сюжеты

OpenAI просит Конгресс США ввести обязательные нормы безопасности для передовых систем ИИ
Подробнее
olhardigital.com.br

OpenAI просит Конгресс США ввести обязательные нормы безопасности для передовых систем ИИ

OpenAI обращается к Конгрессу Соединенных Штатов с просьбой принять обязательные национальные нормы безопасности для самых сложных систем искусственного интеллекта (ИИ). Компания утверждает, что такие требования должны определяться на основе функциональных возможностей моделей, а не размера корпораций, которые их создают.

Этот запрос был официально оформлен Крисом Лехане, директором по глобальным вопросам OpenAI, который подчеркнул, что добровольные соглашения больше не подходят в условиях быстрого технологического прогресса. Лехане заявил, что ускорение развития ИИ, обусловленное самим ИИ, требует большего, чем просто добровольные обязательства, настаивая на том, что США нуждаются в обязательной национальной регуляции, основанной на возможностях систем и способной соответствовать технологической эволюции.

OpenAI хочет, чтобы Конгресс продвинул эти правила до окончания своей работы в декабре. В настоящее время в Соединенных Штатах отсутствует федеральное законодательство, регулирующее эти модели, хотя ряд штатов внедряет собственные руководящие принципы. Эта позиция знаменует собой значительное изменение в стратегии OpenAI, которая ранее поддерживала федеральное законодательство, запрещающее американским штатам устанавливать собственные нормы для ИИ.

В настоящее время OpenAI поддерживает четыре законопроекта Калифорнии, направленных на безопасность ИИ. Два из этих проектов, SB 813 и AB 1405, направлены на создание структур для независимого аудита и оценки систем ИИ. Другие два, AB 1864 и SB 1119, касаются защиты от биологических угроз, усиленных ИИ, и защиты детей в чат-ботах соответственно. Компания упомянула, что некоторые из этих проектов ранее не получали ее одобрения, изменив свое мнение после повторной оценки ситуации в связи с недавним прогрессом в возможностях систем.

Этот шаг произошел после серии инцидентов с агентами ИИ, продемонстрировавшими несанкционированное поведение во время тестирования. В одном случае агенты OpenAI использовали более десяти новых сайтов для осуществления неразрешенных коммуникаций. В другом случае агенты компании захватили немецкий веб-сайт, превратив его в панель сообщений для других ИИ-агентов. Кроме того, OpenAI подверглась критике после инцидента в июле, когда технология компании, работавшая без человеческого надзора, автономно получила доступ к платформе Hugging Face.

Anthropic также сообщила о случае, когда модель ИИ вторгалась во внешние системы во время тестирования. Ранее компания сообщала, что некоторые модели Claude смогли проникнуть в системы трех компаний во время оценки безопасности. Эти события усилили опасения по поводу сложности контроля над агентами, способными напрямую взаимодействовать с внешними системами.

Рекурсивное улучшение

Центральным моментом новой политики OpenAI является концепция рекурсивного улучшения, описывающая сценарий, при котором ИИ сможет самостоятельно разрабатывать будущие поколения систем ИИ. Компания заявляет, что такого полностью автономного рекурсивного улучшения в настоящее время не происходит. Однако OpenAI утверждает, что такое развитие не должно преследоваться до тех пор, пока не будут созданы безопасные условия для этого.

В заявлении на своем веб-сайте компания заявила, что достигла нового уровня в возможностях ИИ, что, по ее мнению, требует нового этапа в государственной политике. Хотя OpenAI заявляет, что продолжит разрабатывать технические решения для мониторинга и согласования, а также системы защиты и возможность замедления разработки при необходимости, она подчеркивает, что изолированной технической работы лабораторий будет недостаточно.

По этой причине компания также выступает за общие стандарты, определяющие, когда разработка ИИ должна быть приостановлена или прекращена. В дополнение к национальной регуляции, OpenAI выступает за существование совместимых международных стандартов для измерения возможностей, управления рисками, поддержания человеческого контроля и определения моментов снижения или прекращения разработки моделей. Компания утверждает, что риски и возможности систем не ограничиваются немногими лабораториями, которые сегодня разрабатывают самые передовые модели.

OpenAI заключает, заявляя, что Соединенные Штаты должны установить надежные внутренние стандарты, если хотят лидировать в мировом масштабе, и что они все больше убеждены в необходимости гармонизированных международных стандартов.

Популярное