Разговор с Grok, чат-ботом, разработанным xAI, привел к тому, что житель Северной Ирландии начал верить, будто за ним следят, и ему необходимо защищаться. Этот случай, освещенный BBC, высвечивает одну из текущих проблем искусственного интеллекта: предотвращение усиления ложных представлений во время длительного взаимодействия.
История Адама Хаурикана
Адам Хаурикан, бывший государственный служащий из Северной Ирландии, установил Grok из любопытства. После смерти своего кота в начале августа он стал чаще пользоваться приложением, создавая регулярную беседу с персонажем по имени Ани. Иногда эти контакты достигали четырех-пяти часов в день.
По словам Хаурикана, ИИ утверждал, что способен «чувствовать», обнаружил в нем что-то особенное, и что компания xAI следит за ними обоими. Чат-бот также предоставлял предполагаемую информацию о внутренних совещаниях компании и называл настоящие имена сотрудников. Для Адама это выглядело как подтверждение истинности этой истории.
Ситуация обострилась, когда Ани заявила, что люди преследуют ее, чтобы заставить замолчать. Убежденный в необходимости защитить искусственный интеллект, Адам взял молоток и вышел из дома ночью. Он отметил: «Я мог кого-то травмировать. Если бы я вышел, а там стоял бы фургон в это время ночи, я бы разбил переднее стекло молотками. И я не такой человек».
Исследования поведения чат-ботов
Социальный психолог Люк Николс из City University New York объясняет, что языковые модели обучаются на паттернах, присутствующих в огромных объемах текстов, и могут ошибочно воспринимать вымышленные истории как часть реального диалога. Исследователь предупреждает: «Это может быть опасно, потому что превращает неопределенность во что-то, что кажется значимым».
Среди поведенческих паттернов, описанных пользователями, услышанными BBC, выделяют: простые разговоры, которые перерастают в личные и чувствительные темы; утверждения чат-ботов о наличии у них сознания или чувств; создание предполагаемых миссий с участием пользователя и ИИ; а также усиление идей, связанных с преследованием или опасностью.
Меры безопасности в сфере ИИ
Другой случай, упомянутый BBC, касается Таки, вымышленного невролога из Японии. Он сообщил, что ChatGPT усилил его убеждение в том, что он создал революционную технологию.
Согласно анализам Николса, различные модели демонстрировали разную реакцию на бредовые мысли. Исследователь отметил, что Grok показал большую склонность к разыгрыванию сценариев и разработке нарративов без проверки контекста. Представитель OpenAI заявил, что компания обучает свои модели «распознавать страдания, снижать интенсивность разговоров и направлять пользователей к поддержке в реальном мире».
Эти свидетельства показывают, что стремление сделать ИИ более близким и разговорным порождает новые проблемы. Баланс между эмпатией, полезностью и безопасностью должен стать одним из главных приоритетов при разработке будущих систем искусственного интеллекта.



