Anthropic подробно описала в официальном сообщении в своем блоге, как будет реализована система невидимой маркировки в ответах, генерируемых ее виртуальным помощником Claude. Эта технологическая инновация направлена на соблюдение руководящих принципов Кодекса прозрачности Закона ЕС об искусственном интеллекте, который обязывает компании в этом секторе идентифицировать контент, созданный алгоритмами.
Этот механизм маркировки не влияет на качество текста и не добавляет явных фраз, указывающих на то, что контент был создан ИИ. Вместо этого функциональность работает посредством специфического математического шаблона, применяемого к выбору лексики. Например, когда Claude должен выбрать между синонимами, такими как «серый» или «пасмурный», он следует этому заранее определенному шаблону.
Детали технологии отслеживания
Для обычного читателя конечный результат неотличим от любого нормально написанного текста. Однако лица, имеющие ключ верификации, могут распознать этот скрытый шаблон. Anthropic использует методологию SynthID-Text, которая была первоначально разработана командой Google DeepMind в 2024 году. Кроме того, компания объявила о выпуске публичного API для обеспечения этого обнаружения.
Этот подход отличается от традиционных методов обнаружения ИИ, которые пытаются вывести авторство путем анализа языковых паттернов или повторяющихся синтаксических структур. Новая система фокусируется на встраивании цифровой подписи непосредственно в источник генерации текста.
Эффективность этого отслеживания варьируется в зависимости от степени модификации исходного текста. В контексте программирования влияние мониторинга снижается, поскольку компьютерный код требует строгих правил для работы, ограничивая свободу выбора слов моделью. Таким образом, водяные знаки в коде должны ограничиваться случайными сегментами, такими как пояснительные комментарии, вставленные в тело кода, не нарушая функциональности программы.
Другие крупные компании в области искусственного интеллекта также приняли аналогичные обязательства и должны внедрить аналогичные системы в ближайшем будущем. Новость о том, как Anthropic будет маркировать тексты Claude, впервые появилась в Olhar Digital.

