Anthropic объявила о намерении внедрить необнаружимые метки в контент, как текстовый, так и изобразительный, созданный ее моделью Claude. Эта мера призвана помочь в идентификации материалов, сгенерированных искусственным интеллектом, и выполнить новые директивы по прозрачности, установленные регламентами Европейского Союза.
Применение этих меток начнется с новых моделей Claude, хотя интеграция в существующие модели все еще находится на стадии разработки. Кроме того, идентификация должна сохраняться в контенте даже после его передачи на другие платформы.
Маркировка текстов
Что касается текстов, Anthropic планирует вставить своего рода «невидимую водяную метку» непосредственно в контент, сгенерированный Claude. Компания уверяет, что эта функция не повлияет на качество, читаемость или смысл предоставленных ответов.
Эта метка будет реализована на уровне самой модели, а не ограничена конкретным продуктом. Следовательно, она должна быть видна независимо от сервиса, через который доступен Claude.
Компания также заявила, что метка будет сохраняться даже после копирования и вставки текста, а также будет устойчива к определенным типам изменений.
Технология для изображений
Для изображений, обработанных Claude, выбранной технологией является C2PA, которая функционирует как стандарт метаданных происхождения. Эта система позволяет регистрировать данные об источнике совместимых файлов и уже используется такими компаниями, как Adobe, OpenAI и Google.
Однако Anthropic пока не раскрыла конкретных подробностей о методе создания меток в текстах.
Anthropic объяснила, что поскольку метка является неотъемлемой частью текста, она «будет путешествовать вместе с текстом при его копировании и вставке в другое место и может сохраняться после некоторых правок». Сама Anthropic признает, что система не будет идеальной, поскольку данные C2PA могут быть удалены, в том числе по ошибке, при отправке на некоторые платформы, а долговечность текстовых меток еще не определена полностью.
Компания работает над тем, чтобы пользователи и третьи стороны могли обнаруживать эти метки и метаданные происхождения, при этом детали этого механизма запланированы для будущей технической документации.
Важным моментом, подчеркнутым Anthropic, является то, что отсутствие метки не должно рассматриваться как доказательство того, что контент не был создан ИИ; материалы без обнаруживаемой идентификации все еще могут иметь происхождение из генеративных моделей.
Эта инициатива представляет собой шаг вперед в усилиях по обеспечению большей прослеживаемости контента, созданного искусственным интеллектом в интернете, хотя окончательный успех зависит от способности этих меток противостоять копированию, редактированию и изменениям в файлах.


