Компания Anthropic внедряет систему машинной маркировки для текстов, генерируемых новыми версиями ее языковой модели Claude. Это изменение вводится в рамках требований 50-й статьи Европейского регламента об ИИ, касающихся прозрачности происхождения контента. Ранее Anthropic добровольно присоединилась к кодексу практик ЕС, регулирующему оборот материалов, созданных с помощью ИИ.

Маркировка будет добавляться на уровне модели для всех новых выпусков Claude. Система затронет пользователей по всему миру, а не только в Европейском союзе. Способ нанесения метки будет различаться в зависимости от типа выходных данных: для текстовых материалов планируется использовать невидимые водяные знаки, а для поддерживаемых файлов — цифровую подпись с информацией о происхождении.
В текстовых ответах Claude будет встроен незаметный сигнал, который не влияет на читаемость и остается в материале даже при копировании и вставке. Разработчики рассчитывают, что часть этих меток сможет сохраниться и после редактирования. Такой подход позволяет охватить все продукты экосистемы Claude, включая API, интерфейс самого чата, инструменты Claude Code и Cowork, а также решение Claude Tag. Корпоративные клиенты, работающие с моделью через основные облачные платформы — AWS, Google Cloud и Microsoft Foundry, — также будут получать маркированные выходные данные.
В Anthropic считают, что это даст сторонним платформам и организациям дополнительный технический способ проверки того, был ли обработан тот или иной фрагмент текста именно их моделью. В будущем компания обещает опубликовать технические детали и инструменты для обнаружения этих водяных знаков, что позволит пользователям и проверяющим сторонам самостоятельно подтверждать наличие маркировки.
Для файлов, включая популярные графические форматы, будет применяться отдельный механизм. В метаданные сгенерированных изображений или документов будет встраиваться цифровая подпись в соответствии со стандартом C2PA (Coalition for Content Provenance and Authenticity). Эта технология позволяет создать единую запись о происхождении контента: действующая подпись подтверждает, что файл был обработан Claude, и показывает, не были ли изменены данные о его авторстве.
В Anthropic предостерегают от восприятия любого из этих сигналов как окончательного доказательства авторства. Claude может обрабатывать материалы, изначально созданные человеком. Кто-то может использовать модель для перевода, сокращения или редактирования существующего текста. В результате итоговый материал всё равно может нести маркировку Claude.
Справедливо и обратное утверждение: отсутствие маркировки не означает, что контент создан человеком. Интенсивное редактирование способно ослабить текстовый водяной знак. Короткие фрагменты также могут оказаться недостаточными для надёжного обнаружения.
Контент, созданный старыми версиями Claude, не будет содержать новой маркировки. Anthropic планирует выпускать дополнительные технические материалы по мере развития и доработки своих систем маркировки и детектирования.
Читайте также: Вредоносные SIM-карты угрожают смартфонам, зарядкам для электромобилей и IoT-устройствам