Компания Anthropic начала внедрять невидимые цифровые водяные знаки в тексты, генерируемые новыми моделями Claude, чтобы соответствовать требованиям прозрачности ЕС. Об этом сообщает Interesting Engineering.
Теперь все новые версии языковой модели будут автоматически маркировать создаваемый контент на уровне самого алгоритма. Это сделано во исполнение ст. 50 Европейского закона об искусственном интеллекте. Anthropic также присоединилась к добровольному кодексу практики ЕС в отношении контента, созданного ИИ.
Система будет использовать разные подходы: для текстов — невидимые водяные знаки, для файлов поддержанных форматов (включая изображения) — подписанные метаданные о происхождении по стандарту C2PA. Маркировка будет применяться глобально ко всем пользователям, а не только к европейским.
«Мы планируем встроить едва заметный сигнал прямо в текст, созданный Claude. Пользователи не увидят метку при обычном чтении. Водяной знак останется частью текста при копировании и вставке ответов и, как мы ожидаем, сможет пережить редактирование», — пояснили в компании.
Маркировка на уровне модели охватывает все продукты Anthropic: API, Claude, Claude Code, Claude Cowork и Claude Tag. Облачные клиенты через AWS, Google Cloud и Microsoft Foundry также будут получать размеченные выходные данные.
В Anthropic обещают опубликовать технические детали для обнаружения водяных знаков. Это поможет пользователям и третьим сторонам проверять контент.
Файлы могут терять метаданные при конвертации, создании скриншотов или пересохранении. Старые модели Claude пока не имеют встроенной маркировки, но компания работает над их обновлением в переходный период, установленный законом ЕС.
Ранее в МГУ назвали гуманитарные профессии, которые не заменит ИИ.