Anthropic внедряет систему водяных знаков для текстов, созданных Claude
Компания Anthropic объявила о разработке технологии, позволяющей добавлять незаметные водяные знаки в тексты, сгенерированные ИИ Claude. Это поможет определить, участвовал ли ИИ в создании текста, не влияя на его качество.
Anthropic сообщила о внедрении технологии незаметного водяного знака в будущие модели Claude, которая будет добавлять такие метки в генерируемые тексты. Эти водяные знаки сохранятся даже при копировании и редактировании, а их основная задача - помочь определить вероятность участия ИИ в создании текста.
По информации компании, внедрение этой технологии не окажет негативного влияния на качество ответов, и визуально такие тексты не будут отличаться от стандартных. При этом водяные знаки не требуют дополнительных токенов, что исключает увеличение стоимости использования Claude.
Водяные знаки реализуются через изменение малозначительных решений в выборе слов, что позволяет создавать статистически проверяемые паттерны. Эти паттерны невозможно визуально обнаружить, но специальный инструмент сможет оценить вероятность генерации текста с помощью Claude.
Эффективность технологии зависит от длины текста: на длинных фрагментах водяной знак обнаруживается легче, в то время как в коротких текстах такие возможности уменьшаются. Если Claude редактирует текст, написанный человеком, метка может практически исчезнуть. В программном коде водяные знаки также менее эффективны из-за строгих требований к синтаксису.
Важно отметить, что водяные знаки не содержат идентифицирующей информации, что исключает возможность определения конкретного пользователя или организации. Они предназначены для оценки вероятности участия ИИ в создании текста сторонними инструментами.
По материалам: 3dnews.ru