Еще про
водяные знаки в ИИ-текстах Claude от Натзира Туррадо.
Водяной знак в тексте, сгенерированном ИИ, — это невидимое статистическое смещение, которое изменяет слова, выбираемые моделью при создании контента, без добавления скрытых символов или метаданных. Этот статистический маркер позволяет инструменту или API определить, что текст был сгенерирован ИИ.
Водяной знак Claude — это вариант SynthID-Text (который Google использует в приложении Gemini с 2024 года).
Без API или ключа ни один инструмент не сможет заявить о возможности «стереть» знаки Claude, потому что он не сможет их измерить. Ни Google, ни Originality, ни GPTZero не могут этого сделать.
Anthropic признает ограничения, хорошо известные в этой области:
- водяные знаки плохо работают с короткими текстами
- менее эффективны для текстов, насыщенных фактами
- в коде, как правило, меньше водяных знаков
- в тексте, исправленном человеком с помощью Claude, водяных знаков почти нет
- полная переработка, при которой заменяется каждое слово, удаляет водяные знаки
- переводы, выполненные Claude, содержат водяные знаки.
На практике надежность водяных знаков сводится к тому, насколько дорого обойдется их удаление. Перефразирование с помощью другой модели работает довольно эффективно.