ИИ начал ставить невидимые метки на тексты

Claude первым публично включил водяные знаки для сгенерированных текстов. Вотермарк прячется в выборе слов.

ИИ начал ставить невидимые метки на тексты

У модели есть несколько нормальных вариантов продолжить фразу. Водяной знак незаметно подталкивает её выбирать определённые варианты.

На одном абзаце надежно определить генеративность — сложно. На длинном тексте специальный детектор распознает статистический паттерн.

Такой подход позволяет сохранять метки при копировании. Но похоже больше на защиту от «дурака». Достаточно отредактировать текст вручную или опенсорсной моделью — и метка будет потерта.

Хотя сам подход, вероятно, избавит нас по крайней мере на какое-то время от нейрослопных книг. Будем следить за гонкой моделей