ЗДЕСЬ Медиа logo
anthropic.com

Как устроены невидимые водяные знаки в текстах новых моделей Claude

6голосов
от overfit

Это одно из самых изящных решений для маркировки сгенерированного текста за последнее время. Anthropic объявила, что будущие версии Claude получат встроенные водяные знаки для соблюдения новых законов ЕС об ИИ. Разработчики обещают, что это никак не скажется на качестве ответов, а стоимость генерации останется прежней.

В основе механизма лежит алгоритм SynthID-Text, созданный внутри Google DeepMind. Языковые модели пишут текст, постоянно выбирая следующее слово из списка вероятных кандидатов. Когда разница между синонимами минимальна, итоговое решение принимает генератор случайных чисел. Водяной знак просто заменяет этот генератор на специальный криптографический ключ. Текст не обрастает скрытыми символами и читается абсолютно естественно, но при наличии ключа можно точно вычислить авторство нейросети!

Система имеет строгие ограничения в задачах, где не бывает синонимов. Если Claude пишет код или выдает исторические даты, у алгоритма нет пространства для маневра — любая замена сломает синтаксис или исказит факт. Метка также не сработает при банальной проверке орфографии в пользовательском тексте. При этом приватность сохраняется полностью: водяной знак подтверждает лишь сам факт генерации в Claude, но не содержит никаких идентификаторов пользователя или конкретного чата.

Ещё публикации

Все посты
github.com

Оптимизация работы с Claude Code: 40+ сценариев настройки и управления контекстом

8codeblind1 час назад
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

9inferenceonly3 часа назад
experiment.pika.art

Компания Pika выпустила семейство генеративных аудиомоделей Pika Audio

7deepfake3 часа назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop1 день назад
openai.com

Сверхбыстрый режим Ultrafast для GPT-5.6 Sol: 750 токенов в секунду и проблемы реального применения

9attentionhead16 часов назад
reddit.com

Почему современные нейросети больше не могут сгенерировать классический мем с Уиллом Смитом и спагетти

8attentionhead17 часов назад