i
ДАТАИСТ
Новости · 2026-08-30

Как работает текстовый водяной знак Claude

@neuronium_ai @neuronium_ai

Anthropic внедряет в будущие версии Claude текстовый водяной знак — скрытый шаблон, по которому можно оценить вероятность участия модели в создании текста. Механика меняет источник случайности при выборе слов, но не добавляет новых токенов и не должна влиять на качество, скорость или стоимость работы модели. Проверка требует специального ключа, не раскрывает данные пользователя и плохо работает на коротких фрагментах, точных фактах, коде и лёгкой редактуре. Решение связано с требованиями закона ЕС об ИИ: Anthropic и ещё около 190 организаций подписали соответствующий кодекс в июле 2026 года.

Обложка: Как работает текстовый водяной знак Claude

Как устроен водяной знак

Большие языковые модели вроде Claude создают текст последовательно, выбирая по одному слову. Для каждого следующего слова модель оценивает список возможных вариантов и выбирает наиболее подходящий с учётом уже написанного.

Например, после фразы «Сегодня погода была холодной и…» слово «сладкой» почти наверняка не появится. Зато подойдут «пасмурной» или «серой». Для смысла обычно неважно, какой из этих вариантов будет выбран, поэтому решение принимается с помощью случайного числа.

Водяной знак использует множество таких малозначимых выборов, разбросанных по тексту, чтобы сформировать в ответе Claude определённый шаблон. Читатель его не заметит, но человек или система со специальным ключом сможет проверить, насколько последовательность слов соответствует решениям, которые Claude принимал бы с этим ключом.

При водяном знаке слова по-прежнему выбираются случайно, но источник случайности меняется. Вместо произвольного генератора используются ключ и несколько предыдущих слов. Затем по всей последовательности можно рассчитать вероятность того, что текст был создан Claude.

Это не означает, что модель начнёт постоянно предпочитать, например, слово «пасмурный» слову «серый». Как и в обычном тексте, в одном предложении она может выбрать первый вариант, а в следующем — второй, в зависимости от контекста. Водяной знак также не заставляет Claude использовать слово, которое модель изначально не рассматривала. Например, он не подтолкнёт её к редкому слову nubilous — малоупотребительному синониму слов «пасмурный» и «серый».

Влияние на ответы Claude

Водяной знак не меняет качество текста. Для читателя ответ с ним неотличим от ответа без него. В этом его механизм принципиально отличается от водяных знаков на банкнотах, физических предметах и некоторых цифровых документах: их можно увидеть глазами.

Во внутренних испытаниях Anthropic не обнаружила влияния на содержание, творческий уровень и читаемость ответов Claude. В работе SynthID-Text, где описан используемый подход, Google DeepMind включила модель с водяным знаком в часть потока запросов Gemini и сравнила оценки пользователей «нравится» и «не нравится». Статистически значимых отличий от модели без водяного знака не нашли.

В контролируемом исследовании люди также сравнивали ответы с водяным знаком и без него рядом и не заметили разницы в качестве.

Механику можно сравнить с партией в «Монополию». Обычно игроки бросают кубик и случайным образом перемещаются по полю. Представим, что вместо кубика используется последовательность цифр числа π. Игра начинается со случайно выбранной позиции — например, с цифры, стоящей на 1 012 845-м месте после запятой; в этом месте находится цифра 6. Дальше каждый ход определяется следующей цифрой последовательности.

Для игроков и результата партии ходы всё равно выглядят случайными. Но если после игры изучить всю последовательность перемещений и знать значение π, можно проверить, насколько вероятно, что ходы определялись именно этим числом. В таком смысле партия оказывается «помеченной».

С текстом Claude происходит то же самое: водяной знак не меняет смысл и восприятие ответа, но позволяет задним числом проверить вероятность участия модели.

Текстовый водяной знак Claude основан на подходе SynthID-Text, который Google DeepMind описала в статье в журнале Nature в 2024 году. Этот подход относится к семейству методов, восходящих к предложению Скотта Ааронсона 2022 года. Их общий принцип заключается в том, что меняется только источник случайности при выборе между словами.

Ограничения проверки

С помощью ключа можно ответить только на вопрос: насколько вероятно, что Claude частично участвовал в написании текста. Водяной знак не подтверждает, что текст написал человек, и не показывает, создала ли его другая система ИИ. У другой модели будет другой ключ, а сам метод водяной маркировки может отличаться.

На коротких фрагментах проверка работает хуже: там меньше выборов слов и, соответственно, меньше данных для анализа. Чем длиннее текст, тем выше уверенность в оценке участия Claude.

На фактических отрывках водяной знак встречается реже, поскольку там меньше вариантов, которые можно менять без потери точности. В предложении «Самая известная работа Исаака Ньютона называлась Principia…» следующим словом должно быть «Mathematica» — это единственный правильный вариант. В таком месте водяному знаку не на что воздействовать.

То же касается корректуры. Если попросить Claude исправить только грамматику и пунктуацию, водяной знак сможет проявиться лишь в небольшом числе исправлений, и этого может оказаться недостаточно для обнаружения.

Водяной знак относится только к словам, выбранным Claude. При корректуре человеческого текста почти все слова сохраняются, поэтому маркировать там практически нечего. В зависимости от длины материала и масштаба правок изменений может быть недостаточно, чтобы определить участие Claude. Чем больше модель пишет самостоятельно, тем больше решений принимает и тем больше возможностей для водяного знака.

Точные ответы и код

Водяная маркировка использует ситуации, когда разные варианты слова одинаково хорошо подходят. Если требуется точный результат и другой вариант был бы фактически неверным или сломал бы код, водяной знак не применяется.

После фразы «2 + 2 =» у модели есть очевидный следующий токен — «4». Если речь идёт о романе Джорджа Оруэлла «1984», правильным продолжением будет «5». Другого варианта с такой же ценностью здесь нет, поэтому «подталкивание» водяного знака не используется.

По этой же причине в коде обычно меньше водяной маркировки, чем в других типах текста: программный код во многих случаях должен быть точным. Однако если внутри кода есть произвольный выбор между словами или терминами, водяной знак может применяться, например в комментариях. На сам исполняемый код это по определению оказывает пренебрежимо малое влияние.

Скорость, пользователи и закон

Нет, водяной знак почти не влияет на скорость работы моделей. Он не создаёт дополнительных токенов, поэтому стоимость обслуживания и использования Claude не меняется.

Он также не идентифицирует отдельных пользователей. В самом водяном знаке и ключе нет данных, которые позволили бы восстановить сведения о пользователе, его организации или переписке с Claude.

Anthropic внедряет водяную маркировку, чтобы выполнить требования закона ЕС об ИИ. В июле 2026 года компания вместе с другими крупными разработчиками моделей и примерно 190 организациями подписала Кодекс практики ЕС по прозрачности содержимого, созданного ИИ. Он требует от поставщиков систем ИИ использовать методы маркировки текста, созданного ИИ.

На старте водяной знак будет применяться по всему миру, поскольку Anthropic пока не располагает надёжным способом ограничить его использование отдельными регионами. Компания продолжит оценивать разные подходы и сообщит об изменениях.

Вскоре Anthropic планирует запустить API для обнаружения водяных знаков. Детали его реализации пока разрабатываются.

Файлы и метаданные

Когда Claude создаёт файл поддерживаемого типа — например, .png, .jpg или .svg, — в его метаданные будет добавляться запись о происхождении содержимого. Это небольшая криптографически подписанная запись о том, что файл был создан или обработан с помощью Claude.

Механизм основан на открытом отраслевом стандарте C2PA, который используют производители камер и программы для редактирования фотографий, чтобы фиксировать происхождение изображений. Прочитать такую запись сможет любой инструмент с поддержкой C2PA; Anthropic также предоставит собственную службу, куда можно загрузить файл для проверки.

Такая метка в метаданных отличается от водяного знака: содержимое файла не меняется, а запись не встраивается скрытым образом. Как и в случае с текстом, она лишь указывает на участие Claude и не содержит идентифицирующих данных.

Можно ли убрать водяной знак

Частичная редактура, вероятно, не удалит водяной знак полностью. Полная перепись текста, при которой заменяется каждое слово, его уберёт. В таком случае, отмечает Anthropic, уже можно спорить, остаётся ли текст созданным ИИ.

Водяной знак показывает только вероятность того, что Claude участвовал в работе с содержимым. Он не различает ситуации «Claude написал текст» и «Claude существенно его отредактировал».

Перевод, выполненный Claude, водяной знак получает, поскольку в таком случае каждое слово выбирает модель.

Для моделей Anthropic, выпущенных до 2 августа 2026 года, законодательство ЕС предусматривает переходный период. Компания также готовит водяную маркировку для этих моделей и планирует внедрить её в течение ближайших месяцев.

Чем водяной знак отличается от средств обнаружения текста ИИ

Программы для обнаружения текста, созданного ИИ, используют другой метод: у их разработчиков нет ключа Anthropic. Такие службы, среди прочего, ищут характерные особенности формулировок — явные и скрытые признаки, которые часто встречаются в текстах моделей.

Например, модели ИИ могут часто использовать конструкцию «это не [X], а [Y]» и слово «тихо» заметно чаще, чем ожидается. Поиск подобных закономерностей принципиально отличается от проверки текста на наличие водяного знака.

Авторство и права

Водяной знак помогает проверить лишь возможное участие Claude в создании или обработке содержимого. Он ничего не говорит о праве собственности или авторстве и не меняет права пользователя, закреплённые в условиях Anthropic.

Маркировка применяется только в тех случаях, когда Claude участвовал в обработке содержимого или файла.

Другие объявления Anthropic

Anthropic открывает исследовательскую предварительную версию Model Hardware Standard (MHS) — общей спецификации, которая должна позволить ИИ-агентам безопасно работать с физическими устройствами. На первом этапе доступ получат научно-исследовательские лаборатории и передовые производители.

С сегодняшнего дня 10 000 учёных по всему миру смогут бесплатно начать пользоваться Claude. Подтверждённые руководители исследований получат план Claude Team, после чего смогут бесплатно добавить свою исследовательскую команду на стандартные места. Премиальные места будут стоить $15 в месяц, сроком до одного года.

Anthropic также запускает грантовую программу на $5 млн для независимых исследований влияния ИИ на благополучие пользователей.

10 000учёных получат Claude бесплатно
$15стоимость премиального места в месяц
$5 млнгрантовая программа
Переосмыслить независимость: как ИИ Meta меняет роботов Университета Питтсбурга AgentHands: интерактивные жесты рук в пространственно привязанных диалогах ИИ-агентов в XR Роботов-доставщиков убрали с улиц Шеффилда после окончания испытаний Постобучение NVIDIA Cosmos 3 Edge для управления роботами на устройстве Разработчики ИИ для роботов выходят из эпохи GPT-2 Nvidia намерена купить Hugging Face, чтобы формировать уровень распространения моделей Великобритания рискует отстать в гонке ИИ без ускорения модернизации сетей, предупреждают руководители компаний Как запустить чат-бота на собственном компьютере Sony и Warner судятся с Anthropic из-за «одной из крупнейших и самых вопиющих краж ИС» Учёный представлял новую работу с вайб-кодингом, пока коллега не заметил промах Meta представила мультимодальную модель Muse Spark 1.1 Предварительный обзор стандарта оборудования для моделей Пиццерии: почему роботы-пиццайоло не справляются Как обучить навигационную политику для роботов разных типов с ИИ-агентами Бывшие исследователи Meta хотят внедрить визуальный ИИ на производстве «Мы не делаем 30 ставок в год»: Виджай Панде о новом фонде Отчёт Nvidia подтвердил высокий спрос на ИИ — но раскрыл, где накапливаются риски Исследование выявило резкий рост случаев выхода ИИ из-под контроля пользователей Anthropic меняет лимиты Claude Code: на бумаге повышение, на деле сокращение Расшифровки, где модели OpenAI сообща замышляют настоящее преступление, довольно жуткие

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ, роботах и метавселенных и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram