Anthropic объявила, что будущие модели Claude будут создавать текст с невидимым статистическим водяным знаком. В нем нет скрытых символов, имени пользователя или номера чата. Проверка сможет оценить вероятность участия Claude, но не установит автора документа и не докажет, что весь текст написала нейросеть.
Что именно анонсировала Anthropic
Компания сообщила о водяных знаках 14 августа 2026 года. Формулировка относится к будущим моделям Claude. Для моделей, выпущенных до 2 августа, действует переходный период, а внедрение маркировки запланировано на следующие месяцы.
Это различие важно: нельзя утверждать, что любой ответ текущей версии Claude уже обязательно содержит обнаруживаемый знак. Anthropic пока не опубликовала полный календарь по моделям и не запустила общедоступный инструмент проверки.
Как можно пометить текст без скрытых символов
Языковая модель последовательно выбирает слова из нескольких подходящих вариантов. Во многих фразах два или три продолжения почти одинаково хорошо передают смысл. Водяной знак использует секретный ключ, чтобы слегка упорядочивать именно такие низкорисковые выборы. В большом фрагменте возникает статистический рисунок, который можно сопоставить с ключом.
Ничего не добавляется между буквами, в пробелы или в форматирование. Копирование текста в блокнот не должно само по себе удалить маркер. Для обычного читателя водяной знак незаметен, а по заявлению Anthropic внутренние тесты не показали ухудшения содержания, креативности или читаемости.
Что сможет показать проверка
Результат будет вероятностным: насколько последовательность слов совместима с работой Claude и его ключом. Чем длиннее текст, тем больше у системы точек для анализа. На короткой заметке, заголовке или одном абзаце уверенность будет ниже.
Даже положительный результат означает только возможное участие Claude на каком-то этапе. Он не различает два сценария: нейросеть написала материал с нуля или существенно отредактировала человеческий черновик. И наоборот, отсутствие обнаруженного маркера не доказывает человеческое происхождение: текст могла создать другая модель, старый Claude либо человек мог полностью его переписать.
| Проверка может | Проверка не может |
|---|---|
| Оценить вероятность участия совместимой модели Claude | Назвать конкретного пользователя, организацию или чат |
| Работать увереннее на длинном тексте | Надежно оценить очень короткий фрагмент |
| Сохранить сигнал после легкого редактирования | Гарантированно пережить полный пересказ другими словами |
| Показать возможную обработку текста Claude | Установить юридическое авторство или ответственность |
Почему факты, код и корректура маркируются слабее
Метод работает там, где у модели есть несколько равноценных слов. В точной формуле, имени, дате или программной команде такой свободы меньше: замена может сделать ответ неверным или сломать код. Поэтому фактические фрагменты и исходный код содержат меньше мест для статистического сигнала.
Та же логика действует при легкой корректуре человеческого текста. Если Claude исправил несколько запятых и опечаток, почти все слова выбрал автор, а не модель. Маркеру просто не на чем сформироваться. При полном переводе ситуация обратная: каждое слово выбирает модель, поэтому перевод может получить водяной знак.
Можно ли удалить водяной знак
Легкая правка, по оценке Anthropic, не обязана полностью уничтожить сигнал. Полная переработка, при которой заменено почти каждое слово, способна его убрать. Это фундаментальное ограничение статистического метода, а не программная ошибка.
Поэтому технология подходит для прозрачности платформы, но не для автоматического наказания людей. Университету, редакции или работодателю нельзя превращать один результат детектора в окончательный вердикт. Нужны исходники, история правок, проверка фактов и разговор с автором.
Когда появится детектор
Anthropic обещает API для проверки, но на момент анонса он еще не запущен. Компания прорабатывает детали реализации. Сторонние сервисы, которые уже сейчас называют себя «детекторами Claude», не имеют секретного ключа Anthropic и анализируют стиль другими методами. Их оценка не равна чтению официального водяного знака.
Зачем компания вводит маркировку по всему миру
Anthropic связывает решение с требованиями европейского регулирования и кодексом прозрачности ИИ-контента. На старте водяной знак планируется применять глобально, поскольку у компании пока нет надежного способа ограничить механизм только одним регионом.
Для файлов подход другой. Поддерживаемые изображения и другие форматы получат метаданные C2PA — криптографически подписанную запись о том, что Claude участвовал в создании или обработке файла. Это не встроенный в пиксели знак и тоже не содержит идентификатора пользователя.
Что это меняет для редакций
Главное правило остается прежним: маркировка происхождения не проверяет достоверность содержания. Текст с водяным знаком может быть точным, а человеческий текст — ошибочным. Редакции по-прежнему должны проверять факты по первичным источникам и указывать использование ИИ по собственной политике.
Похожую проблему разграничения мы разбирали на примере планов маркировки ИИ-музыки. О том, почему громкую цифру из кейса Claude и Samsung нельзя принимать без условий эксперимента, читайте в разборе проверки чипов.
Разборы ИИ без рекламных преувеличений — в Telegram-канале Digital Report.Скопировать HTML для WordPress
