Что за ИИ-маркеры
Начиная со 2 августа 2026 года новые модели Claude начали вшивать в свои ответы скрытые метки — водяные знаки. Пока речь только о Fable 5.1 и Mythos 5.1, которые релизнулись 1 сентября, но в итоге это затронет все версии, которые будут выходить с этого срока. Также Anthropic планирует внедрить маркировку во все ранее вышедшие модели — например, Sonnet 5, Opus 5 и Haiku 4.5. Устаревшие и неиспользуемые версии трогать не будут, но всё, что ещё в ходу, получит апдейт в ближайшие месяцы.
Сама маркировка не буквальная: искать скрытые знаки в тексте или полупрозрачные логотипы на картинках бесполезно. Это не та история, когда ChatGPT по ошибке начал добавлять в ответы непечатаемые символы, по которым можно было распознать генерацию и которые было легко вычистить при желании.
Anthropic использует две независимые механики — для текстов и изображений.
Как маркируется текст
Anthropic использует модификацию открытого инструмента SynthID Text от Google DeepMind для невидимой маркировки. Он внедряется на уровне модели и влияет на то, какие слова та выбирает при ответе.
Тут всё дело в том, как именно генеративный ИИ пишет текст: методично, слово за словом, выбирая каждое следующее из наиболее вероятных кандидатов. И в моментах, когда модель может выбрать одно из нескольких слов без вреда для общего смысла (например, «масштабный», «крупный» или «значительный»), без маркировки она просто возьмёт один рандомный вариант из доступных. А при маркировке с SynthID Text — не совсем. В каждом случае, где это возможно, выбирается слово с тем уровнем вероятности, к которому подталкивает последовательность в ключе.
Это сработает везде, где нет критического перевеса одного из вариантов. Например, после «2 + 2 =» обязательно будет «4» (или «5», если речь конкретно о романе Оруэлла), даже если ключ требует использовать другое число. На вероятности модель опирается только в случаях, когда выбор именно равнозначный.
Для пользователя никакого подвоха заметно не будет: он будет читать обычный текст с логично подобранными словами. А вот тот, у кого есть детектор с нужным ключом, сможет сопоставить, не слишком ли часто в предложениях выбирались слова подходящей вероятности. Нет ключа — нет способа отличить этот перекос от естественного.
Поскольку водяной знак вшит в сам выбор слов, такая маркировка не исчезнет при копировании и вставке текста, смене шрифта и прочих манипуляциях. Даже если загнать текст на картинку, а потом скопировать его оттуда, порядок слов не изменится и ключ продолжит выявлять генерацию.
Как маркируются картинки
Тут может возникнуть резонный вопрос: а какие вообще картинки в Claude? И хотя чат-бот действительно не предлагает генератор изображений в стандартном его понимании, на самом деле он создаёт изображения. Просто это не ваши полароиды с крашем или Хацунэ Мику в стиле работ студии Ghibli, а всевозможные графики и диаграммы, которые здорово дополняют отчёты и исследования. Причём делает это очень круто.
На самом изображении никаких отметок не появляется — вместо этого криптографическая отметка идёт в метаданные по стандарту C2PA. В руководящий комитет C2PA входят Adobe, Microsoft, Google (включая YouTube), BBC, OpenAI и производители камер — они и продвигают этот стандарт как способ маркировать сгенерированные данные. Такая метка показывает происхождение файла и позволяет узнать, редактировали ли его после генерации. В случае с Claude в метаданных будет значиться лишь то, что изображение сделано с помощью модели Anthropic — на конкретного пользователя, по промпту которого оно было создано, выйти будет нельзя.
Учитывая, что такая отметка живёт в расширенных данных о картинке, инструменты по очистке метаданных их сотрут — но более легитимной она не станет, потому что у неё не будет совсем никакой информации о происхождении. Если сделать скриншот, данные тоже не сохранятся.
Зачем нужна такая маркировка
Anthropic внедряет её не по своей воле, а чтобы избежать больших штрафов: 2 августа вступила в силу статья 50 Закона ЕС об ИИ (AI Act). Её второй пункт обязывает поставщиков ИИ-систем, генерирующих текст, изображения, видео и аудио, обеспечить маркировку такого контента как созданного с помощью ИИ или обработанного им.
Anthropic подписала кодекс практик по этой статье и включила маркировку не только для пользователей из ЕС, а во всех регионах, где доступен Claude, причём во всех форматах, включая чат-бота и все его режимы и API, и у облачных партнёров вроде AWS и Google Cloud.
По статье 50 маркировать контент обязаны все поставщики генеративного ИИ, работающие на рынке ЕС, а не только Anthropic. У Google в этом смысле всё давно схвачено: Gemini помечает текст через SynthID с мая 2024 года. OpenAI подписала тот же кодекс практик и обещает распространить маркировку на текст, но пока не сделала этого. По данным СМИ, у компании уже около года готов свой инструмент, но его придерживают — опасаются ложных срабатываний и негативной реакции пользователей. А вот изображения и аудио в ChatGPT уже маркируются с помощью C2PA и версии SynthID для картинок и голоса.
Время у компаний пока есть: для систем, которые были на рынке до 2 августа 2026 года, закон даёт отсрочку до 2 декабря как раз на добавление маркировки. Это касается не только старых версий Claude, а вообще любых моделей, представленных в Европе до вступления закона в силу.
Пока неизвестно, будут ли компании пытаться как-то разграничить европейских пользователей и всех остальных. Вполне вероятно, что они поступят как Anthropic и введут маркировку вообще для всех, чтобы случайно не выдать европейцу чистый текст и не нарваться на штраф.
Можно ли убрать ИИ-маркеры
Нюансов здесь, пожалуй, больше, чем практических рекомендаций.
Детекторы генерации Claude существуют, но не для всех
Проще всего дело обстоит с картинками. У Claude есть официальный онлайн-сервис для проверки файлов. Откройте сайт, загрузите изображение, и если обнаружится метка Claude, вам об этом сообщат. Аналогичные инструменты есть у OpenAI и Google — последний вообще позволяет подгрузить нужный файл в Gemini и спросить у чат-бота, есть ли следы ИИ в присланном изображении или видео.
А вот для текстов общедоступного проверщика пока не существует. Anthropic предлагает API-инструмент некоторым организациям и лицам, как того требует Евросоюз, — в том числе регуляторам, медиа, образовательным организациям и независимым исследователям. Позднее доступ планируют расширить, но пока можно разве что отправить официальный запрос — через Google-форму.
Здесь важно отметить, что ключи привязаны к конкретным моделям, поэтому даже официальный детектор от Claude может только сказать, был ли текст сгенерирован именно Claude, а не определить вероятность генерации как таковую. Соответственно, написанное ChatGPT пройдёт такую проверку без проблем. И когда OpenAI внедрит свою маркировку и выпустит открытый или закрытый инструмент для проверки, он будет работать тоже только на модели OpenAI.
Общедоступные проверщики текстов на ИИ вроде Pangram или ZeroGPT ищут в текстах базовые признаки генерации: типичные конструкции (вроде «это не про X, это про Y»), предсказуемость, недостаток разнообразия по форме и содержанию. Находить водяные знаки Claude они не в состоянии.
Не всё маркируется одинаково
Начнём с того, что не везде маркировка вообще актуальна: она зависит от того, сколько слов модели действительно требовалось выбирать самой.
Если вы просите Claude просто расставить запятые или проверить грамматику в готовом тексте, почти все слова в ответе — ваши, а не его. В таком случае детектор не определит работу ИИ: у модели попросту не было достаточного количества развилок, чтобы выбирать нужные слова с заданной частотой. То же самое касается и редактуры — например, когда вы просите добавить экспрессии в текст или немного подлить воды в эссе, чтобы оно соответствовало требованиям преподавателя. Модель при таком запросе оставит максимум пользовательских слов, которые вряд ли соответствуют паттерну, так что все её дополнения выдадут в худшем случае частичное соответствие ключу.
А вот перевод вполне себе считается генерацией, потому что нейросеть сама выбирает каждое следующее слово. Маркировка будет.
Ещё есть нюанс, который мы уже обсуждали на примере с «2 + 2 =»: там, где требуется точность, рекомендуемый паттерн будет игнорироваться ради правильного ответа. Поэтому сгенерированный Claude код распознать таким детектором не получится: слишком мало развилок, где можно следовать паттерну. Исключение — комментарии, которым такая точность не нужна, поэтому документация сможет распознаваться проверщиками с нужным ключом.
Чтобы избавиться от маркеров, нужно поработать руками — или другой нейросетью
С картинками всё просто: метаданные уберёт любой инструмент для их очистки, а если качество и разрешение не очень важны, можно обойтись просто скриншотом. Но файл всё равно будет подозрительным для любого, кто проверит информацию о нём: там не высветятся данные о камере, геолокации и так далее.
С текстом сложнее, потому что метка не в символах, а в выборе слов. Самый надёжный способ нарушить этот паттерн — переписать текст своими словами, меняя структуру и формулировки. Также можно запросить рерайт у другой нейросети, если она пока не маркирует свои ответы.
Последняя лазейка вряд ли продержится долго. Рано или поздно хороших моделей без SynthID или аналогов у крупных поставщиков может просто не остаться — придётся работать руками или запускать открытую модель локально на своём железе.
Что в итоге
Резюмируем всё, что будет важно большинству пользователей Claude.
- Невидимая маркировка появилась во всех текстах, которые пишут модели Fable 5.1 и Mythos 5.1. Другие актуальные версии пока не затронуты, но все новые релизы будут сразу с маркировкой.
- До 2 декабря маркировать начнут весь контент, созданный любыми моделями Claude. И не только. К ней присоединятся все модели, которые официально представлены в Европе.
- Маркируется любой текст, но код и лёгкая редактура — проверка запятых и орфографии, дописывание небольших фрагментов с сохранением созданной человеком основы — вряд ли распознаются как ИИ-сгенерированные. А вот примечания к коду и перевод распознаются.
- Полностью убрать маркировку из текста практически нельзя — разве что переписать его своими словами вручную или через нейросеть без маркировки. Копирование, смена шрифта и даже перепечатывание тех же слов руками метку не тронут.
- Проверить водяной знак в тексте самостоятельно нельзя: детектор Anthropic доступен только организациям с законными основаниями для этого. С картинками проще — есть бесплатный публичный чекер.
- Все созданные ботом картинки и графики маркируются на уровне метаданных. Скриншот или инструмент для их удаления эту отметку убирает.
Всё перечисленное уже сейчас актуально для Gemini, а скоро будет применимо и к ChatGPT.