Anthropic, OpenAI и Google будут помечать создаваемые тексты невидимыми ИИ-вотермарками
Статья 50 европейского AI Act вступила в силу. Провайдеров обязали помечать ИИ-генерации — но самому проверить эти метки пока нельзя.
10 августа Anthropic обновила справочную статью о том, как Claude помечает сгенерированный контент. В текст теперь будут вплетать незаметные водяные знаки — это происходит на уровне модели, поэтому он переживает копипаст, правки и не зависит от того, откуда текст пришёл: чат, API, Claude Code, Cowork, неважно. К сгенерированным файлам и изображениям (например, .png, .jpg, .svg) прикручиваются метаданные по стандарту C2PA.
Это будут делать «все модели Claude, запущенные 2 августа 2026 года и позже» — текущие модели пока нет, для них обозначен некий «переходный период» без конкретных сроков. Очевидно, тайминг говорит, что это сделано для соответствия европейскому AI Act, но вотермарк будет добавляться везде, где Claude доступен, а не только в ЕС.
Кого и к чему обязали
Статья 50 AI Act — та часть закона 2024 года, которая применяется со 2 августа 2026. Она требует от провайдеров генеративного ИИ, чтобы выдача была помечена машиночитаемо и достоверно определялась как синтетическая, а от тех, кто её публикует, — раскрывать дипфейки и сгенерированные тексты на общественно значимые темы.
Под это Еврокомиссия выкатила кодекс практик из двух секций: первая для провайдеров, вторая для деплойеров. Подписание кодекса добровольное, а обязательства исполнять — принудительные: за несоблюдение статьи 50 грозит штраф до €15 млн или 3% от глобального оборота.
К концу июля подписались около 190 организаций. В секции провайдеров — Google, Microsoft, OpenAI, Anthropic, Mistral и Meta (признана в России экстремистской организацией и запрещена). В секции деплойеров — Getty Images, Lufthansa, Bulgari, Lenovo, Iberdrola и десяток греческих новостных сайтов. Ни Google, ни Microsoft, ни Meta там нет.
То есть под обязательства помечать ИИ-контент гиганты вписались, а показывать плашку у себя на площадках — пока нет.
Естественно, китайских или российских компаний ни в одном из списков нет. Впрочем, как и Apple, Amazon и SpaceX.
Настоящего детектора ИИ-текста нет ни у кого
Anthropic обещает «в будущей документации» рассказать, как проверять свои метки ИИ-контента, но пока детектора от Claude нет. OpenAI запустила публичный верификатор с API — он ловит только картинки и аудио, текст ChatGPT пока не метит, но обещает начать это делать.
Google метит текст Gemini через SynthID с 2024 года, сама технология выложена в опенсорс, а детектор раздают лишь избранным медиа и исследователям.
Сторонние детекторы вроде GPTZero работают недостоверно: они ищут в тексте тропы — длинные тире, частотные обороты, ритм — и на этом гадают. Я скопипастил в один такой свежую генерацию Gemini — получил «создано человеком, уверенность 68%».
Ты, читатель, метку не прочитаешь
Парадокс: ИИ-текст можно не помечать, если он прошёл человеческую редактуру и кто-то несёт за него ответственность. Логика такая: если юрист подписал заключение, он за него отвечает — неважно, чем он его создавал.
ИИ-слоп — не причина этих регуляций ЕЕ: скорее маркировку вводят для проверки, кто за текст отвечает. Google — пионер этой движухи, потому что у него бизнес построен на поиске: ему нужно отличать сигнал от шума. Тысяча постов на Reddit от живых людей — сигнал, что тема кого-то волнует, а тысяча сгенерированных постов — просто шум.
Для ИИ-контента в X уже ввели автоматическую пометку «Made with AI». В LinkedIn, где раньше вообще была кнопка генерации ИИ-постов, теперь наоборот есть кнопка «Выглядит как ИИ-слоп». Подробнее про это можно почитать в недавней статье Виталия Вебера.
Однако, определить вотермарки в тексте на глаз нельзя. В видео Google про SynthID подробно показано, как именно это работает: маркировка зашифровывается и считывается по принципу наличия определённых слов, а не каких-то специальных или невидимых символов. Поэтому так просто генерации из текста не удалишь.
P. S. Этот последний абзац текста я на всякий случай пометил более заметно.
Такие посты чаще выходят у меня в Telegram‑канале, где в основном пишу про AI и его применение.