Услуги Портфолио Контакты БлогНовости +7 (800) 511‑32‑27 Обсудить проект
Комплаенс

OpenAI начнёт маркировать тексты ChatGPT и Codex в ЕС невидимым водяным знаком textGrain

10 октября 2026·5 мин чтения
textGrainEU AI Act
Волны светящихся символов на тёмном фоне со скрытой геометрической сеткой — невидимый водяной знак в сгенерированном тексте

5 октября 2026 года OpenAI объявила textGrain — невидимый водяной знак для текста, который генерируют ChatGPT и Codex. В ближайшие недели он станет обязательным для пользователей в Евросоюзе на всех тарифах, а в API по всему миру его можно включить добровольно. Так компания закрывает требование EU AI Act о машиночитаемой маркировке ИИ-контента.

Для команд, которые встраивают генерацию текста в свои продукты, это первый крупный прецедент: маркировку теперь делает сам поставщик модели. Мы уже разбирали, что требует статья 50 EU AI Act от чат-ботов и генеративных сервисов. Если вы строите ИИ-функции в продуктах для европейского рынка, стоит заново проверить, кто и чем у вас помечает сгенерированный контент.

Ниже — как устроен textGrain, где он перестаёт работать и почему отсутствие метки ничего не доказывает. Оценить «машинность» конкретного текста без доступа к детектору OpenAI можно нашим детектором AI-текста, но это вероятностная оценка, а не проверка водяного знака.

Что именно запускает OpenAI

textGrain встраивает статистический сигнал в выбор слов: модель немного смещает вероятности токенов по секретному ключу. Человек разницы не видит, а детектор, знающий ключ, проверяет, есть ли в отрывке такой узор. По словам OpenAI, метка сохраняется при копировании и вставке, не идентифицирует пользователя и заметно не влияет на качество ответов.

  • ЕС: обязательная маркировка подходящих текстовых ответов ChatGPT и Codex на всех тарифах, развёртывание — в течение ближайших недель.
  • API: с 5 октября функцию можно включить для части моделей по всему миру, по умолчанию она выключена.
  • Детектор: публичным не будет — доступ получат одобренные исследователи и экспертные организации.
  • Обоснование: технический отчёт OpenAI, написанный вместе с исследователями из Пенсильванского и Йельского университетов; по данным компании, результаты не хуже Google SynthID.

Насколько надёжна метка textGrain

Цифры из отчёта OpenAI показывают, что водяной знак работает на длинных и нетронутых текстах. При доле ложных срабатываний 1% детектор находит около 80% размеченных отрывков длиной 200 токенов и около 95% — длиной 400 токенов (замер на текстах по психологии). На математических ответах результат заметно хуже.

Правка текста быстро стирает сигнал. Если заменить синонимами примерно 10% слов, доля обнаружения падает примерно с 92% до 66%, а при замене 25% слов — до 17%. Слабее метка и на коротких фрагментах, и на переведённом тексте. Сама OpenAI подчёркивает: водяной знак показывает, что система компании сгенерировала или обработала часть отрывка, но не говорит, сколько в нём человеческой работы. А отсутствие метки не доказывает, что текст написал человек.

Почему это происходит сейчас

Требования прозрачности статьи 50 EU AI Act действуют с 2 августа 2026 года. Для уже выведенных на рынок генеративных систем машиночитаемую маркировку разрешили внедрить с переходным периодом до 2 декабря 2026 года. Изображения и аудио OpenAI уже помечала средствами проверки происхождения; textGrain переносит этот подход на текст — самый массовый и самый трудный для маркировки тип контента.

Что это значит для команд разработки и контента

Продуктовым командам с пользователями в ЕС. Если ваш сервис генерирует текст через API OpenAI, решите явно, включать ли textGrain: по умолчанию он выключен. Метка поставщика не заменяет ваших обязанностей по уведомлению пользователей о том, что они общаются с ИИ, — это отдельное требование. Зафиксируйте решение в реестре ИИ-систем и в документации продукта.

Мультимодельным системам. Если текст проходит через несколько моделей (генерация, перефразирование, перевод), метка может ослабнуть или исчезнуть на следующих шагах. Маркировка на уровне одного вендора не даёт сквозной картины: нужна собственная фиксация происхождения в метаданных и логах.

Редакциям, HR и преподавателям. textGrain не станет общедоступной «проверкой на ChatGPT»: детектор закрыт, а редактура ломает сигнал. Решения о «машинном» авторстве по-прежнему нельзя принимать на основании одного автоматического инструмента.

Что сделать до 2 декабря 2026 года

1. Составьте список всех мест в продукте, где пользователь получает сгенерированный текст, изображения или аудио, и укажите, какая модель за ними стоит.

2. Для вызовов OpenAI API примите решение по textGrain и закрепите его в конфигурации, а не в коде отдельных сервисов.

3. Проверьте, что в интерфейсе есть явное уведомление о работе с ИИ там, где этого требует статья 50.

4. Храните в логах признак «сгенерировано моделью X» для выдаваемого контента — он пригодится и при запросе регулятора, и при разборе жалоб.

Часто задаваемые вопросы

Будет ли водяной знак в ChatGPT у пользователей из России? Обязательная маркировка объявлена только для ЕС. В API за пределами ЕС она включается добровольно и по умолчанию выключена.

Можно ли самому проверить текст на метку textGrain? Пока нет: доступ к детектору получат только одобренные исследователи и экспертные организации.

Ухудшает ли водяной знак ответы модели? По данным OpenAI, заметного изменения качества нет. Независимых измерений на момент публикации нет.

Если метки нет, значит, текст написал человек? Нет. Сигнал слабеет после редактуры, перевода и на коротких фрагментах, поэтому отсутствие метки авторство не доказывает.

Источники

OpenAI — EU text provenance, 5 октября 2026 года (первоисточник).

TechCrunch — OpenAI will start watermarking ChatGPT’s text in the EU, 5 октября 2026 года.

ITdaily — OpenAI introduces text watermarking for EU to comply with AI Act, 6 октября 2026 года.

Коммерсантъ — OpenAI внедрит невидимый водяной знак textGrain в ChatGPT и Codex, октябрь 2026 года.

Материал подготовлен редакцией YuSMP Group по открытым источникам. Нужна экспертиза по теме или разработка под задачу — обсудим проект.

Подготовим ИИ-функции продукта к требованиям AI Act

Проведём инвентаризацию генеративных функций, настроим маркировку и уведомления пользователей, добавим журнал происхождения контента. Ваш продукт встретит 2 декабря 2026 года без срочных переделок.

Обсудить ИИ-разработку