Тексты ChatGPT получат скрытые водяные знаки: как работает технология textGrain и кого это коснется

OpenAI начала внедрение скрытой маркировки текста, генерируемого ChatGPT и средой разработки Codex на территории Европейского союза. Разработанная компанией технология textGrain встраивает в ответы нейросети специальный статистический след, который позволяет алгоритмам распознавать присутствие машинного контента. Нововведение стало прямым следствием вступления в силу европейского закона об искусственном интеллекте (EU AI Act).
В отличие от ранних примитивных методов водяных знаков, textGrain не использует скрытые символы, невидимые пробелы или технические метаданные, которые легко стереть обычным блокнотом. Как объясняет OpenAI в своем блоге, система вмешивается непосредственно в процесс генерации, едва заметно сдвигая вероятности выбора конкретных слов и токенов.
В результате в достаточно длинном фрагменте текста формируется скрытый математический узор. Для человеческого глаза фразы выглядят абсолютно естественно и грамотно, однако специализированный детектор способен с высокой точностью подтвердить, что формулировки сгенерированы моделями OpenAI.
Уязвимость к пересказу и закрытый детектор
Несмотря на технологичность решения, создатели прямо предупреждают о его ограничениях. В справочном центре компании подчеркивается, что водяной знак не является строгим юридическим доказательством причастности ИИ, а лишь указывает на высокую вероятность его использования.
Устойчивость метки к редактированию имеет предел:
- глубокий ручной рерайт или автоматический перевод на другой язык способны сильно размыть или полностью разрушить статистический след;
- короткие реплики, программный код и формульные научные тексты практически невозможно надежно пометить без падения качества самого ответа;
- детектор textGrain не станет общедоступным сервисом: на первом этапе доступ к нему получат только аккредитованные академические исследователи и экспертные организации, чтобы снизить число ложных обвинений и не дать спамерам возможность быстро тестировать методы обхода.
Закон для Европы и свобода для разработчиков
Срочность интеграции связана с жесткими европейскими нормами. В официальных разъяснениях Еврокомиссии указано, что согласно 50-й статье закона AI Act все создатели генеративных моделей обязаны снабжать синтетический контент машиночитаемой маркировкой. Эти правила вступили в силу еще 2 августа 2026 года, но разработчикам предоставили переходный период до начала декабря.
При этом глобальных пользователей принудительная маркировка пока не затронет: в потребительских версиях ChatGPT и Codex система активируется только для жителей стран ЕС. Для разработчиков, использующих OpenAI API по всему миру, textGrain станет доступен как отдельная опция с 5 октября, но по умолчанию будет отключен. В дальнейшем компания планирует выложить код технологии в открытый доступ, чтобы задать общий отраслевой стандарт.