Тексти ChatGPT отримають приховані водяні знаки: як працює технологія textGrain і кого це стосуватиметься

OpenAI почала впроваджувати приховане маркування текстів, які генерують ChatGPT і середовище розробки Codex, на території Європейського Союзу. Розроблена компанією технологія textGrain вбудовує у відповіді нейромережі спеціальний статистичний слід, завдяки якому алгоритми можуть розпізнавати присутність машинного контенту. Нововведення стало прямим наслідком набуття чинності європейського закону про штучний інтелект (EU AI Act).
На відміну від ранніх примітивних методів водяних знаків, textGrain не використовує приховані символи, невидимі пробіли чи технічні метадані, які легко стерти звичайним блокнотом. Як пояснює OpenAI у своєму блозі, система втручається безпосередньо в процес генерації, ледь помітно зсуваючи ймовірності вибору конкретних слів і токенів.
У результаті в досить довгому фрагменті тексту формується прихований математичний візерунок. Для людського ока фрази виглядають цілком природно й грамотно, проте спеціалізований детектор здатен з високою точністю підтвердити, що формулювання згенеровані моделями OpenAI.
Уразливість до переказу та закритий детектор
Попри технологічність рішення, його творці прямо попереджають про обмеження. У довідковому центрі компанії наголошують, що водяний знак не є суворим юридичним доказом причетності ШІ, а лише вказує на високу ймовірність його використання.
Стійкість мітки до редагування має межу:
- глибокий ручний рерайт або автоматичний переклад іншою мовою здатні сильно розмити чи повністю зруйнувати статистичний слід;
- короткі репліки, програмний код і наукові тексти з формулами практично неможливо надійно позначити без втрати якості самої відповіді;
- детектор textGrain не стане загальнодоступним сервісом: на першому етапі доступ до нього отримають лише акредитовані академічні дослідники та експертні організації, щоб зменшити кількість хибних звинувачень і не дати спамерам змоги швидко тестувати методи обходу.
Закон для Європи і свобода для розробників
Терміновість інтеграції пов’язана з жорсткими європейськими нормами. В офіційних роз’ясненнях Єврокомісії зазначено, що згідно зі статтею 50 закону AI Act усі творці генеративних моделей зобов’язані позначати синтетичний контент машиночитним маркуванням. Ці правила набули чинності ще 2 серпня 2026 року, але розробникам дали перехідний період до початку грудня.
Водночас глобальних користувачів примусове маркування поки не торкнеться: у споживчих версіях ChatGPT і Codex система вмикається лише для мешканців країн ЄС. Для розробників, які використовують OpenAI API у всьому світі, textGrain стане доступним як окрема опція з 5 жовтня, але за замовчуванням буде вимкнений. Надалі компанія планує викласти код технології у відкритий доступ, щоб задати спільний галузевий стандарт.