Компания OpenAI приступила к внедрению невидимой маркировки текстов, созданных ChatGPT, в странах Евросоюза в рамках исполнения требований европейского закона об искусственном интеллекте. По официальной формулировке, маркировка должна помочь системам распознавать контент, сгенерированный генеративными моделями, без явного указания источника. В рамках текущей информации мера пока касается текстов, созданных пользователями в ЕС и связанных сервисов OpenAI, и не обязательно действует во всех регионах и для всех продуктов, согласно источникам.

Для реализации маркировки применяется технология textGrain. Она не добавляет в текст скрытых символов, пробелов или иных необычных знаков; вместо этого изменяется статистический выбор слов и токенов по заданному алгоритму, что позволяет детектору оценить вероятность того, что фрагмент создан ИИ.

Ранее OpenAI разрабатывала подобную систему, но не запускала её в массовом масштабе из‑за опасений по поводу рискованных выводов, например в контексте проверки студенческих работ. В настоящее время маркировка постепенно появляется в текстах ChatGPT и Codex, созданных пользователями в ЕС, с акцентом на тексты, которые соответствуют европейским правилам.

Внутренние испытания показывали уязвимость метода к редактированию: детектор находил примерно 80% помеченных фрагментов длиной 200 токенов и до 95% текстов длиной 400 токенов. При замене около четверти слов вероятность обнаружения падала до примерно 17%, что подчёркивает зависимость эффективности от изменений в тексте.

OpenAI подчёркивает: наличие маркировки не доказывает полного копирования материала из ChatGPT и не указывает точную долю созданного ИИ текста или объём текста, изменённого человеком. Аналогичный подход к маркировке для соблюдения требований ЕС применяют в некоторых моделях Claude у Anthropic.