OpenAI добавила невидимые водяные знаки в тексты ChatGPT и Codex в ЕС
OpenAI начала маркировать тексты ChatGPT и Codex невидимой статистической меткой textGrain: с 5 октября функция доступна в API по желанию клиента, а в течение нескольких недель станет обязательной для пользователей в Евросоюзе. Компания сама предупреждает, что метка легко теряется при редактировании.
5 октября OpenAI объявила, что начинает добавлять невидимые водяные знаки к текстам, которые генерируют ChatGPT и Codex. Первым регионом, где маркировка станет поведением по умолчанию, станет Евросоюз: так компания исполняет требования закона об ИИ (AI Act). Технология получила название textGrain, а её технический отчёт подготовлен вместе с исследователями из Пенсильванского университета и Йеля.
Как работает textGrain
Метка — это не символ и не скрытые пробелы. Система слегка смещает вероятности, с которыми модель выбирает следующее слово или его фрагмент. Когда несколько вариантов подходят одинаково хорошо, секретный ключ определяет, какой из них «выпадет». По отдельности такую подсказку заметить невозможно, но на длинном фрагменте накапливается статистический узор, который умеет распознавать детектор OpenAI. Поскольку сигнал живёт в самих словах, он сохраняется при копировании текста.
- API. С 5 октября клиенты по всему миру могут включить маркировку для отдельных моделей. По умолчанию она остаётся выключенной.
- ChatGPT и Codex. В течение нескольких недель метка появится у подходящих пользователей в ЕС на всех планах, включая бесплатный. В других регионах по умолчанию её не будет.
- Детектор. Приём заявок уже открыт, но доступ к инструменту проверки получат сначала только одобренные исследователи и экспертные организации.
Насколько это надёжно
Сам OpenAI не скрывает ограничений. В тестах на фрагментах длиной около 400 токенов замена 10% слов синонимами снижала обнаружение примерно с 92% до 66%, а замена 25% слов — до 17%. Короткие тексты, математические ответы и переводы распознаются хуже. При целевом уровне ложных срабатываний в 1% детектор находил метку примерно в 80% фрагментов на 200 токенов.
Компания также прямо перечисляет, чего водяной знак не делает: он не идентифицирует пользователя, не измеряет вклад человека, не устанавливает авторство или ответственность и не подтверждает достоверность. Отсутствие метки тоже ничего не доказывает — текст может быть слишком коротким, отредактированным или созданным другой моделью.
Почему это важно
Статья 50 закона ЕС об ИИ требует, чтобы поставщики генеративных систем делали вывод машиночитаемо идентифицируемым; правила прозрачности вступили в силу 2 августа, а уже работающие на рынке провайдеры должны соответствовать им к 2 декабря. OpenAI называет подход поэтапным и обещает со временем открыть технологию. Фактически это первый крупный коммерческий запуск обязательной маркировки ИИ-текста — и одновременно проверка того, насколько вообще работоспособна такая мера, когда текст легко отредактировать. К кодексу практики ЕС по ИИ-контенту уже присоединились Anthropic, Google, Meta и Microsoft.