В ЕС введут штрафы до 15 млн евро за публикацию нейрослопа без маркировки

OpenAI объявила о внедрении невидимых водяных знаков в текстовые генерации ChatGPT и Codex. Пользователь не увидит метку в готовом материале: специальный алгоритм изменяет статистику выбора слов так, чтобы обученный детектор мог распознать синтетический текст.
На первом этапе технология будет применяться к пользователям из Европейского союза. Разработчики, работающие с OpenAI API за пределами ЕС, смогут включать маркировку добровольно. Компания не уточняет, каким образом определяет местоположение пользователя.
Требования европейского закона
Причиной запуска стал EU AI Act — общеевропейский закон, регулирующий разработку и использование систем искусственного интеллекта. Его положения распространяются не только на компании внутри ЕС, но и на поставщиков, чьи продукты затрагивают граждан и резидентов союза.
Статья 50 документа, вступившая в силу 2 августа 2026 года, обязывает поставщиков ИИ-систем обеспечивать машиночитаемую маркировку синтетического контента, включая тексты, изображения, аудио и видео. За нарушение предусмотрен штраф до 15 млн евро или до 3% годового мирового оборота компании — в зависимости от того, какая сумма окажется больше. Под эти требования подпадает и OpenAI.
Насколько надёжна технология
По данным OpenAI, textGrain не является безошибочным детектором. При уровне ложных срабатываний около 1% система распознаёт метку примерно в 80% отрывков длиной 200 токенов и в 95% отрывков длиной 400 токенов — если речь идёт о текстах с большим разнообразием слов, например материалах на психологические темы. В математических текстах показатели ниже из-за более ограниченного словаря.
Редактирование заметно снижает точность проверки. После замены 10% слов синонимами доля обнаруженных меток уменьшается примерно на четверть. Если переписать около 25% текста, вероятность обнаружения может составлять всего 7–15% в зависимости от размера материала.
Таким образом, маркировка остаётся невидимой для читателя, но относительно легко теряет эффективность после небольшой переработки текста. Замена слов и изменение их последовательности способны существенно снизить вероятность срабатывания детектора, что ограничивает его пользу при поиске ИИ-контента в интернете.
Как OpenAI планирует использовать метки
Сначала доступ к инструментам проверки получат одобренные эксперты и организации. Затем невидимые водяные знаки должны появиться во всех тарифах ChatGPT и Codex на территории ЕС. Для пользователей OpenAI API по всему миру функция останется опциональной и по умолчанию будет отключена.
Результат проверки не сможет доказать, что весь текст создан искусственным интеллектом. Водяной знак не показывает долю человеческого участия и не позволяет установить аккаунт, с которого был отправлен запрос. В OpenAI также подчёркивают, что технология не должна заметно влиять на качество ответов. Внутренние сравнения генераций Astra с маркировкой и без неё показали практически одинаковые результаты.
Пока textGrain больше похож на первый этап системы контроля происхождения контента, чем на универсальный способ обнаружения «нейрослопа». Для регуляторов это может стать инструментом формального соблюдения требований закона, однако устойчивость маркировки к редактированию остаётся главным вопросом для её практического применения.


