OpenAI добавит невидимые водяные знаки в текст ChatGPT в ЕС. Никаких специальных символов не требуется. После перезаписи он может стать недействительным.

📅 2026-10-06

Аннотация:

OpenAI постепенно добавляет невидимые водяные знаки в тексты, генерируемые ChatGPT и Кодексом в Европейском Союзе, чтобы соответствовать требованиям Закона ЕС об искусственном интеллекте в отношении разборчивости контента, созданного ИИ. OpenAI заявила, что эта технология создания водяных знаков в тексте под названием textGrain не добавляет в статью скрытые символы, невидимые пробелы или специальные знаки препинания. Вместо этого он корректирует метод выбора слов, когда модель генерирует текст, формируя статистический признак во всем тексте, который не может быть непосредственно обнаружен человеческим глазом, но может быть распознан машиной.

1780081657_chatgpt_logo.webp

Согласно информации, опубликованной OpenAI, соответствующие требования прозрачности Закона Европейского Союза об искусственном интеллекте вступят в силу 2 августа 2026 года. Поставщики услуг генеративного ИИ обязаны иметь созданный ИИ контент с машинно-распознаваемыми знаками. Поэтому OpenAI планирует постепенно внедрять текстовые водяные знаки для соответствующих пользователей ChatGPT и Codex в ЕС в течение следующих нескольких недель, и это развертывание будет охватывать все пакеты ChatGPT, а не только платящих пользователей.

Этот вид водяного знака отличается от «скрытого текста» в традиционном понимании. Когда пользователи копируют контент, сгенерированный ChatGPT, скрытый символ при этом не копируется, и в тексте не обнаруживаются специальные символы. Что textGrain на самом деле меняет, так это вероятность случайного выбора модели при столкновении с несколькими возможными словами. Изменения в одном слове могут быть совершенно незаметными, но при объединении большого количества слов может сформироваться статистическая закономерность, которую сможет распознать система обнаружения.

В OpenAI заявили, что преимуществом этого дизайна является то, что он существенно не меняет обычный текстовый вывод. Тесты компании показали, что разница в производительности модели при добавлении водяных знаков и без добавления водяных знаков находилась в пределах нормального диапазона колебаний теста, а влияние на скорость генерации текста также было очень небольшим. В ходе предыдущего внутреннего тестирования ChatGPT, проведенного OpenAI, не было обнаружено, что функция водяных знаков привела к увеличению негативных отзывов пользователей.

Однако OpenAI также признала, что текстовые водяные знаки не являются на 100% надежным методом идентификации контента ИИ. При обнаружении водяных знаков возможны две возможные ошибки. Во-первых, текст без водяного знака ошибочно воспринимается как имеющий водяной знак, а во-вторых, текст действительно имеет водяной знак, но система обнаружения его не распознает.

Длина текста также является важным фактором, влияющим на результаты обнаружения. В более коротком тексте у модели меньше возможностей для корректировки выбора слов, что затрудняет формирование стабильного статистического сигнала. Правила, опубликованные OpenAI, также показывают, что в соответствии со спецификациями прозрачности ИИ ЕС для добавления текстовых водяных знаков не требуется вывод менее 200 токенов, около 150 английских слов и фрагментов кода.

Существуют также различия в результатах обнаружения на разных языках. OpenAI протестировала все 24 официальных языка Евросоюза. При сохранении уровня ложноположительных результатов на уровне 1% уровень обнаружения испанского языка достиг максимума 69%, в то время как уровень обнаружения румынского языка составлял всего 42,2%. Для языков со слабыми эффектами обнаружения OpenAI может увеличить силу водяного знака, чтобы расширить возможности обнаружения.

Это означает, что textGrain нельзя понимать как технологию, которая может на 100% доказать, что она была создана ChatGPT, когда вы видите водяной знак. OpenAI ясно дает понять, что даже если исходный текст не был изменен, нет никакой гарантии, что система обнаружения сможет обнаружить водяной знак, особенно когда текст короткий или диапазон выбираемых слов невелик.

В то же время существуют очевидные различия между текстовыми водяными знаками и детекторами текста AI, представленными в настоящее время на рынке. Сторонние инструменты обнаружения ИИ, такие как Pangram, в основном используют классификаторы, чтобы определить, может ли фрагмент текста быть сгенерирован ИИ, путем анализа выбора слов, структуры предложения и других особенностей языка. Этот метод анализирует текст после его генерации, а textGrain непосредственно оставляет машиночитаемый статистический сигнал во время процесса генерации текста.

OpenAI считает, что этот подход больше соответствует требованиям Закона ЕС об искусственном интеллекте в отношении «встроенных» идентифицируемых сигналов.

OpenAI не использовала напрямую SynthID от Google DeepMind или другие существующие решения для создания текстовых водяных знаков, а разработала textGrain самостоятельно. Компания заявила, что ее собственная разработка позволяет ей более гибко настраивать баланс между обнаруживаемостью водяных знаков и разнообразием результатов модели. В ходе внутреннего тестирования textGrain распознавал текст с водяными знаками со скоростью, равной или превышающей скорость других протестированных компанией решений, включая SynthID для текста.

OpenAI также планирует открыть исходный код технологии textGrain, надеясь, что другие исследовательские учреждения и компании смогут использовать эту технологию для дальнейших исследований и улучшения распознавания источников текста ИИ. Однако OpenAI не будет сразу открывать детектор текстовых водяных знаков для публики, а сначала предоставит каналы применения утвержденным исследователям и профессиональным учреждениям.

Эти авторизованные исследователи и учреждения могут использовать инструменты обнаружения OpenAI, чтобы определить, содержит ли фрагмент текста водяной знак, сгенерированный OpenAI, но результаты обнаружения не раскрывают личность пользователя, слова-подсказки или записи чата, соответствующие сгенерированному контенту. OpenAI считает, что, поскольку современные технологии по-прежнему сопряжены с риском ложноположительных и ложноотрицательных результатов, прямое открытие инструментов обнаружения для всех может привести к чрезмерной интерпретации результатов обнаружения водяных знаков.

Стоит отметить, что на этот раз OpenAI не планирует включать текстовые водяные знаки по умолчанию во всем мире. Компания заявила, что на данном этапе ChatGPT и текстовые водяные знаки Кодекса будут постепенно внедряться только для региона ЕС. Это региональное развертывание позволит OpenAI наблюдать за производительностью в реальных условиях использования и корректировать технологию на основе реальных отзывов.

Для разработчиков API ситуация иная. OpenAI начала разрешать глобальным клиентам API активно включать функцию текстовых водяных знаков для некоторых моделей, но по умолчанию она по-прежнему отключена. Это означает, что компании могут решать, ставить ли водяные знаки в текст, созданный с помощью API, исходя из своих собственных требований к прозрачности.

OpenAI также координирует свои действия с партнерами по облачным сервисам, надеясь, что в ближайшие несколько недель подходящий контент, созданный путем вызова моделей OpenAI через эти облачные платформы, также получит соответствующие исходные сигналы.

Однако текстовые водяные знаки не заменят другие методы идентификации контента с помощью искусственного интеллекта. OpenAI подчеркивает, что исходная информация, такая как машиночитаемые водяные знаки и C2PA, не может заменить публичные заявления, такие как видимые метки AI и баннеры с подсказками, требуемые законом или платформой. Они решают проблемы источников контента на разных уровнях.

Для обычных пользователей самое примечательное в этом изменении: если вы находитесь в ЕС и используете ChatGPT для генерации длинного текста, то с того момента, как система водяных знаков официально распространяется на вашу учетную запись, сгенерированный контент уже может содержать исходные сигналы, невидимые невооруженным глазом. Прямое копирование исходного текста обычно не уничтожает этот сигнал, но если текст значительно переписан, переформулирован или переведен, обнаруживаемость водяного знака может значительно снизиться.

OpenAI также явно признает это ограничение. Сигнал textGrain существует в выделенном слове модели, а не в виде невидимого символа, независимо прикрепленного к текстовому файлу. Следовательно, достаточное переписывание текста может разрушить исходную статистическую закономерность. Вот почему OpenAI подчеркивает, что текстовые водяные знаки в настоящее время более подходят в качестве сигнала оценки источника и не могут рассматриваться как абсолютно надежный «сертификат идентификации ИИ».

Вообще-то, OpenAI на этот раз запустила textGrain в ЕС главным образом для того, чтобы адаптироваться к новым нормативным требованиям, введенным Законом об искусственном интеллекте. Это также означает, что идентификация источника текста, сгенерированного ИИ, развивается от традиционных «декларативных тегов» к машинно-распознаваемым сигналам. Он не изменит текст, который видят пользователи, и при копировании текста не появятся загадочные символы, но позволит системам с разрешениями на обнаружение попытаться определить, исходит ли часть контента из модели OpenAI.

Однако, поскольку текстовые водяные знаки по-прежнему имеют проблемы, такие как языковые различия, ограничения длины текста и ослабление сигнала после переписывания, в настоящее время они больше подходят в качестве вспомогательного доказательства в системе отслеживания контента ИИ, а не используются отдельно для определения того, была ли статья «написана ИИ».

Связанные теги

Похожие статьи

Комментарии

0/500
Captcha (click to refresh)
Нет комментариев