Невидимые водяные знаки: OpenAI начинает маркировать тексты с помощью технологии textGrain
ChatGPT оставляет невидимые «следы» в сгенерированном ИИ-тексте
OpenAI начинает маркировать тексты в Европе с помощью технологии textGrain/Фото: Pexels
Компания OpenAI официально объявила о начале внедрения инновационной технологии маркировки контента. Разработчики сообщили, что начнут добавлять специальный невидимый водяной знак к текстовым материалам, которые генерируют ChatGPT и Codex на территории Европейского Союза. Главная цель нововведения — полное соответствие строгим требованиям недавно принятого Закона ЕС об искусственном интеллекте.
Детали
Согласно новым правилам прозрачности, предусмотренным Законом ЕС об искусственном интеллекте, которые официально вступили в силу 2 августа, ведущие компании-разработчики обязаны маркировать любой контент, созданный с помощью ИИ. Это необходимо для того, чтобы другие цифровые системы и пользователи могли четко идентифицировать машинное происхождение материала.
Согласно планам OpenAI, защитную маркировку будут внедрять постепенно в течение ближайших недель. Она охватит всех пользователей ChatGPT и Codex независимо от их тарифных планов, однако исключительно в пределах Европейского Союза. В то же время разработчики, которые интегрируют API OpenAI по всему миру, могут самостоятельно активировать эту функцию для определенных моделей уже сегодня. По умолчанию глобальная настройка текстового водяного знака на момент запуска не устанавливалась.
Как работает технология textGrain
Инновационный водяной знак не является привычным визуальным символом или значком. Принцип его действия заключается в тонкой и незаметной корректировке выбора слов самой моделью во время генерации. Это создает уникальный цифровой паттерн, который абсолютно незаметен для обычного читателя, но легко распознается специализированным детектором.

Поскольку маркировка встроена непосредственно в структуру лексики, перенос и копирование текста (например, через буфер обмена) не уничтожают ее — узор перемещается вместе с текстом. В компании подчеркнули, что такой подход полностью защищает конфиденциальность и не идентифицирует конкретного пользователя. Кроме того, внутренние тесты не выявили никаких существенных задержек или снижения производительности моделей при активации этого инструмента.
Параллельно с анонсом OpenAI представила подробный технический отчет, посвященный собственной методологии под названием textGrain. Документ, созданный в соавторстве с выдающимися исследователями из Пенсильванского и Йельского университетов, описывает использование секретного криптографического ключа для упорядочивания прогнозов следующего слова. Собрав несколько сотен таких фрагментов, аналитический детектор способен надежно подтвердить искусственное происхождение контента, используя только сам текст и ключ.
Несмотря на высокую технологичность, разработчики открыто заявляют о существующих ограничениях. В частности, тесты OpenAI доказали, что водяной знак можно деактивировать путем редактирования текста. Например, замена всего 10% слов синонимами снижает эффективность и точность обнаружения примерно с 92% до 66%. Кроме того, более сложными для идентификации остаются короткие отрывки, математические расчеты и переведенные тексты.
Именно из-за этих факторов компания решила предоставить первоначальный доступ к детектору ограниченному кругу лиц — исключительно утвержденным исследователям и профильным экспертным организациям. Они помогут протестировать надежность системы и обеспечить ее ответственное использование.
В OpenAI подчеркивают:
Водяные знаки могут указывать на то, что система OpenAI сгенерировала или обработала часть текста, но не на то, сколько человеческого суждения, редактирования или творчества было вложено в это
Еще в 2024 году компания OpenAI разработала метод, позволяющий надежно определять, когда кто-то использует ChatGPT для написания эссе или научной работы. Компания не опубликовала его, несмотря на распространенные опасения по поводу использования студентами искусственного интеллекта для списывания.
По словам источников и согласно внутренним документам, с которыми ознакомилась газета The Wall Street Journal, проект уже много лет находится в центре внутренних дискуссий в OpenAI и давно готов к выпуску.
Ранее OpenAI запустила специальную версию ChatGPT для подростков. Она предусматривает усиленные возрастные ограничения, родительский контроль и функции для обучения вместо простых готовых ответов. Новый продукт создан для поддержки самостоятельного развития школьников и минимизации их контакта с опасным контентом.
Не пропустите интересное!
Подписывайтесь на наши каналы и читайте новости в удобном формате!