Невидимі водяні знаки: OpenAI починає маркувати тексти за допомогою технології textGrain
ChatGPT залишати невидимі "сліди" у згенерованому ШІ тексті
OpenAI починає маркувати тексти в Європі за допомогою технології textGrain/Фото: Рexels
Компанія OpenAI офіційно оголосила про старт впровадження інноваційної технології маркування контенту. Розробники повідомили, що почнуть додавати спеціальний невидимий водяний знак до текстових матеріалів, які генерують ChatGPT та Codex на території Європейського Союзу. Головна мета нововведення – повна відповідність суворим вимогам нещодавно ухваленого Закону ЄС про штучний інтелект.
Деталі
Згідно з новими правилами прозорості, передбаченими Законом ЄС про штучний інтелект, які офіційно набрали чинності 2 серпня, провідні компанії-розробники зобов'язані маркувати будь-який контент, створений за допомогою ШІ. Це необхідно для того, щоб інші цифрові системи та користувачі могли чітко ідентифікувати машинне походження матеріалу.
Згідно з планами OpenAI, захисне маркування впроваджуватимуть поступово протягом найближчих тижнів. Воно охопить усіх користувачів ChatGPT та Codex незалежно від їхніх тарифних планів, проте виключно в межах Європейського Союзу. Водночас розробники, які інтегрують API OpenAI по всьому світу, можуть самостійно активувати цю функцію для певних моделей уже сьогодні. За замовчуванням глобальне налаштування текстового водяного знака на момент запуску не встановлювалося.
Як працює технологія textGrain
Інноваційний водяний знак не є звичним візуальним символом чи значком. Його принцип дії полягає в тонкому й непомітному коригуванні вибору слів самою моделлю під час генерації. Це створює унікальний цифровий патерн, який абсолютно не помітний для звичайного читача, але легко розпізнається спеціалізованим детектором.

Оскільки маркування вбудоване безпосередньо в структуру лексики, водіння та копіювання тексту (наприклад, через буфер обміну) не знищує його – візерунок переміщується разом із текстом. У компанії наголосили, що такий підхід повністю захищає конфіденційність і не ідентифікує конкретного користувача. Крім того, внутрішні тести не виявили жодних суттєвих затримок чи погіршення продуктивності моделей під час активації цього інструменту.
Паралельно з анонсом OpenAI презентувала детальний технічний звіт, присвячений власній методології під назвою textGrain. Документ, створений у співавторстві з видатними дослідниками з Університету Пенсильванії та Єльського університету, описує використання секретного криптографічного ключа для впорядкування прогнозів наступного слова. Зібравши кількасот таких фрагментів, аналітичний детектор здатний надійно підтвердити штучне походження контенту, використовуючи лише сам текст і ключ.
Попри високу технологічність, розробники відкрито заявляють про наявні обмеження. Зокрема, тести OpenAI довели, що водяний знак можна деактивувати шляхом редагування тексту. Наприклад, заміна лише 10% слів синонімами знижує ефективність і точність виявлення з приблизно 92% до 66%. Крім того, складнішими для ідентифікації залишаються короткі уривки, математичні розрахунки та перекладені тексти.
Саме через ці фактори компанія вирішила надати початковий доступ до детектора обмеженому колу осіб – виключно затвердженим дослідникам та профільним експертним організаціям. Вони допоможуть протестувати надійність системи та забезпечити її відповідальне використання.
В OpenAI наголошують:
Водяні знаки можуть вказувати на те, що система OpenAI згенерувала або обробила частину тексту, але не на те, скільки людського судження, редагування чи творчості було вкладено в це
Ще у 2024 році компанія OpenAI розробила метод, що дозволяє надійно визначати, коли хтось використовує ChatGPT для написання есе або наукової роботи. Компанія не опублікувала його, незважаючи на поширені побоювання щодо використання студентами штучного інтелекту для списування.
За словами джерел та внутрішніх документів, з якими ознайомилася газета The Wall Street Journal, проєкт уже багато років перебуває в центрі внутрішніх дискусій у OpenAI і вже давно готовий до випуску.
Раніше OpenAI запустила спеціальну версію ChatGPT для підлітків. Вона містить посилені вікові обмеження, батьківський контроль та функції для навчання замість простих готових відповідей. Новий продукт створено для підтримки самостійного розвитку школярів та мінімізації їхнього контакту з небезпечним контентом.
Не пропустіть цікавинки!
Підписуйтесь на наші канали та читайте новини у зручному форматі!