Перейти до основного змісту
Тепер роботу ChatGPT можна буде розпізнати: OpenAI маркуватиме згенеровані тексти, але лише в ЄС

Тепер роботу ChatGPT можна буде розпізнати: OpenAI маркуватиме згенеровані тексти, але лише в ЄС

ChatGPT
ChatGPT. Angga Budhiyanto/Zuma Press Wire/Shutterstock

Компанія OpenAI почне додавати невидимі водяні знаки до текстів, які генерують моделі ChatGPT та Codex у Європейському Союзі. Таке рішення ухвалили, щоб відповідати новим правилам Закону ЄС про штучний інтелект.

Про це йдеться у блозі OpenAI.

Правила прозорості європейського закону про ШІ набули чинності 2 серпня. Вони вимагають від розробників маркувати згенерований контент так, щоб його могли розпізнати інші системи.

В OpenAI заявили, що функція буде впроваджена протягом наступних тижнів для користувачів у ЄС на всіх тарифних планах. Водночас розробники, які використовують API OpenAI у будь-якій точці світу, вже від сьогодні можуть увімкнути маркування для окремих моделей. За замовчуванням цю опцію вимкнули, і компанія поки не планує робити текстовий водяний знак глобальним.

Що відомо про водяні знаки ChatGPT

Функція отримала назву textGrain. Водяний знак не є фізичним символом. Натомість він непомітно формує вибір слів, створюючи шаблон, який читачі не бачать, але фіксує спеціальний детектор. Оскільки цей маркер система вбудовує безпосередньо у слова, він зберігається під час копіювання тексту. Представники компанії запевняють, що водяний знак не ідентифікує користувача і не погіршує продуктивність моделей.

Разом із цим анонсом розробники опублікували технічний звіт про свій метод. Документ створили у співавторстві з дослідниками з Університету Пенсильванії та Єльського університету. У звіті автори пояснюють, що технологія textGrain використовує криптографічний ключ для коригування передбачень наступного слова під час генерації тексту. Метод калібрується за рівнем ентропії: чим вища варіативність можливих слів у реченні, тим легше вбудувати маркер без втрати якості та плавності тексту. Якщо об'єднати сотні таких виборів, детектор зможе виявити згенерований контент.

Розробники також протестували, чи можна видалити маркер шляхом редагування. Результати показали, що заміна 10 % слів синонімами знижує рівень виявлення з 92 % до 66 %. Крім того, системі важко розпізнати короткі тексти, математичні відповіді та переклади. Через ці обмеження компанія вирішила надати початковий доступ до детектора лише затвердженим дослідникам та експертним організаціям, які допоможуть оцінити надійність інструмента.

Також в OpenAI попередили, що відсутність водяного знака не доводить авторство людини. Текст може бути надто коротким, сильно відредагованим або створеним за допомогою ШІ від іншої компанії.

«Водяні знаки можуть вказувати на те, що система OpenAI згенерувала або обробила частину уривку, але не на те, скільки людського розсуду, редагування чи креативності було вкладено в це», — наголосили в компанії.

Досвід інших компаній

Два місяці тому компанія Anthropic запровадила глобальне маркування текстів, згенерованих моделлю Claude. Це викликало обурення серед частини користувачів, які стверджували, що саме вони надають інструкції та контекст, а нейромережа працює лише як інструмент.

Журналісти також нагадують публікацію The Wall Street Journal за 2024 рік, де йшлося про те, що OpenAI вже розробляла текстовий водяний знак, але відкладала його реліз через побоювання, що користувачі перейдуть до конкурентів.

Сьогодні Anthropic, Google, Meta, Microsoft та OpenAI належать до переліку компаній, які зобов'язалися дотримуватися кодексу практики ЄС щодо згенерованого контенту.

Читайте нас у Facebook, Instagram і Telegram, дивіться наш YouTube і TikTok

Поділіться своєю історією з Суспільне Культура. З нами можна зв'язатися у соціальних мережах та через пошту: [email protected]

Топ дня
Вибір редакції
На початок