OpenAI готує запуск технології невидимого маркування текстів, створених штучним інтелектом. Система під назвою textGrain буде вбудована в інтерфейси ChatGPT та Codex для користувачів із Європейського Союзу. Компанія планує розпочати маркування протягом найближчих тижнів.
Вимоги законодавства та доступність функції
Як повідомили в OpenAI, рішення про впровадження пов’язане з імплементацією європейського Закону про штучний інтелект. Для розробників, які використовують OpenAI API, можливість додавати такі водяні знаки вже доступна. Ця функція працюватиме для клієнтів API по всьому світу, проте передбачено можливість її вимкнення.
Інструмент для виявлення маркування поки що не буде відкритим для широкого загалу. Першочергово доступ до нього отримають схвалені дослідники та експертні організації. У компанії розраховують на їхню допомогу у тестуванні системи та подальшому вдосконаленні алгоритмів.
Механізм роботи textGrain
Технологія textGrain ідентифікує тексти, згенеровані ШІ, аналізуючи специфічні закономірності у виборі слів моделлю під час процесу генерації. Якщо текст має достатню довжину, у послідовності обраних слів формується прихований сигнал, непомітний для людського ока. Детектор сканує велику кількість таких виборів, щоб знайти цей характерний маркер.
Водночас у OpenAI наголошують, що водяний знак не дасть змоги визначити конкретного користувача, його акаунт, конкретний запит або історію листування з ChatGPT. Крім того, система не вказує, яка саме частина тексту була написана людиною, а яка — штучним інтелектом.
Обмеження точності та вплив редагування
Розробники визнають, що поточна версія системи не гарантує 100% точності виявлення. За даними OpenAI, для текстів обсягом 200 токенів водяний знак виявляється приблизно в 80% випадків, тоді як для 400 токенів цей показник становить близько 95% (за умови цільового рівня хибних спрацьовувань у 1%).
Ефективність перевірки суттєво знижується, якщо текст піддається редагуванню. Під час тестувань було встановлено, що заміна 10% слів синонімами знижує ймовірність виявлення водяного знака з приблизно 92% до 66%. Якщо ж замінити чверть слів, показник падає до 17%.
Отже, відсутність виявленого водяного знака не є доказом того, що текст написала людина. Раніше про наміри використовувати аналогічну технологію повідомляла компанія Anthropic, яка також планує маркувати згенерований контент моделлю Claude невидимими водяними знаками після ухвалення європейського закону про штучний інтелект.
Коментарі
До цієї новини ще немає коментарів. Будьте першим!