OpenAI готовится к запуску технологии невидимой маркировки текстов, созданных искусственным интеллектом. Система под названием textGrain будет встроена в интерфейсы ChatGPT и Codex для пользователей из Европейского Союза. Компания планирует начать маркировку в ближайшие недели.
Требования законодательства и доступность функции
Как сообщили в OpenAI, решение о внедрении связано с имплементацией европейского Закона об искусственном интеллекте. Для разработчиков, которые используют OpenAI API, возможность добавлять такие водяные знаки уже доступна. Эта функция будет работать для клиентов API по всему миру, однако предусмотрена возможность ее отключения.
Инструмент для обнаружения маркировки пока не будет открыт для широкой публики. В первую очередь доступ к нему получат одобренные исследователи и экспертные организации. В компании рассчитывают на их помощь в тестировании системы и дальнейшем совершенствовании алгоритмов.
Механизм работы textGrain
Технология textGrain идентифицирует тексты, сгенерированные ИИ, анализируя специфические закономерности в выборе слов моделью в процессе генерации. Если текст имеет достаточную длину, в последовательности выбранных слов формируется скрытый сигнал, незаметный для человеческого глаза. Детектор сканирует большое количество таких выборов, чтобы найти этот характерный маркер.
Вместе с тем в OpenAI подчеркивают, что водяной знак не позволит определить конкретного пользователя, его аккаунт, конкретный запрос или историю переписки с ChatGPT. Кроме того, система не указывает, какая именно часть текста была написана человеком, а какая — искусственным интеллектом.
Ограничения точности и влияние редактирования
Разработчики признают, что текущая версия системы не гарантирует 100% точности обнаружения. По данным OpenAI, для текстов объемом 200 токенов водяной знак обнаруживается примерно в 80% случаев, тогда как для 400 токенов этот показатель составляет около 95% (при целевом уровне ложных срабатываний в 1%).
Эффективность проверки существенно снижается, если текст подвергается редактированию. Во время тестов было установлено, что замена 10% слов синонимами снижает вероятность обнаружения водяного знака с примерно 92% до 66%. Если же заменить четверть слов, показатель падает до 17%.
Таким образом, отсутствие обнаруженного водяного знака не является доказательством того, что текст написал человек. Ранее о намерениях использовать аналогичную технологию сообщала компания Anthropic, которая также планирует маркировать сгенерированный контент моделью Claude невидимыми водяными знаками после принятия европейского закона об искусственном интеллекте.
Комментарии
К этой новости пока нет комментариев. Будьте первым!