В текстах ChatGPT появятся невидимые водяные знаки


OpenAI начнет встраивать в тексты ChatGPT и Codex невидимые водяные знаки. На первом этапе технология заработает для пользователей в Евросоюзе, а определить происхождение текста можно будет по статистической закономерности в выборе слов искусственным интеллектом.

Компания представила собственную технологию под названием textGrain. Ее внедрение связано с требованиями европейского закона об искусственном интеллекте — EU AI Act.

В течение ближайших недель невидимая маркировка появится в подходящих текстовых ответах ChatGPT и Codex для пользователей всех тарифов в Евросоюзе. Делать эту систему глобальной и включать ее по умолчанию для пользователей за пределами ЕС OpenAI пока не собирается.

Одновременно технология стала доступна клиентам OpenAI API по всему миру для отдельных моделей. Однако здесь использование водяного знака остается добровольным: разработчики и компании смогут самостоятельно включить его, а по умолчанию функция отключена.

В отличие от обычной маркировки, textGrain не вставляет в текст скрытые символы, невидимые пробелы или специальную пунктуацию. Система меняет вероятность выбора моделью определенных слов или частей слов во время генерации.

В достаточно длинном тексте постепенно возникает статистический рисунок, который способен обнаружить специальный детектор. Для обычного читателя формулировки при этом выглядят как обычный текст.

OpenAI подчеркивает, что наличие такого сигнала не позволяет установить личность пользователя, его аккаунт или запрос, который он отправлял ChatGPT. Детектор также не раскрывает переписку и не способен определить, какую именно часть материала впоследствии написал или отредактировал человек.

Есть у технологии и существенные ограничения. Чем короче текст и чем сильнее его отредактировали после генерации, тем сложнее обнаружить первоначальный сигнал.

Поэтому отсутствие водяного знака нельзя будет считать доказательством того, что материал написал человек. Текст мог быть создан другой моделью, существенно переработан или сгенерирован до появления маркировки.

OpenAI также не собирается сразу предоставлять детектор всем желающим. На первом этапе доступ к нему получат одобренные исследователи и экспертные организации. Компания рассчитывает с их помощью оценить надежность технологии и количество ошибочных срабатываний.

Для обычных пользователей это означает, что скопированный из ChatGPT текст не получит видимых пометок вроде «создано ИИ». Водяной знак находится непосредственно в статистической структуре формулировок и сохраняется при обычном копировании текста.

При этом существенный рерайт, перефразирование или перевод способны ослабить сигнал и сделать его обнаружение менее надежным. Сама OpenAI признает, что даже неизмененный текст не всегда удастся определить, особенно если он короткий или модель имела мало вариантов для выбора формулировок.

Компания подчеркивает, что водяной знак говорит только о возможном происхождении материала. Он не подтверждает достоверность написанного, авторские права на текст или отсутствие последующего человеческого редактирования.
  • strana.life
  • СМИ России
  • Сегодня, 00:00