Появился способ отличить сгенерированный ИИ контент

OpenAI объявила о внедрении водяных знаков в сгенерированный ИИ контент
В соответствии с законом ЕС об искусственном интеллекте разработчики начали внедрение водяных знаков в сгенерированный моделями контент.
Cagkan Sayin/Shutterstock/FOTODOM

С 5 октября клиенты API моделей ChatGPT и Codex могут по желанию включить маркировку контента, сгенерированного искусственным интеллектом, сообщила OpenAI. По умолчанию она будет оставаться отключенной.

Система водяных знаков textGrain разработана и внедрена во исполнение закона Евросоюза об ИИ. «В ближайшие недели» текстовый контент, создаваемый с помощью генеративных моделей OpenAI на территории ЕС, будет помечаться автоматически.

textGrain изменяет статистическую закономерность в выборе слов моделью, незаметную для пользователя, но легко идентифицируемую специальной программой-детектором. Система далеко не безупречна, особенно в анализе коротких текстов — может давать ложные срабатывания или, наоборот, пропускать водяные знаки там, где они есть. Кроме того, редактированием текста водяные знаки можно в значительной мере «подтереть».

OpenAI предупредила и о других ограничениях системы. textGrain не измеряет вклад человека, не устанавливает право собственности или ответственность, не идентифицирует пользователя, не подтверждает достоверность помеченного контента.

«Отсутствие водяного знака не доказывает человеческое авторство, — подчеркивается в сообщении. — Текст, созданный с помощью инструментов OpenAI, может быть слишком коротким, отредактированным или переведенным для надежной работы обнаружения».

В силу всех вышеизложенных недостатков детектор пока предоставляется «одобренным исследователям и экспертным организациям» в индивидуальном порядке. С развитием и усовершенствованием технология, возможно, станет общедоступной.

Подписывайтесь и читайте «Науку» в MAX