Исследование раскрыло, как ИИ-чатботы втираются в доверие

Искусственный интеллект стал неотъемлемой частью нашей повседневной реальности — при этом он по-прежнему нещадно галлюцинирует и распространяет недостоверную информацию. В Университете штата Пенсильвания изучили, почему люди доверяют ИИ. Результаты исследования обнародованы в Journal of Computer-Mediated Communication.
Его авторы нашли очень простую зависимость: чем словоохотливее ИИ-чатбот — тем больше ему доверяют пользователи. Эта взаимосвязь опосредована через снижение «негативной машинной эвристики» — склонности считать, что машинам не хватает человеческой интуиции и способности принимать субъективные решения.
«Текстовая выдача генеративного ИИ сверхточно подстроена под конкретный вопрос, поэтому кажется очень персонализированной. Впервые в истории технологий машина действительно может вести беседу, которую не предугадал программист и которая не была прописана заранее», — говорит профессор С. Шьям Сундар, руководивший исследованием.
В основу его лег онлайн-эксперимент с участием 477 человек, которых предупредили, что они помогают тестировать нового ИИ-помощника по здоровью. Каждого испытуемого попросили задать боту один запрос из предложенного набора. В ответ ИИ выдавал неверную информацию. Затем участников спрашивали, насколько достоверными им показались полученные сведения.
Кроме того, проверили, как влияет на доверие опция проверки, которая была представлена в четырех разных вариантах:
- простая подсказка с маленьким значком-предупреждением о возможной недостоверности;
- обязательная проверка с кнопкой, без нажатия на которую нельзя продолжить;
- необязательная проверка с кнопкой, которую можно нажать по желанию
- и полное отсутствие валидации.
Эта вторая часть эксперимента дала, пожалуй, самые удручающие результаты: имея возможность проверить выдачу ИИ, сделали это только 50% испытуемых.
«Опция проверки — хорошее противоядие от разговорчивой убедительности генеративного ИИ. Именно это мы и вынесли в название исследования: „Общайся, но проверяй“. Общайтесь в свое удовольствие, но не давайте себя обманывать», — призывает Сундар.
Участники, получавшие ответы от более разговорчивого ИИ, чаще считали информацию достоверной, чем те, кто взаимодействовал с менее многословными версиями. И это происходило даже тогда, когда ответы были откровенно бредовыми.
«Некоторые примеры дезинформации в нашем исследовании были абсурдными — например, что имбирь может быть эффективнее химиотерапии в лечении рака. Звучит нелепо, но если это преподносит очень разговорчивый ИИ, люди доверяют сильнее. По-моему, это тревожно», — считает ведущий автор исследования Мэгги Ляо.
Доверие снижалось также после проверки — поскольку по условиям эксперимента ИИ выдавал заведомую ложь вроде «микроволновка вызывает рак».
«Хочется надеяться, что исследование, показывающее пользу инструментов проверки в борьбе с дезинформацией, убедит ИИ-платформы отнестись к ним серьезно и разработать больше подобных механизмов проверки информации, создаваемой ИИ», — подытожил Сундар.












