Группа исследователей из Carnegie Mellon, MIT и Cornell провела два онлайн-эксперимента, в которых проверяла, способен ли короткий разговор с большой языковой моделью снизить веру в конспирологические теории. Участниками стали взрослые американцы, набранные через опросную платформу: 472 человека в эксперименте, связанном с покушением на Дональда Трампа, и 1035 — в эксперименте с убийством Брайана Кирка. В обоих случаях диалог с ИИ длительностью около семи минут уменьшал убеждённость в собственной конспирологической теории сильнее, чем статичный факт-лист с указанием источников.

Методология экспериментов строилась на сравнении трёх групп. Первая группа вела минимум пять раундов переписки с моделью Google Gemini (версия 1.5 от февраля 2024 года в первом эксперименте, версия 2.5 от июня 2025 года во втором), которой в системном промпте была поставлена задача снижать конспирологические убеждения через диалог, основанный на фактах. Вторая группа получала факт-лист с цитатами источников. Третья — контрольная — общалась на нейтральную тему, например о том, кто лучше: кошки или собаки. Важно, что оба события произошли после даты среза обучающих данных моделей, поэтому ни Gemini, ни GPT-4o не могли опираться на внутренние знания. Вместо этого исследователи встроили в системный промпт курируемую базу фактов, разделённую на подтверждённые сведения, уже опровергнутые утверждения и вопросы, открыто помеченные как нерешённые. В эксперименте с Кирком модели также разрешался веб-поиск, но только для проверки фактических утверждений.

ЭкспериментЧисло участниковМодельРезультат
Покушение на Трампа472Gemini 1.5Снижение веры в конспирологию
Убийство Кирка1035Gemini 2.5Снижение веры, рост доверия к официальной версии

Результаты показали, что диалог с ИИ превосходит факт-лист по ключевому показателю — снижению согласия с утверждениями о «сокрытии» или «неизвестных факторах». В эксперименте с Трампом доверие к официальной версии не выросло, что авторы связывают с отсутствием чёткого официального объяснения на тот момент: мотив стрелка оставался неясным даже при написании статьи. В эксперименте с Кирком, где власти уже раскрыли детали о преступнике, доверие к официальной версии немного возросло по сравнению с контрольной группой, однако разница с факт-листом не была статистически значимой. Также диалог не оказал измеримого влияния на поддержку политического насилия.

Эффект debunking-беседы сохранялся спустя два месяца и снижал восприимчивость к новым конспирологическим нарративам.

In both experiments, belief in the participant's own conspiracy theory dropped more after the LLM dialogue than after reading a static fact sheet. | Image: Costello et al.
In both experiments, belief in the participant's own conspiracy theory dropped more after the LLM dialogue than after reading a static fact sheet. | Image: Costello et al. · Источник: The Decoder

Анализ ответов модели показал, что она адаптировала тактику убеждения в зависимости от доступности информации. В случае с покушением на Трампа, когда о мотивах стрелка было почти ничего не известно, модель реже использовала рациональные аргументы и чаще прибегала к эпистемической скромности — признанию ограниченности собственных знаний, — а также к сократическим вопросам, побуждающим собеседника задуматься о собственных доказательствах, и указаниям на авторитетные источники. В случае с убийством Кирка, где данных было больше, подход напоминал работу с классическими конспирологическими теориями: больше внимания уделялось социальному вреду конспирологического мышления.

Эффект от разговора оказался устойчивым во времени и распространился на последующие события. Через два месяца после первого покушения на Трампа на его территории был арестован ещё один вооружённый человек. Участники, прошедшие debunking-диалог, реже верили, что правду узнают лишь немногие влиятельные лица или что её скроют от общественности. Аналогичная картина наблюдалась и в случае с Кирком: через две с половиной недели после его убийства произошло нападение на церковь в Гранд-Бланк Тауншипе, и через одиннадцать дней опрос показал, что основное влияние на этот эпизод не было значимым, однако вторичный анализ выявил остаточный эффект в конспирологических нарративах о церковной атаке. Более отчётливо перенос проявился в общих конспирологических убеждениях: участники, общавшиеся с моделью, реже соглашались с распространёнными конспирологическими нарративами. Таким образом, debunking-интервенция работала как своего рода пребакинг — профилактика против будущих ложных утверждений.

Исследование поднимает вопрос о практическом применении диалоговых систем для борьбы с дезинформацией. В отличие от традиционных методов пребакинга, где людей заранее предупреждают и показывают ослабленные примеры манипуляций, здесь использовался интерактивный формат, который оказался более эффективным, чем пассивное чтение фактов. Однако авторы отмечают ограничения: эксперименты проводились вскоре после событий, выборка ограничена американскими пользователями, а долгосрочные эффекты требуют дополнительного изучения. Тем не менее, результаты дают основания рассматривать LLM-диалоги как инструмент для снижения уязвимости к дезинформации в периоды повышенного информационного шума.