Диалог с Gemini снижает веру в теории заговора лучше, чем факты

В течение недели после покушения на Дональда Трампа в июле 2024 года около половины репрезентативной выборки жителей США слышали версию, что нападение было инсценировкой, а 11% в неё верили. После убийства ультраправого активиста Чарли Кирка в сентябре 2025 года теории о причастности Моссада, о «постановочной» операции (false flag) и о сокрытии информации властями разошлись за считаные дни.
Исследователи из Университета Карнеги, Меллона, Массачусетского технологического института (MIT) и Корнеллского университета проверили, способен ли короткий диалог с языковой моделью ослабить эти нарративы именно в это окно, сразу после трагедии. Они провели два онлайн-эксперимента. Участников набирали через опросную платформу, а моделью GPT-4o отбирали тех, кто уже выражал веру в конспирологическую версию события: после отбора в эксперименте про Трампа осталось 472 человека, в эксперименте про Кирка, 1035. Замерив исходный уровень убеждений, участников случайно распределяли по трём группам. Первая вела не менее пяти раундов диалога с Google Gemini (версия 1.5 от февраля 2024 года в первом эксперименте, версия 2.5 от июня 2025 года во втором), которой было предписано снижать веру в теорию заговора через аргументированный разговор с опорой на доказательства. Вторая получала статичную справку с фактами и ссылками на источники. Третья вела нейтральный контрольный разговор, о том, кто лучше, кошки или собаки.
Оба события произошли позже даты обучения используемых моделей, поэтому опереться на собственные знания модель не могла: исследователи заранее встроили в системный промпт подобранную фактическую базу, подтверждённые факты, уже опровергнутые утверждения и вопросы, прямо помеченные как открытые. В эксперименте про Кирка модели также разрешили веб-поиск, но только для проверки фактических утверждений, а не для свободного поиска.
Диалоги длились в среднем около семи минут и в обоих экспериментах снижали веру участника в его собственную версию заговора сильнее, чем контрольный чат и справка с фактами; согласие с утверждениями о «сокрытии или заговоре» и о «скрытых, неозвученных обстоятельствах» тоже падало. При этом доверие к официальной версии в эксперименте про Трампа не выросло, по мнению авторов, потому что на тот момент чёткой официальной версии просто не существовало: было известно только, что охрана не справилась, а мотив стрелка оставался неясным даже на момент публикации исследования. В эксперименте про Кирка, где власти уже раскрыли подробности о предполагаемом преступнике, доверие к официальной версии слегка выросло по сравнению с контрольным чатом, хотя отличие от группы со справкой не оказалось статистически значимым; на поддержку политического насилия диалог о Кирке заметного влияния не оказал.
Чтобы понять, как именно модель убеждала людей, исследователи разобрали её реплики по отдельным предложениям и увидели, что тактика менялась в зависимости от того, сколько фактов было известно. В случае с Трампом, где о мотиве и биографии стрелка почти ничего не было известно, модель реже прибегала к рациональной аргументации, чем при разборе классических теорий заговора: вместо этого она признавала пределы собственных знаний, призывала не спешить с выводами, задавала сократовские вопросы, подталкивающие людей самим оценить свои доказательства, и указывала на надёжные источники. В случае с Кирком, где информации было больше, поведение модели больше напоминало разбор классических теорий заговора, с упором на то, какой вред конспирологическое мышление наносит обществу.
Эффект от разговора с моделью переносился и на последующие, не связанные напрямую события. Через два месяца после первого покушения на Трампа на его территории задержали ещё одного вооружённого человека, участники, прошедшие через диалог-разубеждение, реже верили, что правду узнает лишь узкий круг влиятельных людей или что её скроют от общества. Через две с половиной недели после убийства Кирка в городке Гранд-Бланк-Тауншип в Мичигане произошло нападение с поджогом на храм Церкви Иисуса Христа Святых последних дней; исследователи повторно опросили участников спустя одиннадцать дней. Основной анализ не выявил значимого прямого эффекта диалога применительно именно к этому нападению, но вторичный анализ показал, что часть исходного эффекта всё же проявилась, в виде меньшей склонности верить общим, не привязанным к конкретному событию теориям заговора.
Авторы подчёркивают, что их работа, это кейс-стади: возможны кризисы, где такой подход не сработает, и ситуации, где заговор существует на самом деле и переубеждать людей было бы неправильно. Они также ссылаются на собственную более раннюю работу, показавшую, что похожий диалог с моделью способен действовать и в обратную сторону, убеждать людей в теориях заговора, а не разубеждать; для новых, только зарождающихся конспирологических нарративов авторы называют это риском злоупотребления. И конечно, для эффекта людям для начала нужно согласиться обсуждать свои убеждения с языковой моделью.
Та же исследовательская группа два года назад с помощью диалогов с GPT-4 снижала веру в устоявшиеся теории заговора почти на 20 процентных пунктов, причём эффект сохранялся ещё два месяца и распространялся даже на нарративы, которые в разговоре не поднимались; новизна нынешней работы, проверка того же подхода на свежих событиях, где фактов на момент разговора было мало. Отдельное исследование с почти 77 тысячами участников объясняло, почему диалог обгоняет справку с фактами: языковые модели в разговоре оказались на 41, 52% убедительнее короткого текстового сообщения, и решающим фактором был именно объём подкреплённых источниками утверждений, а не удачные разговорные приёмы. Тот же самый механизм убеждения работает и во вред: похожий, но неавторизованный эксперимент Цюрихского университета на Reddit использовал его именно так.
Ключевые факты
- Два эксперимента: после покушения на Трампа (июль 2024, 472 участника) и убийства Чарли Кирка (сентябрь 2025, 1035 участников), оба через неделю-другую после события.
- Диалог с Google Gemini (не менее 5 раундов, в среднем около 7 минут) снижал веру в конспирологическую версию сильнее, чем статичная справка с фактами и нейтральный контрольный чат.
- Модель меняла тактику по объёму известных фактов: при нехватке информации (Трамп) чаще признавала пределы своих знаний и задавала наводящие вопросы, при большей ясности (Кирк) действовала как при разборе классических теорий заговора.
- Эффект частично переносился на новые, не связанные события, задержание вооружённого человека на территории Трампа и нападение на церковь в Мичигане, хотя для последнего прямой эффект статистически не подтвердился.
- Авторы называют работу кейс-стади и предупреждают: похожий диалог способен и убеждать в теориях заговора, а не только их развенчивать, риск злоупотребления для новых конспирологических нарративов.
Почему это важно
Большинство исследований по борьбе с дезинформацией проверяют развенчание задним числом, на давно известных теориях заговора. Здесь модель работала прямо в разгар кризиса, когда фактов ещё мало, и всё равно обошла статичную справку с фактами, стандартный инструмент модерации и просвещения. Дополнительно ценно, что часть эффекта перенеслась на последующие, заранее не обсуждавшиеся события: получилось что-то вроде разубеждения впрок, без предварительного предупреждения о будущей дезинформации.
Кому это важно
Площадкам и СМИ, которым приходится реагировать на всплеск конспирологии сразу после теракта или громкого убийства; исследователям дезинформации, которые ищут работающие форматы вмешательства; разработчикам LLM (в исследовании, Google, чья Gemini выступала инструментом диалога), думающим о безопасности и социально полезных применениях моделей; регуляторам и платформам, оценивающим риски и пользу автоматизированных чат-ботов в кризисных ситуациях.
Как это применить
Ключевые условия эксперимента: в системный промпт модели заранее закладывается проверенная фактическая база, разбитая на подтверждённые факты, уже опровергнутые утверждения и явно помеченные открытые вопросы; диалог должен идти минимум пять раундов, в среднем достаточно около семи минут; веб-поиск, если он разрешён, используется моделью только для проверки фактов, а не для свободного поиска. Главное узкое место, не техническое: люди сначала должны согласиться обсуждать свои убеждения с чат-ботом, а это происходит далеко не всегда.
Можно ли доверять
Авторы сами называют работу кейс-стади, а не универсальным доказательством. В материале The Decoder не названы ни фамилии исследователей, ни название статьи, ни издание публикации, ни статус рецензирования, ни источник финансирования; не приведены и абсолютные числа, насколько именно диалог с Gemini снизил веру в заговор в процентных пунктах, известно лишь то, что он обошёл контрольный чат и справку с фактами. Это не повод считать результат недостоверным, но повод воспринимать цифры и выводы как предварительные, требующие публикации полного исследования.
Риски и подводные камни
Тот же механизм работает в обратную сторону: собственная более ранняя работа авторов показала, что похожий диалог с моделью способен убеждать людей в теориях заговора, а не только разубеждать, и для новых, ещё не устоявшихся нарративов это прямо названо риском злоупотребления. Неавторизованный эксперимент Цюрихского университета на Reddit уже показал этот механизм в действии против людей. Диалог о Кирке при этом не повлиял на поддержку политического насилия, то есть снижение веры в конкретную конспирологию не равно смене политических взглядов. И наконец, подход по определению не годится для случаев, когда версия о заговоре или сокрытии информации оказывается правдой.