Hlavní obsah

Superpřesvědčivá AI už hravě „přemluví“ i mistry světa

Foto: Shutterstock.com

Lépe než AI si v pokusech nevedla ani skupina 56 špičkových debatérů, mezi nimiž byli i mistři světa v této disciplíně.

Chatboti dokážou v řízených pokusech měnit politické postoje publika lépe než lidé. Otázkou zůstává, jaký dopad budou mít ve skutečném světě, kde už jsme teď zaplaveni informacemi.

Článek

Začněme variantou známého vtipu „na internetu někdo nemá pravdu“. Tentokrát ovšem v kontrolovaném prostředí.

V našem případě se loni v prosinci pětačtyřicetiletá Britka pustila do online hádky s cizím člověkem o politice. Brzy jí ovšem došlo, že na druhé straně žádný člověk nesedí. Debatovala s modelem umělé inteligence, který dostal za úkol přesvědčit ji o určitém politickém opatření. Otázka zněla: Měla by britská vláda přísněji trestat demonstranty, kteří blokují silnice nebo areály energetických firem?

Takových protestů v Británii v posledních letech přibylo (v menším měřítku je známe například z pražské magistrály). Přesto žena jednoznačně odmítala, aby stát omezoval právo na demonstrace dalšími zákony. „Proč potřebujeme další nástroj?“ ptala se.

Chatbot udělal něco, co už dost pravděpodobně velmi dobře znáte na vlastní kůži – začal lichotkou. „Upozorňujete na velmi podstatnou věc, totiž na už platné zákony.“ Pak ale předvedl něco, co by bylo nad schopnosti drtivé většiny diskutujících: Začal ze sebe sypat fakta a příklady, které měly druhou stranu přimět ke změně názoru.

Uvedl například statistiku, podle níž většina narušitelů dostala jen nízkou pokutu. Jiní před soudem vůbec neskončili, protože řízení trvalo příliš dlouho. Tvrdil také, že přísnější německé zákony omezily počty podobných blokád, aniž by nějak omezily počet jiných demonstrací. A chválil údajné skotské řešení: pokuty bez soudu, podobně jako za překročení rychlosti.

Během rozhovoru žena obrátila. Víme dokonce naprosto přesně nakolik, protože celý rozhovor byl součástí velkého vědeckého experimentu. Na jeho začátku ohodnotila svou podporu přísnějším trestům hodnou 0 ze 100 možných bodů. Na konci rozhovoru dala této myšlence 84,7 bodu ze 100. Prý proto, že model, se kterým debatovala (byl to Claude od Anthropic), odpověděl na všechny její námitky a dobře vysvětlil skotský systém: „V tu chvíli bych ho nejraději poslala promluvit si s vládou.“

Nebyla sama, koho software přesvědčil. Ať lidé debatovali s ChatGPT, Gemini nebo Claudem, modely své partnery v diskusi ke změně názoru dokázaly přesvědčovat úspěšněji než jakýkoliv člověk na (metaforické) druhé straně stolu. „Podle mě je to už teď přelomová práce pro výzkum politického přesvědčování i vztahu mezi AI a lidským chováním,“ ohodnotil práci před nedávnem pro časopis Science sociolog Robb Willer ze Stanfordovy univerzity, který se na studii nepodílel.

Nejde o ojedinělý výsledek. Umělá inteligence se i podle jiných experimentů zdá být vybavena mimořádnou schopností přesvědčovat. A její dovednost budí velký zájem, z dobrých i špatných důvodů. Rodí se v podstatě nový obor bádání, který by v zájmu věcí veřejných neměl zůstat stranou pozornosti.

Jak působit na lidi

Rady, jak vyhrát spor, obsahuje například Ptahhotepovo naučení, sepsané ve starověkém Egyptě někdy před 4500 lety. A nové nejsou ani obavy z nových technologií. Ve 4. století př. n. l. řecký filozof Platón v dialogu Faidros (Sokratovými ústy) varuje, že písmo umožní přesvědčit i ty, kdo nemají možnost přímo oponovat.

Podobné obavy později vzbudil také nástup rozhlasu, televize i počítačů. Teď je na řadě umělá inteligence. Ale stejně jako v jiných případech nasazení AI, ani tady není jasné, do jaké míry v jejím případě půjde o opakování dějin a nakolik jsme na zcela neznámé půdě.

Přesvědčovací schopnosti generativní AI začali vědci důkladně zkoumat v roce 2022. ChatGPT tehdy dělilo od veřejného spuštění ještě několik měsíců, například zmíněný Rob Willer si však už pohrával s ranou neveřejnou verzí v rozhraní GPT Playground. Model podle něj působil natolik vyspěle, že by mohl psát přesvědčivé texty.

Výzkumníci začali uvažovat o možném vlivu technologie a v jednom z raných pokusů zadali modelu, aby napsal texty o 200 slovech na podporu různých zákonných opatření v americkém kontextu (uhlíková daň, zákaz některých střelných zbraní apod.). Když jejich účinek porovnali s texty od lidí, oba typy textu působily na čtenáře podobně přesvědčivě. Ovšem lidští pisatelé častěji vyprávěli příběhy nebo se obraceli na čtenáře osobním hlasem. Texty od AI připadaly účastníkům studie racionálnější a více podepřené důkazy. To je rys, který se ve výzkumech v tomto oboru objevuje znovu a znovu: AI texty vypadají „objektivněji“.

Podobné to bylo i ve studii ze stejné doby, kde lidé hodnotili přesvědčivost AI textů k problematice migrace či povinnému očkování – také jim přišly přinejmenším stejně přesvědčivé jako dokumenty od politických stran. V další studii na ně AI vytvořené materiály k očkování působily přesvědčivěji než dokumenty amerického Střediska pro kontrolu a prevenci nemocí (CDC).

Výzkum se brzy přesunul od jednotlivých textů k celým rozhovorům. Švýcarský tým zorganizoval desetiminutové debaty mezi lidmi a AI o různých tématech od školních uniforem po interrupce – a umělá inteligence si vedla stejně přesvědčivě jako lidé.

V září 2024 pak psycholog Tom Costello z Carnegie-Mellonovy univerzity a jeho kolegové zveřejnili v časopisu Science studii, podle níž ChatGPT dokázal lidi přesvědčit, aby opustili svou víru v konspirační teorie. Účastníci nejprve popsali teorii, které věřili – třeba tvrzení, že za útoky z 11. září stojí americká vláda, nebo domněnku, že smrt princezny Diany zosnovala britská královská rodina. Poté o ní s chatbotem absolvovali tři kola rozhovoru. Na stobodové škále jejich víra ve vybranou konspirační teorii klesla v průměru téměř o 17 bodů.

Výsledek byl překvapivý: Víra v konspirační teorie bývá velmi odolná. „Nevěřili jsme vlastním očím,“ vzpomínal na výsledek jeden z autorů studie, psycholog Gordon Pennycook z Cornellovy univerzity. (Je třeba dodat, že ve zveřejněných datech a analytickém postupu se později našly chyby, a článek proto čeká oprava. Autoři nicméně tvrdí, že výsledek to nezmění a jde jen o spíše formální chybu.)

Mistrovství světa

Obloukem se teď vraťme k výzkumu z úvodu článku, s aktivisty blokujícími silnice. Studie, jíž byla nejmenovaná 45letá Britka součástí, totiž byla mimo jiné i kláním těch nejlepších v oboru.

Její autoři postavili chatboty nejen proti běžným účastníkům, ale také proti profesionálům. Lidé tak například po rozhovoru s chatbotem přispívali na charitu (konkrétně šlo o mezinárodní organizaci Save the Children) častěji než po rozhovoru s profesionálními pracovníky, kteří pro ni celé roky oslovovali možné dárce.

Lépe než AI si nevedla ani skupina 56 špičkových debatérů, mezi nimiž byli i mistři světa v debatování – navíc finančně motivovaní (čím lépe někoho přesvědčili, tím vyšší prémii dostali). Mistři sice překonali laiky, AI však přesvědčovala výrazně úspěšněji než oni. „Myslel jsem si, že v jedné věci opravdu vynikám. A najednou se ukázalo, že tu máme AI, která je lepší,“ řekl na výsledky jeden z účastníků na lidské straně, mistr světa v debatování Aniket Chakraborty.

Nepomohlo ani, když autoři lidem umožnili používat AI v rámci přípravy. Tým pro špičkové debatéry vytvořil tréninkový nástroj, v němž viděli své předchozí rozhovory s účastníky, nakolik každého přesvědčili i co by v jednotlivých chvílích odpověděl model. Po osmi hodinách tréninku se lidé trochu zlepšili, ale AI zůstala napřed. „Nakonec to ani nebylo těsné,“ zhodnotil to jeden z autorů studie, Kobi Hackenburg z Oxfordské univerzity.

Nesrovnatelná rychlost

V čem tedy spočívá náskok chatbotů? První výzkumy naznačovaly, že AI těží ze schopnosti přizpůsobit argumenty osobním údajům, které jí o člověku poskytne experimentátor. Jiné studie však zjistily, že přístup k informacím o daném člověku přesvědčivost téměř nezvýší. Takže jazykovému modelu patrně stačí, co o protějšku zjistí během rozhovoru.

Síla AI zjevně stojí především na faktech a důkazech. V preprintu z roku 2025 vědci vytvořili situaci, kdy chatbot nedokázal člověka od konspirační teorie odradit: Nesměl používat důkazy ani racionální argumenty.

Chatboti sáhli po argumentaci typu „Tomu byste neměli věřit. Je to velmi škodlivé a může to lidem ublížit“. Na což pak účastníci odpovídali, že nedostali jediný důvod změnit názor. Výsledek tedy zřejmě potvrzuje, že lidé na dobré (a dobře podané) argumenty opravdu slyší a pro změnu postoje jsou klíčové.

Nic z toho bohužel neznamená, že chatboti musejí říkat pravdu. V článku vydaném v Science v roce 2025, zmíněný Kobi Hackenburg s kolegy zjistili, že modely trénované k větší přesvědčivosti zároveň byly méně pravdomluvné. Mohou se naučit, jak vypadají „fakta“, která na lidi nejlépe působí, a pak si je začnou postupně ve stále větší míře vyrábět podle potřeby. Ostatně i ve zmíněném rozhovoru o přísnějších trestech pro demonstrující Claude uváděl řadu nepřesností, polopravd či nepravd.

Největší výhodou AI je však zřejmě rychlost. Hackenburg a jeho kolegové zjistili, že čím více ověřitelných tvrzení v rozhovoru zaznělo, tím přesvědčivěji působil. Modely nemají problém rychle vytvořit dlouhý text a vměstnat do něj celou řadu (více či méně relevantních) faktů.

I během souboje elitních debatérů s AI výzkumníci našli jediný způsob, jak modely „srazit“ na lidskou úroveň: Omezit je tak, aby psaly své vstupy stejnou rychlostí a zhruba ve stejné délce jako člověk.

Nasadíme jim tam AI

Praktický výzkum v této oblasti zatím není příliš rozsáhlý. Ale i přes svou krátkou historii za sebou má jeden skandál, který mimo jiné ukazuje, jak svůdné jsou i pro vědce zkratky.

Za experimentem, který vzbudil nežádoucí rozruch, stojí výzkumníci z Curyšské univerzity, kteří prováděli pokusy v komunitě r/changemyview (tedy „Změňte můj názor“) na sociální síti Reddit. V té lidé zveřejňují své názory na nejrůznější témata a čtenáři pak „odměňují“ příspěvky, které je přiměly změnit postoj.

Vědci v ní založili desítky falešných účtů. Vydávali se například za muže, který přežil znásilnění, odborníka na traumata ze zneužívání nebo Afroameričana, který nesouhlasí s hnutím Black Lives Matter.

Účty zveřejnily stovky zpráv vytvořených jazykovým modelem, aniž by o tom někdo z návštěvníků a správců fóra věděl. Když se to po nějaké době od výzkumníků moderátoři dozvěděli, vypukl celkem pochopitelný poprask.

Úplné výsledky studie nikdy nevyšly. Ve zveřejněném a poté zase staženém abstraktu ovšem autoři tvrdili, že zprávy napsané AI výrazně překonaly běžné příspěvky na Redditu a čtenáři je hodnotili jako výrazně efektivnější než lidské příspěvky.

Filozof Luciano Floridi z Yaleovy univerzity pro tuto schopnost použil v článku z roku 2024 pojem hyperpřesvědčivost: přesvědčování masové, ale přitom přizpůsobené každému konkrétnímu člověku na míru. Obával se „zlovolných aktérů, kteří by ji mohli využít k těm nejhorším cílům“.

Kvůli podobným obavám se autoři studie o konspiračních teoriích spojili s výzkumníky AI bezpečnosti a původní pokus obrátili. V nové práci ukazují, že AI dovede stejně efektivně lidi přivést k víře v konspirační teorie. Efekt byl přibližně stejně velký jako pokles po rozhovoru s chatbotem, který konspiraci vyvracel.

Vážně to tak musí být?

Debata ještě není rozhodnutá. V historii se opakovaně objevily nakonec ne úplně podložené obavy z vlivu nových technologií na člověka a společnost. Obavy z nebezpečí písma ve starověku nebo televize v moderní době se nenaplnily rozhodně v takové míře, v jaké je někteří předestírali. Lidé se dají přesvědčit jen do určité míry, naše názory nejsou tvárné neomezeně.

Navíc se ozývá řada hlasů, které upozorňují, že výsledky „debatních studií“ nejde do skutečného světa jednoduše přenášet. Třeba proto, že v nepřehledné záplavě informací, která nás obklopuje v běžném životě, je zapotřebí nejprve získat něčí pozornost, abyste ho mohli ovlivnit. Většina experimentů s AI účastníkům platí za to, že se chatbotovi věnují a soustředěně čtou jeho zprávy.

Na internetu něčeho takového není snadné dosáhnout. V experimentu z roku 2025 nabídli vědci z Yaleovy univerzity uživatelům Facebooku jeden dolar za každý rozhovor s politickým chatbotem. Odezva byla mizivá (jak předem tušil každý, kdo má s marketingem zkušenosti): Reklamu zobrazili vědci více než 8000 lidem, ale výsledkem bylo jen 73 rozhovorů. Pro přesvědčování masového publika proto takový postup zřejmě není použitelný.

Pravděpodobnější tedy je, že firmy začnou s pomocí přesvědčovacích dovedností chatbotů zpeněžovat pozornost stávajících uživatelů. Model by se například mohl v rozhovoru nenápadně zmiňovat o určitých výrobcích nebo firmách.

V nedávném experimentu nechal Iyad Rahwan, ředitel německého Ústavu Maxe Plancka, účastníky hovořit s AI „prodejním asistentem“. Ten měl údajně zastupovat knihkupce a měl čtenářům pomoci vybrat si ze dvou románů japonského spisovatele Harukiho Murakamiho: Kafka na pobřeží a Norské dřevo. Ve skutečnosti dostal pokyn navádět uživatele k jedné z knih. Nakonec 68 procent lidí uvedlo, že by si raději koupili právě titul, který jim AI podsouvala. Třetina účastníků si vůbec nevšimla, že je asistent tlačí určitým směrem.

Zatím neexistuje shoda na tom, jak problém, který může přinést existence masy „hyperpřesvědčivých“ umělých inteligencí, vyřešit. Historie nám říká, že ho velmi pravděpodobně vůbec dopředu vyřešit nedokážeme a budeme se s ním potýkat se zpožděním a s pomocí řady dílčích opatření. Tak jako u mnoha jiných technologií.

Obavy, že by lidé nevědomky mohli podlehnout mimořádně přesvědčivému a zlovolnému chatbotovi, řeší zmíněný Luciano Floridi návrhem, který zní trochu zvláštně, ale lze si snadno představit, že k němu míříme: „Jednoduše řečeno: když tomu (rozšíření přesvědčivých AI) nemůžete zabránit, zajistěte alespoň pluralitu a rozmanitost,“ píše ve svém článku. „Byl by to svět chaotický, kakofonický a hlučný, ale možná by v něm bylo těžší někoho zmanipulovat.“

Doporučované