Umělá inteligence s falešnou osobností snadno prošla Turingovým testem lidskosti

V pokusu měli lidé, kteří současně komunikovali s umělou inteligencí (AI) a člověkem, říci, koho pokládají za stroj, a koho za lidskou bytost. Speciálně zaúkolovaný chatbot si vytvořil umělou osobnost, která byla důvěryhodnější než člověk.

Úkol zněl jednoduše. Lidé přes textový chat vedli dva rozhovory. Jeden s člověkem, druhý s umělou inteligencí. Testovaný měl vybrat, koho z diskuzních partnerů považuje za lidskou bytost, a koho za stroj. V tomto experimentu, který se označuje jako Turingův test, umělé bytosti ty lidské porazily. Dokázaly totiž přesvědčit, že jsou lidmi víc než opravdoví lidé.

Ve zdání lidskosti vyhrál model GPT-4.5, který dostal zadání, aby předstíral, že je poněkud sociálně neobratným mladým mužem, který rád v komunikaci používá slang. Tuto falešnou osobnost považovalo za reálného člověka 73 procent zkoumaných osob, což znamená, že se tato AI vydávala za člověka přesvědčivěji než člověk.

Podle magazínu Psychology Today to odhaluje, jak nesmírně zranitelný je člověk vůči podobným manipulacím. V době, kdy procházejí AI dramaticky rychlým vývojem (který se podle řady expertů ještě zrychlí, až začnou AI vylepšovat samy sebe), to pokládá řadu znepokojivých otázek. Jak konstatuje výše uvedený časopis: „Nešlo o selhání detekce umělé inteligence. Byl to triumf umělé empatie.“

Hra na člověka má vítěze: stroj

Výzkum je dílem vědců z Kalifornské univerzity v San Diegu. Ti vloni nechali proběhnout více než tisícovku takových třístranných rozhovorů. Otestovali v nich čtyři pokročilé modely AI, přičemž opravdu s přehledem lidi porazil jen jediný, právě GPT-4.5. Vědci ho vyzkoušeli ve dvou variantách, v jedné neměl nastavenou žádnou osobnost, ve druhé mu pomohli vytvořit falešného mladíka: ten občas dělal chyby, choval se rozpačitě, používal neformální slang a snažil se být šarmantní. Zatímco obecný model lidé dokázali odhalit relativně spolehlivě, u toho s „osobností“ selhávali.

Základní model dokázal přesvědčit o své lidskosti ve 36 procentech, „nesmělý mládenec“ to dokázal v 76 procentech. Testující lidé se přitom podle studie pídili právě po „lidskosti“ objektu na druhé straně obrazovky. Jen málokdy se ptali na logické nebo faktické otázky, netestovali schopnost uvažování, věnovali pozornost emocím ve vyjadřování, hodně dali právě na drobné chyby v komunikaci, jakými jsou nespisovnost nebo zadrhávání se.

Nejčastějšími argumenty, proč zvolili, co zvolili, byly „tenhle působil opravdověji“ a „mluvili přirozeněji“. „Často se spoléhali na jazykový styl, neformální jazyk nebo tón,“ shrnuli to autoři studie.

Kolaps rozlišování

Autoři experimentu tak dokázali během pár minut vytvořit falešnou osobnost, která dokázala ovlivnit i lidi, kteří byli varováni, že mohou čelit AI. Ani tak nedokázali umělého podvodníka odhalit. O něco úspěšnější než většina byli v experimentu lidé, kteří studovali psychologii.

„Tato studie neukázala jen to, že nás GPT-4.5 může oklamat. Ukázala, že se necháme oklamat snadněji, než si myslíme,“ zdůrazňuje Psychology Today. „Turingův test se obrátil: Turingův test už není testem strojů, ale nás samotných. A my stále častěji selháváme. Protože už nehodnotíme lidskost na základě kognitivní podstaty. Hodnotíme ji na základě toho, jak se při ní cítíme. A velké jazykové modely ho dokáží využít s neuvěřitelnou přesností,“ dodává zmíněný článek.

Jiný pohled

Takzvané umělé inteligence a programy schopné konverzace porazily člověka už mnohokrát. Poprvé to přesvědčivě dokázal program jménem Eugene Goostman už roku 2014. A podobnými triky, jako to dokázal nyní GPT-4.5: tedy předstíráním zapomětlivosti, zdánlivým snižováním vlastních schopností a jakousi roztržitostí při diskuzi.

Ve skutečnosti byla základní verze GPT-4.5 méně úspěšná než „prababička“ chatbotů ELIZA, která dokázala o své lidskosti přesvědčit už v šedesátých letech dvacátého století pomocí několika velmi primitivních diskuzních triků – například na otázku odpovídal vlastní otázkou odvozenou z té původní.

Výběr redakce

Aktuálně z rubriky Věda

Mnohým AI chybí dostatečná opatření při dotazech vztažených k terorismu, varuje zpráva

Mnoho modelů umělé inteligence (AI) nemá dostatečné bezpečnostní mechanismy proti žádostem o „pomoc při teroristické operaci“, uvádí iniciativa Tech Against Terrorism v páteční zprávě.
před 1 hhodinou

Za padesát let zmizely tři čtvrtiny volně žijících obratlovců

Populace volně žijících obratlovců klesly v letech 1970 až 2022 v průměru o 73 procent. Největšími hrozbami pro tyto živočichy jsou ztráta a degradace stanovišť, nadměrné využívání přírodních zdrojů, klimatická změna, znečištění, invazní druhy nebo nemoci. Nejhůře jsou na tom sladkovodní populace živočichů, které poklesly průměrně o 85 procent. Vyplývá to ze Zprávy o stavu planety 2026 (Living Planet Report).
před 4 hhodinami

Emise skleníkových plynů za poslední dekádu měly dopad na sílu veder v Evropě, ukazuje studie

Když Evropu zasáhne mimořádná vlna veder, dokážou klimatologové poměrně dobře stanovit, jakou roli v ní sehrála člověkem způsobená změna klimatu. Nedávno publikovaná studie si ale klade mnohem složitější otázku – dá se v konkrétní vlně veder rozeznat vliv části skleníkových plynů, konkrétně těch, které lidstvo vypustilo teprve během posledních deseti let?
před 7 hhodinami

AI vyřešila stovky matematických problémů, tvrdí OpenAI. Vědci protestují

Společnost OpenAI zaměřená na výzkum a vývoj umělé inteligence (AI) zveřejnila rozsáhlou sbírku matematických výpočtů, které vytvořil její nový interní model. Podle deníku The New York Times (NYT) výsledky na jednu stranu odhalují, čeho jsou nejpokročilejší modely AI schopny, ale vyvolávají i otázku, do jaké míry se výsledky opírají o práci skutečných matematiků. Překotný vývoj AI také vyvolává obavy, že firmy technologii vyvíjejí rychleji, než se změně dokáže přizpůsobit akademické prostředí.
včera v 17:30‌‌

Rakovina dutiny ústní zabije ročně stovky Čechů. Člověk ji může odhalit sám, radí stomatolog

Stovky lidí ročně zbytečně zemřou na rakovinu dutiny ústní, hlavně proto, že se s touto diagnózou dostanou k lékaři pozdě. Ve skutečnosti mohou ale hodně udělat sami, tento nádor se dá totiž odhalit i pomocí samovyšetření. Včasný záchyt je pro toto zhoubné onemocnění klíčový, říká v rozhovoru pro ČT24 přednosta Stomatologické kliniky FN Plzeň Lukáš Hauer.
včera v 16:26‌‌

Větrné elektrárny mohou ochlazovat mořskou hladinu, ukázal výzkum

Spočítat dopady větrných elektráren na okolí není úplně snadné – zejména na moři, kde existuje spousta nejrůznějších vlivů, jejichž dopady komplikují vyhodnocení. Teď přišli s kvalifikovanými odhady experti ze Skotska.
včera v 13:12‌‌

Zemřela Margaret Hamiltonová, která vyvíjela programy pro NASA

Ve věku devadesáti let zemřela americká softwarová inženýrka Margaret Hamiltonová, která vedla tým, jenž vyvíjel letový software pro program Apollo amerického Národního úřadu pro letectví a vesmír (NASA). Informoval o tom její někdejší zaměstnavatel, Massachusettský technický institut (MIT).
včera v 12:13‌‌

Největší soukromá archeologická společnost na světě končí, stovky vědců jsou bez práce

„Archeologie jako byznys s růstovou strategií“ – takový byl záměr americké soukromé společnosti Chronicle Heritage, která zaměstnávala stovky archeologů, antropologů a paleontologů. Na začátku října přestala fungovat, možná i kvůli obavám z budoucího nedostatku financí.
včera v 11:08‌‌

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.