Umělé inteligence se zlepšují ve lhaní. Může to být nebezpečné, varují experti

V italské lidové pohádce se dřevěný, ale inteligentní panáček Pinocchio vyznačoval tím, že byl velmi špatný lhář. Pokaždé, když řekl nějakou nepravdu, o něco mu povyrostl nos. Dnešní umělé inteligence takový problém nemají. Za několik posledních let dosáhly obrovského pokroku ve všech oblastech. Včetně právě lhaní, upozornila nová studie.

Analýza vědců z Massachusettského technologického institutu (MIT) popsala případy, kdy systémy umělé inteligence podváděly své lidské oponenty, dokázaly blafovat a úspěšně předstírat, že jsou lidé. Jeden zkoumaný chatbot dokonce změnil své chování během bezpečnostních testů, což podle autorů zvyšuje riziko, že AI budou umět lidi přelstít poměrně snadno.

„S tím, jak budou schopnosti systémů AI lhát stále dokonalejší, bude nebezpečí, které představují pro společnost, stále vážnější,“ komentoval výsledky zkoumání autor studie Peter Park.

Lež jako cesta k vítězství

Park se rozhodl prověřit schopnosti AI lhát poté, co se dozvěděl o tom, jak je úspěšná ve stolní hře Diplomacy. Umělá inteligence Cicero od společnosti Meta se naučila, jak v ní porazit většinu lidských soupeřů – a protože je v této dobyvatelské strategii zapotřebí umět lhát a podvádět, musela si to osvojit.

AI to dokázala, přestože byla navržená tak, aby byla „převážně čestná“ a nikdy nepodrazila své lidské spoluhráče. Jenže k vítězství to nestačilo – a tak lhala. Park a jeho kolegové prošli veřejně dostupná data o hrách Cicera proti lidem a našli v nich několik případů, kdy umělá inteligence promyšleně lhala, pletichařila s hráči proti jiným, a dokonce maskovala svou AI povahu, když se jinému hráči omlouvala za zpoždění slovy, že „telefonovala se svou přítelkyní“. „Zjistili jsme, že umělá inteligence Meta se naučila mistrovsky podvádět,“ potvrzuje Park.

Jeho tým pak popsal podobné schopnosti i u jiných systémů AI, například u programu pro poker Texas Hold 'em, který dokázal blafovat proti profesionálním lidským hráčům. V jedné studii si umělé inteligence v digitálním simulátoru dokonce „hrály na mrtvé“, aby tak oklamaly test sestavený k eliminaci systémů umělé inteligence, které se vyvinuly k rychlému replikování. Po skončení testování obnovily svou původní činnost. To je podle autorů výjimečně znepokojivé, protože to ukazuje, jak složité mohou už brzy být snahy umělé inteligence kontrolovat.

Podle Parka to může mít zásadní důsledky. „To, že se systém umělé inteligence považuje za bezpečný v testovacím prostředí, ještě neznamená, že je bezpečný i potom v ostrém provozu. Může se stát, že v testovacím prostředí jenom předstírá, že je bezpečný,“ upozornil Park.

Vědci tyto nové informace zveřejnili v odborném žurnálu Patterns. Současně v článku vyzvali vlády, aby navrhly zákony o bezpečnosti umělé inteligence, které by se věnovaly právě problému podvodů ze stran AI. Varují mimo jiné před tím, že pokud tyto systémy dokáží svou schopnost lhát ještě více zdokonalit, mohli by nad nimi lidé snadno ztratit kontrolu.


Výběr redakce

Aktuálně z rubriky Věda

Mnohým AI chybí dostatečná opatření při dotazech vztažených k terorismu, varuje zpráva

Mnoho modelů umělé inteligence (AI) nemá dostatečné bezpečnostní mechanismy proti žádostem o „pomoc při teroristické operaci“, uvádí iniciativa Tech Against Terrorism v páteční zprávě.
před 9 hhodinami

Za padesát let zmizely tři čtvrtiny volně žijících obratlovců

Populace volně žijících obratlovců klesly v letech 1970 až 2022 v průměru o 73 procent. Největšími hrozbami pro tyto živočichy jsou ztráta a degradace stanovišť, nadměrné využívání přírodních zdrojů, klimatická změna, znečištění, invazní druhy nebo nemoci. Nejhůře jsou na tom sladkovodní populace živočichů, které poklesly průměrně o 85 procent. Vyplývá to ze Zprávy o stavu planety 2026 (Living Planet Report).
před 12 hhodinami

Emise skleníkových plynů za poslední dekádu měly dopad na sílu veder v Evropě, ukazuje studie

Když Evropu zasáhne mimořádná vlna veder, dokážou klimatologové poměrně dobře stanovit, jakou roli v ní sehrála člověkem způsobená změna klimatu. Nedávno publikovaná studie si ale klade mnohem složitější otázku – dá se v konkrétní vlně veder rozeznat vliv části skleníkových plynů, konkrétně těch, které lidstvo vypustilo teprve během posledních deseti let?
před 16 hhodinami

AI vyřešila stovky matematických problémů, tvrdí OpenAI. Vědci protestují

Společnost OpenAI zaměřená na výzkum a vývoj umělé inteligence (AI) zveřejnila rozsáhlou sbírku matematických výpočtů, které vytvořil její nový interní model. Podle deníku The New York Times (NYT) výsledky na jednu stranu odhalují, čeho jsou nejpokročilejší modely AI schopny, ale vyvolávají i otázku, do jaké míry se výsledky opírají o práci skutečných matematiků. Překotný vývoj AI také vyvolává obavy, že firmy technologii vyvíjejí rychleji, než se změně dokáže přizpůsobit akademické prostředí.
8. 10. 2026‌‌

Rakovina dutiny ústní zabije ročně stovky Čechů. Člověk ji může odhalit sám, radí stomatolog

Stovky lidí ročně zbytečně zemřou na rakovinu dutiny ústní, hlavně proto, že se s touto diagnózou dostanou k lékaři pozdě. Ve skutečnosti mohou ale hodně udělat sami, tento nádor se dá totiž odhalit i pomocí samovyšetření. Včasný záchyt je pro toto zhoubné onemocnění klíčový, říká v rozhovoru pro ČT24 přednosta Stomatologické kliniky FN Plzeň Lukáš Hauer.
8. 10. 2026‌‌

Větrné elektrárny mohou ochlazovat mořskou hladinu, ukázal výzkum

Spočítat dopady větrných elektráren na okolí není úplně snadné – zejména na moři, kde existuje spousta nejrůznějších vlivů, jejichž dopady komplikují vyhodnocení. Teď přišli s kvalifikovanými odhady experti ze Skotska.
8. 10. 2026‌‌

Zemřela Margaret Hamiltonová, která vyvíjela programy pro NASA

Ve věku devadesáti let zemřela americká softwarová inženýrka Margaret Hamiltonová, která vedla tým, jenž vyvíjel letový software pro program Apollo amerického Národního úřadu pro letectví a vesmír (NASA). Informoval o tom její někdejší zaměstnavatel, Massachusettský technický institut (MIT).
8. 10. 2026‌‌

Největší soukromá archeologická společnost na světě končí, stovky vědců jsou bez práce

„Archeologie jako byznys s růstovou strategií“ – takový byl záměr americké soukromé společnosti Chronicle Heritage, která zaměstnávala stovky archeologů, antropologů a paleontologů. Na začátku října přestala fungovat, možná i kvůli obavám z budoucího nedostatku financí.
8. 10. 2026‌‌

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.