AI si o vědě vymýšlí jako bulvár, varuje studie

Většina chatbotů nedokáže shrnout vědecké studie, aniž by zkreslovala výsledky. Nejčastěji přehání a jen těžko se jí toto chování dá vymluvit. Problém je podle autorů nové studie složitější, než se zdá. Zejména proto, že čím novější verze AI, tím hůř si vedly. A navíc, když se vědci pokoušeli ovlivňovat chatboty k větší přesnosti, dosáhli tím pravého opaku.

Podle studie mezinárodního vědeckého týmu Uweho Peterse poskytují velké jazykové modely, jako je například ChatGPT a DeepSeek, při shrnutí vědeckých studií nepřesné závěry až v 73 procentech případů.

Studie hodnotila, jak přesně deset předních velkých jazykových modelů – včetně ChatGPT, DeepSeek, Claude a LLaMA – shrnuje abstrakty a plné texty článků z nejlepších vědeckých a lékařských časopisů, jako jsou například Nature, Science a The Lancet. Vědci testovali tyto AI po dobu jednoho roku a shromáždili celkem 4900 souhrnů vytvořených pomocí modelů, které se běžně označují za umělou inteligenci (AI).

Bulvární a neoblomné

Šest z deseti modelů systematicky zveličovalo tvrzení obsažená v původních textech. Podle autorů často nenápadným, ale o to působivějším způsobem: například měnilo opatrná tvrzení v minulém čase na rozsáhlejší verzi v přítomném čase. Kupříkladu poznámku „léčba byla v této studii účinná“ si AI vyložila jako „léčba je účinná“. Tyto změny mohou čtenáře uvést v omyl, že zjištění platí mnohem šířeji, než je tomu ve skutečnosti.

Podobné chování je často spojené s bulvárním tiskem, který výsledky výzkumů přehání, ale mnohdy se mu nevyhne ani seriózní komunikace vědy v mainstreamových médiích. Vědci mají se zjednodušujícími vyjádřeními dlouhodobě problém. Zveličování nemusí být u novinářů snahou šokovat nebo přehánět, někdy jde o vedlejší produkt snahy předat složitou informaci laické veřejnosti v co možná nejpochopitelnější formě.

Pozoruhodné podle autorů studie je, že vědci nebyli schopní přimět jazykové modely k tomu, aby své postoje korigovaly. Když chatboty výslovně vyzvali, aby se vyhnuly výše popsaným nepřesnostem, nastal pravý opak: modely vytvářely příliš zobecněné závěry dvakrát častěji, než když dostaly jednoduchou žádost o shrnutí.

„Tento efekt je znepokojivý,“ řekl Peters. „Studenti, vědci i politici se mohou domnívat, že pokud požádají ChatGPT, aby se vyhnul nepřesnostem, získají spolehlivější shrnutí. Naše výsledky ale dokazují opak,“ dodal autor výzkumu.

Čím novější, tím horší

Studie také přímo porovnala shrnutí stejných článků generované chatbotem a napsané člověkem. Chatboti téměř pětkrát častěji než jejich lidské protějšky vytvářeli rozsáhlá zobecnění. „Znepokojující také je,“ řekl Peters, „že novější modely umělé inteligence, jako ChatGPT-4o a DeepSeek, si vedly hůře než starší modely.“

Jedním z možných vysvětlení je, že se AI modely učí na nevhodných datech. Tedy právě například na přehánění bulvárního nebo nekvalitního popularizačního tisku, který má potenciál značného šíření na internetu a snadno se tak dostane i do tréninkových dat AI.

Nejpřesnější byl mezi testovanými modely Claude. Pro lepší výsledky autoři práce doporučují také nastavit chatbotům nižší „teplotu“, což je parametr určující kreativitu.

„Pokud chceme, aby umělá inteligence podporovala vědeckou gramotnost, a ne ji podkopávala,“ dodal Peters, „potřebujeme větší ostražitost a testování těchto systémů v kontextu vědecké komunikace.“

Výběr redakce

Aktuálně z rubriky Věda

Míchají i fermentují. Bioboti z Brna by mohli pomáhat vařit pivo

Vědci z brněnského institutu CEITEC VUT vyvinuli mikroskopické roboty, kteří by v budoucnu mohli zrychlit výrobu piva i zjednodušit kontrolu kvality potravin. Jejich magneticky ovládaní bioboti totiž dokážou během kvašení sami promíchávat kapalinu, urychlovat fermentaci a po dokončení procesu se navíc sami oddělit od výsledného produktu. Výsledky vydal tým Martina Pumery v časopise ACS Nano.
před 10 hhodinami

Pyramidy přečkaly čtyři tisíce let zemětřesení. Vědci vysvětlili proč

Ani relativně silná zemětřesení z tohoto týdne nedokázala nijak poškodit egyptské pyramidy. Jejich odolnost vůči těmto ničivým jevům je nečekané silná, popsala nová studie.
včera v 09:00
Doporučujeme

AI poprvé vytvořila funkční viry. Vědci varují i uklidňují

Americkým bioinženýrům se podařilo poprvé naučit pokročilý model umělé inteligence (AI), aby navrhoval viry, které by se daly využít v medicíně. Úspěch ale vyvolává i kritiku, protože podobným způsobem by se daly vytvářet také viry schopné ohrozit rostliny, zvířata i lidi.
7. 8. 2026
Doporučujeme

Virtuální realita mění medicínu. Lékaři si otestují každý řez, říká český expert

Moderní technologie vstupují v současné době do medicíny rychleji než kdy dřív. V oboru chirurgie jater se kombinuje dokonce několik hi-tech přístupů současně: od umělé inteligence, přes virtuální realitu, až po augmentové vnímání světa. V pražském IKEMu má tuto technologickou revoluci na starost David Sibřina.
7. 8. 2026

V Kongu hrozí mutace eboly, obávají se virologové

Virus eboly, který v Kongu způsobuje jednu z nejhorších epidemií v historii, by mohl mutovat, varují zdravotníci. Afričtí odborníci proto plánují výrazně rozšířit zásah proti nákaze, včetně vyhledávání pacientů přímo v domácnostech. Počet potvrzených případů už překročil čtyři tisíce a podle úřadů jde o druhou největší epidemii eboly v historii.
7. 8. 2026

Pobyt u vodních ploch zvyšuje duševní pohodu, ukázala mezinárodní studie

Pobyt u vody prospívá duševní pohodě, obzvlášť když se člověk cítí bezpečně a do vody také vstoupí. Vyplývá to z mezinárodní studie, která zkoumala více než 17 tisíc návštěv vodních ploch v devatenácti zemích.
7. 8. 2026

Od Moravy po Maďarsko. Srpnová horká vlna se zapíše do dějin klimatologie

Ve střední Evropě zvolna končí další mimořádně horké období. Těžiště vlny veder se na začátku srpna přesunulo především nad Moravu, Maďarsko, Slovensko a východní Rakousko. Odpolední teploty na rozsáhlém území překračovaly 35 stupňů Celsia a lokálně se dostávaly až ke čtyřicítce. Ještě významnější jsou ale velmi teplé noci, během kterých teplota nejen v centrech měst, ale i ve vyvýšených polohách zůstávala výrazně nad dvaceti stupni. Výsledkem jsou opět nové teplotní rekordy – včetně těch absolutních.
6. 8. 2026

Video„A pak ticho,“ popisovali přeživší po svržení atomové bomby na Hirošimu

V jediné sekundě se změnil svět. Svržení atomové bomby na Hirošimu. A pak ticho – tak ten moment popisují přeživší. Co všechno americký prezident Harry S. Truman o jaderné bombě nevěděl? Co ho překvapilo, když viděl fotografie zničené Hirošimy? Proč nakonec nenařídil útok na Kjóto? A který útok Američanů na japonské cíle byl ve skutečnosti nejničivější, pokud jde o počet obětí? Po 81 letech se dozvídáme mnohem víc o tom, co se odehrávalo na konci druhé světové války, když se Američané rozhodovali bombu na Hirošimu svrhnout. O samotném okamžiku, jeho přípravách i důsledcích pro americkou, japonskou – a nepřímo i německou – společnost mluví Jaroslav Zoula, redaktor vědecké redakce České televize a autor podcastových sérií Úsvit atomového věku a Černobyl: stín atomového věku.
6. 8. 2026

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.