AI si o vědě vymýšlí jako bulvár, varuje studie

Většina chatbotů nedokáže shrnout vědecké studie, aniž by zkreslovala výsledky. Nejčastěji přehání a jen těžko se jí toto chování dá vymluvit. Problém je podle autorů nové studie složitější, než se zdá. Zejména proto, že čím novější verze AI, tím hůř si vedly. A navíc, když se vědci pokoušeli ovlivňovat chatboty k větší přesnosti, dosáhli tím pravého opaku.

Podle studie mezinárodního vědeckého týmu Uweho Peterse poskytují velké jazykové modely, jako je například ChatGPT a DeepSeek, při shrnutí vědeckých studií nepřesné závěry až v 73 procentech případů.

Studie hodnotila, jak přesně deset předních velkých jazykových modelů – včetně ChatGPT, DeepSeek, Claude a LLaMA – shrnuje abstrakty a plné texty článků z nejlepších vědeckých a lékařských časopisů, jako jsou například Nature, Science a The Lancet. Vědci testovali tyto AI po dobu jednoho roku a shromáždili celkem 4900 souhrnů vytvořených pomocí modelů, které se běžně označují za umělou inteligenci (AI).

Bulvární a neoblomné

Šest z deseti modelů systematicky zveličovalo tvrzení obsažená v původních textech. Podle autorů často nenápadným, ale o to působivějším způsobem: například měnilo opatrná tvrzení v minulém čase na rozsáhlejší verzi v přítomném čase. Kupříkladu poznámku „léčba byla v této studii účinná“ si AI vyložila jako „léčba je účinná“. Tyto změny mohou čtenáře uvést v omyl, že zjištění platí mnohem šířeji, než je tomu ve skutečnosti.

Podobné chování je často spojené s bulvárním tiskem, který výsledky výzkumů přehání, ale mnohdy se mu nevyhne ani seriózní komunikace vědy v mainstreamových médiích. Vědci mají se zjednodušujícími vyjádřeními dlouhodobě problém. Zveličování nemusí být u novinářů snahou šokovat nebo přehánět, někdy jde o vedlejší produkt snahy předat složitou informaci laické veřejnosti v co možná nejpochopitelnější formě.

Pozoruhodné podle autorů studie je, že vědci nebyli schopní přimět jazykové modely k tomu, aby své postoje korigovaly. Když chatboty výslovně vyzvali, aby se vyhnuly výše popsaným nepřesnostem, nastal pravý opak: modely vytvářely příliš zobecněné závěry dvakrát častěji, než když dostaly jednoduchou žádost o shrnutí.

„Tento efekt je znepokojivý,“ řekl Peters. „Studenti, vědci i politici se mohou domnívat, že pokud požádají ChatGPT, aby se vyhnul nepřesnostem, získají spolehlivější shrnutí. Naše výsledky ale dokazují opak,“ dodal autor výzkumu.

Čím novější, tím horší

Studie také přímo porovnala shrnutí stejných článků generované chatbotem a napsané člověkem. Chatboti téměř pětkrát častěji než jejich lidské protějšky vytvářeli rozsáhlá zobecnění. „Znepokojující také je,“ řekl Peters, „že novější modely umělé inteligence, jako ChatGPT-4o a DeepSeek, si vedly hůře než starší modely.“

Jedním z možných vysvětlení je, že se AI modely učí na nevhodných datech. Tedy právě například na přehánění bulvárního nebo nekvalitního popularizačního tisku, který má potenciál značného šíření na internetu a snadno se tak dostane i do tréninkových dat AI.

Nejpřesnější byl mezi testovanými modely Claude. Pro lepší výsledky autoři práce doporučují také nastavit chatbotům nižší „teplotu“, což je parametr určující kreativitu.

„Pokud chceme, aby umělá inteligence podporovala vědeckou gramotnost, a ne ji podkopávala,“ dodal Peters, „potřebujeme větší ostražitost a testování těchto systémů v kontextu vědecké komunikace.“

Výběr redakce

Aktuálně z rubriky Věda

Společnost Anthropic začala provozovat AI biolaboratoř. Chce dělat vědu bez vědců

Americká společnost Anthropic, která patří mezi hlavní hráče v oblasti umělé inteligence (AI), začala provozovat biologickou laboratoř. Firma tak rozšiřuje své ambice z AI do světa farmaceutického výzkumu. Informovala o tom agentura Reuters s odvoláním na představitele podniku a zdroje obeznámené se situací, sama firma o laboratoři původně sama neinformovala.
před 2 hhodinami

Tyranosauři měli v podstatě stejnou tělesnou teplotu jako lidé

Je možná nepředstavitelné, že by člověk mohl mít něco společného s Tyrannosaurem rexem – predátorem, který žil před desítkami milionů let. Přesto mají tyto dva druhy jednu věc společnou – tělesnou teplotu. Uvádějí to vědci na základě výzkumu skloviny tyranosauřích zubů.
před 4 hhodinami

Experimentální terapie zachránila v USA život chlapci s pokročilou rakovinou jater

Genetická úprava vlastních imunitních buněk patří mezi nejmodernější lékařské metody. Přes její novost i experimentální status přináší spoustu úspěchů. Teď oznámili další pokrok američtí pediatři.
19. 9. 2026

Vědci objevili nový druh kočky. Měří půl metru a žije v Bolívii

Před deseti lety zavolali bolivijské bioložce Paole Nogales-Ascarrunzové z jedné rezervace. Oznámili jí, že našli opravdu divnou kočku, kterou původně ještě jako kotě našel místní muž a myslel si, že je to obyčejná kočka domácí. Když si uvědomil, že je to divoká šelma, informoval úřady. Vědci, kteří tvora zkoumali, ho teď popsali jako dosud neznámý druh kočkovité šelmy.
18. 9. 2026

Severokorejské jaderné testy probudily spící seismologické zlomy

Vědci ze tří čínských univerzit popsali, že Severní Korea způsobila svými podzemními testy atomových zbraní nečekaně silné dopady. Otřesy nepřestávají dodnes, a to přesto, že se poslední taková zkouška odehrála už roku 2017.
18. 9. 2026

Vědci v Česku poprvé chytili největšího netopýra Evropy

Česká zoologická společnost oznámila, že se jejím vědcům podařilo odchytit netopýra obrovského. O jeho občasném výskytu na českém území sice věděli už řadu let, ale snaha o přímé pozorování byla nesmírně složitá. Tento druh může mít rozpětí křídel až půl metru.
18. 9. 2026

El Niño dál zesiluje. Letos je jiné

El Niño roku 2026 patří mezi ty nejsilnější v dějinách pozorování. Navíc se ale rozvíjí v mnohem teplejším světě, než byl ten při minulých extrémních epizodách tohoto jevu. Vědci předpokládají, že také jeho dopady proto mohou být letos velmi odlišné.
18. 9. 2026

Tajné náklady a rušení družic. Vesmírné zbrojní závody sílí

Sdělení Spojených států ohledně rozmístění zbraní na oběžné dráze odstartovalo novou éru militarizace vesmíru, míní experti. Nečekaný krok podle nich ukazuje, že závody ve zbrojení zrychlují. USA mají nejspíš v kosmu systémy elektronického boje, protože kinetické zbraně za sebou zanechávají nebezpečný odpad. Washington chce vyslat vzkaz Rusku a Číně, která ve velkém modernizuje své síly.
18. 9. 2026

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.