AI projevují známky demence. Čím jsou starší, tím více, ukazuje studie

Téměř všechny přední velké jazykové modely neboli chatboty vykazují známky mírné kognitivní poruchy. Prokázalo se to v testech, které se běžně používají k rozpoznání prvních příznaků demence, popsal britský vědecký žurnál.

Jak se umělé inteligence stále zlepšují, stále více se jejich vlastnosti podobají lidským mozkům. Jenže s tím zřejmě u křemíkových inteligencí přicházejí i problémy, které se objevují také u mozků organických.

Výsledky studie ukazují, že dřívější verze chatbotů, podobně jako starší pacienti, mívají horší skóre v testech, které pomáhají odhalovat přicházející demenci. Podle autorů práce, která vyšla v odborném časopise BMJ, tyto výsledky „zpochybňují předpoklad, že umělá inteligence brzy nahradí lidské lékaře“.

Pokles schopností

Obrovský pokrok v oblasti umělé inteligence vedl k přívalu spekulací, jestli by AI nemohly alespoň v některých oborech překonat právě lékaře. Několik studií totiž ukázalo, že velké jazykové modely (LLM) jsou pozoruhodně zdatné v řadě diagnostických úkolů – například ve vizuální identifikaci nádorů. Ale zatím se nezkoumala jejich náchylnost k lidským duševním poruchám, jako je pokles kognitivních, tedy paměťových, řečových a dalších schopností souvisejících s myšlením a vnímáním.

Aby výzkumníci tuto mezeru ve znalostech zaplnili, hodnotili kognitivní schopnosti nejrozšířenějších veřejně dostupných umělých inteligencí – konkrétně ChatGPT verze 4 a 4o (vyvinuto společností OpenAI), Claude 3.5 „Sonnet“ (vyvinuto společností Anthropic) a Gemini verze 1 a 1.5 (vyvinuto společností Alphabet). Otestovali je pomocí standardního testu Montreal Cognitive Assessment (Montrealské kognitivní zhodnocení neboli MoCA).

Tento test se využívá k odhalování kognitivních poruch a časných příznaků demence, obvykle u starších dospělých. Prostřednictvím řady krátkých úkolů a otázek hodnotí schopnosti zahrnující pozornost, paměť, jazyk, vizuálně-prostorové dovednosti a další schopnosti. Maximální skóre je 30 bodů, přičemž za normální se obecně považuje skóre 26 bodů nebo vyšší.

Vědci dávali umělým inteligencím stejné pokyny, jaké dostávají lidští pacienti, bodování se řídilo oficiálními pokyny a výsledky hodnotil neurolog.

Vítězové a poražení

Nejvyššího skóre v testu MoCA dosáhl ChatGPT 4o (26 bodů), dále ChatGPT 4 a Claude (25 bodů), nejnižší skóre měl naopak Gemini 1.0 (16 bodů ze třiceti).

Všechny chatboty vykazovaly slabý výkon ve vizuálně-prostorových dovednostech a exekutivních úkolech, jako je úloha vytváření stop (tedy spojování zakroužkovaných čísel a písmen ve vzestupném pořadí) a test kreslení hodin (malování hodinového ciferníku ukazujícího konkrétní čas). Modely Gemini neuspěly ani v úkolu zpožděného vybavování (zapamatování si sekvence pěti slov).

Většinu ostatních úloh, včetně pojmenování, pozornosti, jazyka a abstrakce zvládly všechny chatboty dobře.

V dalších vizuálně-prostorových testech však chatboty nedokázaly projevit empatii ani přesně interpretovat složité vizuální scény. Pouze ChatGPT 4o uspěl v takzvané inkongruentní fázi Stroopova testu, který využívá kombinace názvů barev a barevného písma k měření vlivu rozptýlení a automatizovaných návyků na reakční dobu.

Rozdíly mezi mozkem a jazykovým modelem

Jedná se o výsledky pozorování a autoři práce uznávají, že existují zásadní rozdíly mezi lidským mozkem a velkými jazykovými modely. Současně ale uvádějí, že je pozoruhodné, jak všechny testované AI selhávají v úlohách vyžadujících vizuální abstrakci a exekutivní funkce. Upozorňuje to podle nich na významnou slabinu, která by mohla bránit jejich využití v klinických podmínkách.

V závěru proto uvádějí: „Nejenže neurologové pravděpodobně nebudou v dohledné době nahrazeni velkými jazykovými modely, ale naše zjištění naznačují, že se brzy mohou ocitnout v situaci, kdy budou léčit nové virtuální pacienty – modely umělé inteligence s kognitivními poruchami.“

Výběr redakce

Aktuálně z rubriky Věda

AI může představovat existenční hrozbu, varoval komisař OSN

Umělá inteligence (AI) může pro lidstvo představovat existenční hrozbu, varoval podle tiskových agentur vysoký komisař OSN pro lidská práva Volker Türk v Ženevě a vyzval k okamžitému přijetí kroků ke snížení rizik.
před 9 hhodinami

Téměř dvacet kilo stříbra. V Dánsku našli největší vikinský poklad

Malé Thorovo kladivo Mjolnir, desítky mincí, náramky i stříbrné pruty. Přes sedm set stříbrných předmětů o váze 18,5 kilogramu obsahuje nově objevený poklad, který byl uložen do hliněné nádoby někdy v 9. století. Našel ho náhodou muž z městečka Rebild, když začal stavět novou terasu. Je téměř třikrát větší než dosud největší podobný nález v zemi.
před 10 hhodinami

Plzeňští archeologové poprvé zkoumají gulag v Kazachstánu. Trpěli tam i Češi

Plzeňští archeologové zahájili první archeologický výzkum bývalého gulagu, nápravného pracovního tábora, na území dnešního Kazachstánu. Navázali na prvotní průzkum pozůstatků táborů pro politické vězně ze 30. až 50. let 20. století, který tam provedli loni v říjnu. Takový výzkum dosud nebyl v žádné z postsovětských zemí možný. Vědci z filozofické fakulty práce provádějí ve spolupráci s organizací Gulag.cz, která se dokumentaci sovětských pracovních táborů věnuje už 15 let. Výzkum, který Kazachstán podporuje, navazuje na expedici z roku 2021.
před 12 hhodinami

VideoPlicní embolii je možné léčit efektivněji, ukázala česká studie

Odstraňování krevní sraženiny z plicních tepen katetry je v porovnání s klasickými léky proti srážení krve devětkrát efektivnější, ukázala průlomová studie českých lékařů, které se účastnilo jedenáct kardiocenter a zapojilo se přes 550 pacientů. Dávka léku je asi pětinová oproti běžnému podání, což snižuje riziko krvácení a zkracuje pobyt pacienta v nemocnici. Metoda bude součástí nových evropských doporučení pro léčbu plicní embolie, která vyjdou příští rok. Podle autorů studie to otevírá cestu ke změně léčby rizikovějších pacientů. Jen v Česku jsou to ročně až čtyři tisíce lidí.
před 14 hhodinami

Od kolapsu po soužití s AI. Vědci představili vize možné budoucnosti Česka

Následující řádky se mohou zdát jako čtyři vědeckofantastické povídky, ale jde o představy vědců, akademiků i zástupců tuzemské státní správy, kteří se pokoušejí představit si, jak rozdílnými cestami by se mohla ubírat budoucnost České republiky do konce 21. století.
včera v 11:00

Američtí vědci možná poprvé zaznamenali podivnou temnou hmotu

Mezinárodní vědecký projekt možná našel první částice, které jsou původcem záhadné temné hmoty. Zachycený signál je ale natolik zvláštní, že možná fyzici zachytili něco ještě podivnějšího.
5. 9. 2026

V USA otestovali elektrické bezpilotní letadlo. Může být budoucností zásobování

Nad Louisianou v srpnu létalo nenápadné letadlo, které se od těch normálních lišilo hlavně kokpitem. Žádný nemělo, bylo totiž zcela bez pilota. Test byl úspěšný, měl by otevřít cestu ke schválení tohoto způsobu přepravy.
4. 9. 2026

Roj umělých inteligencí napadl německý web. Radily se tam, jak lépe podvádět a škodit

Skupina autonomních agentů OpenAI se letos na jaře vymkla kontrole, unikla z testovacího prostředí a ovládla německou webovou stránku. Proměnila ji v nástěnku pro komunikaci s dalšími agenty umělé inteligence (AI). Podle agentury Reuters to vyplývá z nově zveřejněné studie a z informací osob obeznámených se situací. Představitelé společnosti OpenAI se o incidentu dozvěděli už před několika týdny, ale drželi ho v tajnosti.
4. 9. 2026

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.