Umělá inteligence uspěla v testu pro lékařské oprávnění. Odpovídala smysluplně a inovativně

Umělá inteligence ChatGPT dosáhla dalšího milníku. Poté, co zaujala schopností smysluplně odpovídat na otázky, plnit nejrůznější kreativní úkoly a třeba i psát eseje nebo básně, nyní uspěla v testu, který se skládá pro získání lékařské licence ve Spojených státech.

Konverzační umělá inteligence ChatGPT dosáhla průměrného skóre přibližně 60 procent v testu, který je nutný pro složení lékařské licenční zkoušky v americké licenční zkoušce USMLE. Podle vědců, kteří ji tomuto úkolu vystavili, její odpovědi dávají ucelený vnitřní smysl a obsahují inovativní postřehy.

USMLE, kterou skládají studenti medicíny a lékaři, hodnotí znalosti z většiny lékařských oborů od biochemie přes diagnostické uvažování až po bioetiku. Vědecký tým vedený Victorem Tsengem z testu vyřadil několik otázek založených na obrázcích. Umělá inteligence je totiž navržená „jen“ jako jazykové rozhraní, obrazy zatím nerozeznává. Výzkumníci tedy otestovali program na 350 z 376 veřejných otázek z USMLE z června 2022.

Po odstranění neurčitých odpovědí dosáhl ChatGPT ve všech třech zkouškách USMLE skóre mezi 52,4 a 75 procenty. Hranice úspěšnosti je přitom každý rok přibližně šedesát procent. ChatGPT také u 88,9 procenta odpovědí přinesl alespoň jeden významný poznatek, tedy něco, co bylo nové a klinicky užitečné.

Autory testu překvapilo, že ChatGPT překonal výkon PubMedGPT, což je obdobný model umělé inteligence, ale specializovaný jen na lékařská témata. Ten dosáhl skóre jen 50,8 procenta ve stejném typu testu.

I když relativně malý rozsah vstupních dat omezil hloubku a rozsah analýz, autoři poznamenávají, že jejich zjištění poskytují náhled na potenciál ChatGPT pro zlepšení lékařského vzdělávání a případně i klinické praxe. Sami ho přitom už v praxi používají: sami vystaví lékařskou zprávu a umělá inteligence ji z nesrozumitelného lékařského žargonu přepíše do obyčejného, lidem srozumitelného jazyka.

„To, že program dosáhl úspěšného výsledku u této obtížné odborné zkoušky, a to bez jakéhokoli lidského posílení, představuje pozoruhodný milník ve vyspělosti klinické umělé inteligence,“ dodávají autoři.

ChatGPT je nový systém umělé inteligence (AI), který pracuje na principu velkého jazykového modelu. Jde o to, že umí předpovídat následující slovní sekvence tak, aby výsledné odpovědi dávaly lidem smysl. Tento program nabral spoustu znalostí při procesu učení, takže má všechny uložené ve své paměti a už nemusí pro správné odpovědi prohledávat internet. 

Výběr redakce

Aktuálně z rubriky Věda

Mnohým AI chybí dostatečná opatření při dotazech vztažených k terorismu, varuje zpráva

Mnoho modelů umělé inteligence (AI) nemá dostatečné bezpečnostní mechanismy proti žádostem o „pomoc při teroristické operaci“, uvádí iniciativa Tech Against Terrorism v páteční zprávě.
před 11 hhodinami

Za padesát let zmizely tři čtvrtiny volně žijících obratlovců

Populace volně žijících obratlovců klesly v letech 1970 až 2022 v průměru o 73 procent. Největšími hrozbami pro tyto živočichy jsou ztráta a degradace stanovišť, nadměrné využívání přírodních zdrojů, klimatická změna, znečištění, invazní druhy nebo nemoci. Nejhůře jsou na tom sladkovodní populace živočichů, které poklesly průměrně o 85 procent. Vyplývá to ze Zprávy o stavu planety 2026 (Living Planet Report).
před 14 hhodinami

Emise skleníkových plynů za poslední dekádu měly dopad na sílu veder v Evropě, ukazuje studie

Když Evropu zasáhne mimořádná vlna veder, dokážou klimatologové poměrně dobře stanovit, jakou roli v ní sehrála člověkem způsobená změna klimatu. Nedávno publikovaná studie si ale klade mnohem složitější otázku – dá se v konkrétní vlně veder rozeznat vliv části skleníkových plynů, konkrétně těch, které lidstvo vypustilo teprve během posledních deseti let?
před 17 hhodinami

AI vyřešila stovky matematických problémů, tvrdí OpenAI. Vědci protestují

Společnost OpenAI zaměřená na výzkum a vývoj umělé inteligence (AI) zveřejnila rozsáhlou sbírku matematických výpočtů, které vytvořil její nový interní model. Podle deníku The New York Times (NYT) výsledky na jednu stranu odhalují, čeho jsou nejpokročilejší modely AI schopny, ale vyvolávají i otázku, do jaké míry se výsledky opírají o práci skutečných matematiků. Překotný vývoj AI také vyvolává obavy, že firmy technologii vyvíjejí rychleji, než se změně dokáže přizpůsobit akademické prostředí.
8. 10. 2026‌‌

Rakovina dutiny ústní zabije ročně stovky Čechů. Člověk ji může odhalit sám, radí stomatolog

Stovky lidí ročně zbytečně zemřou na rakovinu dutiny ústní, hlavně proto, že se s touto diagnózou dostanou k lékaři pozdě. Ve skutečnosti mohou ale hodně udělat sami, tento nádor se dá totiž odhalit i pomocí samovyšetření. Včasný záchyt je pro toto zhoubné onemocnění klíčový, říká v rozhovoru pro ČT24 přednosta Stomatologické kliniky FN Plzeň Lukáš Hauer.
8. 10. 2026‌‌

Větrné elektrárny mohou ochlazovat mořskou hladinu, ukázal výzkum

Spočítat dopady větrných elektráren na okolí není úplně snadné – zejména na moři, kde existuje spousta nejrůznějších vlivů, jejichž dopady komplikují vyhodnocení. Teď přišli s kvalifikovanými odhady experti ze Skotska.
8. 10. 2026‌‌

Zemřela Margaret Hamiltonová, která vyvíjela programy pro NASA

Ve věku devadesáti let zemřela americká softwarová inženýrka Margaret Hamiltonová, která vedla tým, jenž vyvíjel letový software pro program Apollo amerického Národního úřadu pro letectví a vesmír (NASA). Informoval o tom její někdejší zaměstnavatel, Massachusettský technický institut (MIT).
8. 10. 2026‌‌

Největší soukromá archeologická společnost na světě končí, stovky vědců jsou bez práce

„Archeologie jako byznys s růstovou strategií“ – takový byl záměr americké soukromé společnosti Chronicle Heritage, která zaměstnávala stovky archeologů, antropologů a paleontologů. Na začátku října přestala fungovat, možná i kvůli obavám z budoucího nedostatku financí.
8. 10. 2026‌‌

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.