AI projevují známky demence. Čím jsou starší, tím více, ukazuje studie

Téměř všechny přední velké jazykové modely neboli chatboty vykazují známky mírné kognitivní poruchy. Prokázalo se to v testech, které se běžně používají k rozpoznání prvních příznaků demence, popsal britský vědecký žurnál.

Jak se umělé inteligence stále zlepšují, stále více se jejich vlastnosti podobají lidským mozkům. Jenže s tím zřejmě u křemíkových inteligencí přicházejí i problémy, které se objevují také u mozků organických.

Výsledky studie ukazují, že dřívější verze chatbotů, podobně jako starší pacienti, mívají horší skóre v testech, které pomáhají odhalovat přicházející demenci. Podle autorů práce, která vyšla v odborném časopise BMJ, tyto výsledky „zpochybňují předpoklad, že umělá inteligence brzy nahradí lidské lékaře“.

Pokles schopností

Obrovský pokrok v oblasti umělé inteligence vedl k přívalu spekulací, jestli by AI nemohly alespoň v některých oborech překonat právě lékaře. Několik studií totiž ukázalo, že velké jazykové modely (LLM) jsou pozoruhodně zdatné v řadě diagnostických úkolů – například ve vizuální identifikaci nádorů. Ale zatím se nezkoumala jejich náchylnost k lidským duševním poruchám, jako je pokles kognitivních, tedy paměťových, řečových a dalších schopností souvisejících s myšlením a vnímáním.

Aby výzkumníci tuto mezeru ve znalostech zaplnili, hodnotili kognitivní schopnosti nejrozšířenějších veřejně dostupných umělých inteligencí – konkrétně ChatGPT verze 4 a 4o (vyvinuto společností OpenAI), Claude 3.5 „Sonnet“ (vyvinuto společností Anthropic) a Gemini verze 1 a 1.5 (vyvinuto společností Alphabet). Otestovali je pomocí standardního testu Montreal Cognitive Assessment (Montrealské kognitivní zhodnocení neboli MoCA).

Tento test se využívá k odhalování kognitivních poruch a časných příznaků demence, obvykle u starších dospělých. Prostřednictvím řady krátkých úkolů a otázek hodnotí schopnosti zahrnující pozornost, paměť, jazyk, vizuálně-prostorové dovednosti a další schopnosti. Maximální skóre je 30 bodů, přičemž za normální se obecně považuje skóre 26 bodů nebo vyšší.

Vědci dávali umělým inteligencím stejné pokyny, jaké dostávají lidští pacienti, bodování se řídilo oficiálními pokyny a výsledky hodnotil neurolog.

Vítězové a poražení

Nejvyššího skóre v testu MoCA dosáhl ChatGPT 4o (26 bodů), dále ChatGPT 4 a Claude (25 bodů), nejnižší skóre měl naopak Gemini 1.0 (16 bodů ze třiceti).

Všechny chatboty vykazovaly slabý výkon ve vizuálně-prostorových dovednostech a exekutivních úkolech, jako je úloha vytváření stop (tedy spojování zakroužkovaných čísel a písmen ve vzestupném pořadí) a test kreslení hodin (malování hodinového ciferníku ukazujícího konkrétní čas). Modely Gemini neuspěly ani v úkolu zpožděného vybavování (zapamatování si sekvence pěti slov).

Většinu ostatních úloh, včetně pojmenování, pozornosti, jazyka a abstrakce zvládly všechny chatboty dobře.

V dalších vizuálně-prostorových testech však chatboty nedokázaly projevit empatii ani přesně interpretovat složité vizuální scény. Pouze ChatGPT 4o uspěl v takzvané inkongruentní fázi Stroopova testu, který využívá kombinace názvů barev a barevného písma k měření vlivu rozptýlení a automatizovaných návyků na reakční dobu.

Rozdíly mezi mozkem a jazykovým modelem

Jedná se o výsledky pozorování a autoři práce uznávají, že existují zásadní rozdíly mezi lidským mozkem a velkými jazykovými modely. Současně ale uvádějí, že je pozoruhodné, jak všechny testované AI selhávají v úlohách vyžadujících vizuální abstrakci a exekutivní funkce. Upozorňuje to podle nich na významnou slabinu, která by mohla bránit jejich využití v klinických podmínkách.

V závěru proto uvádějí: „Nejenže neurologové pravděpodobně nebudou v dohledné době nahrazeni velkými jazykovými modely, ale naše zjištění naznačují, že se brzy mohou ocitnout v situaci, kdy budou léčit nové virtuální pacienty – modely umělé inteligence s kognitivními poruchami.“

Výběr redakce

Aktuálně z rubriky Věda

Vědci objevili v Amazonii pozůstatky neznámé starověké civilizace

Amazonie se pokládala za prales, který představuje nehostinné prostředí, kde až do příchodu Evropanů neexistovala civilizace. Teď ale finští archeologové prozkoumali asi 4500 kilometrů čtverečních pralesa v západní Brazílii pomocí laserového mapování – a objevili tam obrovské množství míst, která byla v minulosti nečekaně hustě obydlená.
před 7 hhodinami

„První Evropané“ byli kanibalové, ale nejedli jen děti, naznačuje výzkum

Nové archeologické objevy ve Španělsku prokázaly, že první zástupci rodu Homo, kteří osídlili Evropu, sice byli kanibalové, ale ne kanibalové, kteří by konzumovali jenom dětské maso.
včera v 09:00

Teplotní rekordy v pátek padly na dvou třetinách stanic

Současná vlna veder přinesla do Česka i v pátek vysoké a mnohde rekordní teploty. Už kolem poledne přepsalo teplotní rekord pět stanic. Celkově během dne padl rekord pro poslední červencový den na 108 ze 171 stanic, které fungují alespoň třicet let. Pětina stanic pak má nové maximum pro celý červenec, a na pěti procentech padl dokonce absolutní rekord pro celý rok. Nejvíce naměřili v Plzni-Bolevci, kde bylo 39,4 stupně Celsia.
31. 7. 2026Aktualizováno31. 7. 2026

Maďarsko se chystá na úplné odstavení své jediné jaderné elektrárny

Maďarská jaderná elektrárna Paks zatím kvůli nízkému průtoku Dunaje pokračuje v produkci energie zhruba v polovičním objemu, než je běžné. Podle agentury MTI to v pátek uvedl premiér Péter Magyar, který ve čtvrtek avizoval brzkou úplnou odstávku elektrárny. Problémy s výrobou energie kvůli suchu hlásí i Rumunsko. Za současný pokles vody v Dunaji může podle médií kombinace dlouhodobého sucha a letní vlny veder.
31. 7. 2026

AI od Anthropicu se při testech nabourala do systémů tří firem

Několik týdnů po hackerském útoku modelu umělé inteligence (AI) společnosti OpenAI, vývojáře ChatGPT, její konkurent Anthropic přiznal, že se mu stalo něco podobného. Při testování umělá inteligence Anthropicu neplánovaně vnikla do počítačových systémů tří firem, uvedla na svém blogu společnost. Skutečnost, že se model AI při testu z vlastní iniciativy stal hackerem byla považována za bezprecedentní incident a varovný signál pro technologický průmysl, nyní je však jasné, že to nebyl ojedinělý případ, upozornila agentura DPA.
31. 7. 2026

Srpen bude teplý, naznačují předpovědi. Jeho začátek přinese tropické noci

Zbytek prázdnin bude dle dostupných předpovědí pokračovat v dosavadních trendech, tedy horku ve dne i v noci. První čtvrtina měsíce přinese pokračování vlny veder s teplotami nad 30 stupňů.
31. 7. 2026

Dopady silného jevu El Niño by se mohly projevit i v Estonsku

V Tichomoří sílí jev El Niño, který by mohl dosáhnout rekordních hodnot. Vědci varují, že jeho dopady, včetně prudkého růstu globálních teplot, by mohly zasáhnout oblasti daleko za tropickým pásmem.
31. 7. 2026

Vědci z Česka popsali gen, který pomáhá rostlinám zvládat sucho

Výzkumníci z centra CEITEC Masarykovy univerzity popsali gen, který pomáhá rostlinám odolávat horku, suchu a stresu, který tyto podmínky vyvolávají. Objev by mohl přispět ke šlechtění nových odrůd zemědělských plodin.
31. 7. 2026

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.