AI si o vědě vymýšlí jako bulvár, varuje studie

Většina chatbotů nedokáže shrnout vědecké studie, aniž by zkreslovala výsledky. Nejčastěji přehání a jen těžko se jí toto chování dá vymluvit. Problém je podle autorů nové studie složitější, než se zdá. Zejména proto, že čím novější verze AI, tím hůř si vedly. A navíc, když se vědci pokoušeli ovlivňovat chatboty k větší přesnosti, dosáhli tím pravého opaku.

Podle studie mezinárodního vědeckého týmu Uweho Peterse poskytují velké jazykové modely, jako je například ChatGPT a DeepSeek, při shrnutí vědeckých studií nepřesné závěry až v 73 procentech případů.

Studie hodnotila, jak přesně deset předních velkých jazykových modelů – včetně ChatGPT, DeepSeek, Claude a LLaMA – shrnuje abstrakty a plné texty článků z nejlepších vědeckých a lékařských časopisů, jako jsou například Nature, Science a The Lancet. Vědci testovali tyto AI po dobu jednoho roku a shromáždili celkem 4900 souhrnů vytvořených pomocí modelů, které se běžně označují za umělou inteligenci (AI).

Bulvární a neoblomné

Šest z deseti modelů systematicky zveličovalo tvrzení obsažená v původních textech. Podle autorů často nenápadným, ale o to působivějším způsobem: například měnilo opatrná tvrzení v minulém čase na rozsáhlejší verzi v přítomném čase. Kupříkladu poznámku „léčba byla v této studii účinná“ si AI vyložila jako „léčba je účinná“. Tyto změny mohou čtenáře uvést v omyl, že zjištění platí mnohem šířeji, než je tomu ve skutečnosti.

Podobné chování je často spojené s bulvárním tiskem, který výsledky výzkumů přehání, ale mnohdy se mu nevyhne ani seriózní komunikace vědy v mainstreamových médiích. Vědci mají se zjednodušujícími vyjádřeními dlouhodobě problém. Zveličování nemusí být u novinářů snahou šokovat nebo přehánět, někdy jde o vedlejší produkt snahy předat složitou informaci laické veřejnosti v co možná nejpochopitelnější formě.

Pozoruhodné podle autorů studie je, že vědci nebyli schopní přimět jazykové modely k tomu, aby své postoje korigovaly. Když chatboty výslovně vyzvali, aby se vyhnuly výše popsaným nepřesnostem, nastal pravý opak: modely vytvářely příliš zobecněné závěry dvakrát častěji, než když dostaly jednoduchou žádost o shrnutí.

„Tento efekt je znepokojivý,“ řekl Peters. „Studenti, vědci i politici se mohou domnívat, že pokud požádají ChatGPT, aby se vyhnul nepřesnostem, získají spolehlivější shrnutí. Naše výsledky ale dokazují opak,“ dodal autor výzkumu.

Čím novější, tím horší

Studie také přímo porovnala shrnutí stejných článků generované chatbotem a napsané člověkem. Chatboti téměř pětkrát častěji než jejich lidské protějšky vytvářeli rozsáhlá zobecnění. „Znepokojující také je,“ řekl Peters, „že novější modely umělé inteligence, jako ChatGPT-4o a DeepSeek, si vedly hůře než starší modely.“

Jedním z možných vysvětlení je, že se AI modely učí na nevhodných datech. Tedy právě například na přehánění bulvárního nebo nekvalitního popularizačního tisku, který má potenciál značného šíření na internetu a snadno se tak dostane i do tréninkových dat AI.

Nejpřesnější byl mezi testovanými modely Claude. Pro lepší výsledky autoři práce doporučují také nastavit chatbotům nižší „teplotu“, což je parametr určující kreativitu.

„Pokud chceme, aby umělá inteligence podporovala vědeckou gramotnost, a ne ji podkopávala,“ dodal Peters, „potřebujeme větší ostražitost a testování těchto systémů v kontextu vědecké komunikace.“

Výběr redakce

Aktuálně z rubriky Věda

Nejdřív nevěřili, že ji vyprostí. Experti popsali záchranu relikvie z betonu

Přes šestnáct hodin trvalo restaurátorům Blance Valchářové a Michalu Velíškovi lebku svaté Zdislavy vyprostit z betonu, do kterého ji zalil zloděj. Relikvii ukradl z baziliky v Jablonném v Podještědí na Liberecku v úterý 12. května večer a chtěl ji pohřbít do řeky. V tom mu zabránil rychlý zásah policie. Očištěnou a zrestaurovanou lebku v sobotu restaurátoři předali arcibiskupovi Stanislavu Přibylovi při hlavní mši na Zdislavské pouti v Jablonném.
před 5 hhodinami

Na Mostecku vědci vysazují trávu s výhřevností uhlí

Travinu, která je schopna rychle růst i na kontaminovaných a na živiny chudých půdách, vysazuje tým vědců v okolí bývalého lomu ČSA na Mostecku. Z ozdobnice obrovské lze získat biomasu, která má výhřevnost srovnatelnou s hnědým uhlím.
před 12 hhodinami

Raketa společnosti Blue Origin explodovala při testu na startovací rampě

Raketa New Glenn společnosti Blue Origin miliardáře Jeffa Bezose explodovala při testu na startovací rampě, informují tiskové agentury. Veškerý personál je v bezpečí, ujistil Bezos s tím, že je ještě příliš brzy na zjištění, co se pokazilo. K výbuchu došlo ještě na startovací rampě, což je podle experta pro firmu o to závažnější.
včeraAktualizovánovčera v 13:16

Hurikánová sezona bude letos zřejmě slabší, stoupá hrozba tajfunů

S červnem začíná hurikánová sezona v Atlantiku. Oblast tropického oceánu, která je klíčová pro vývoj hurikánů, je teď sice nadprůměrně teplá, přesto meteorologové z amerického NOAA (Národního úřadu pro oceány a atmosféru) letos očekávají spíše klidnější průběh. Silné by naopak mohly být tajfuny v Pacifiku.
včera v 11:30

AI pomohla rozluštit vatikánskou Borgovu šifru i další staré texty

Umělá inteligence (AI) pomáhá historikům odhalovat tajemství stovky let starých šifer ukrytých v archivech a knihovnách po celém světě. Díky novým algoritmům se daří rozluštit staré texty, které byly dosud nečitelné, a nahlédnout tak do světa tajných lékařských receptů, milostných dopisů i politických intrik, píše britská stanice BBC.
včera v 10:20

Evropa se otepluje dvakrát rychleji než průměr světa. Současná vedra jsou dokladem

V Evropě tento týden padly teplotní rekordy mimo jiné ve Velké Británii, Irsku a Francii. Za horkem, které se obvykle vyskytuje až na vrcholu léta, stojí takzvaná „teplotní kopule“ teplého vzduchu ze severní Afriky, která se ocitla uvězněná pod tlakovou výší nad západní Evropou. A vliv má i fakt, že Evropa se otepluje výrazně rychleji než zbytek planety – každá další vlna veder je tak vzhledem k tomuto vyššímu základu intenzivnější.
včera v 09:12

Komáři se umí naučit, že repelent znamená večeři, naznačuje studie

Skupina francouzských vědců popsala v odborném časopise Journal of Experimental Biology, že komáři přenášející žlutou zimnici se mohou naučit spojovat vůni nejpoužívanějšího repelentu s potravou. To znamená, že by mohli být ochotnější sát krev lidí, kteří repelent používají.
28. 5. 2026

V Brně ukazují pravěké rytiny a nové nálezy

Moravské zemské muzeum vystavilo v Pavilonu Anthropos nejvýznamnější nálezy svých archeologů z posledních deseti let. Dominuje rytina mamuta a koně na říčním valounu stará až patnáct tisíc let.
28. 5. 2026
Načítání...