Kutatás

Harvard-kutatás: egy OpenAI-modell pontosabb lehet a sürgősségi diagnózisokban a humán orvosoknál

A Harvard Egyetem által vezetett kutatás azt vizsgálta, hogyan teljesítenek mesterséges intelligencia-modellek sürgősségi osztályi orvosi szituációkban.

A Harvard Egyetem által jegyzett kutatás azt vizsgálta, hogyan teljesítenek az OpenAI különböző modelljei orvosi helyzetekben, különös tekintettel a sürgősségi osztályokra. A kutatócsoport több kísérletet végzett, amelyekben a mesterséges intelligencia és valódi orvosok diagnózisait vetették össze.

A vizsgálat felépítése

Az egyik kísérletben 76 beteget vontak be, akik egy kórház sürgősségi osztályára kerültek. E csoport esetében a kutatók összehasonlították két belgyógyász szakorvos diagnózisait az OpenAI o1 és 4o jelű modelljeinek válaszaival. A diagnózisokat két valódi orvos értékelte ki vaktesztként: ők nem tudták, hogy egy adott diagnózist ember vagy AI állított-e fel – ezt a vizsgálati elrendezést ismerteti a TechCrunch összefoglalója.

Eredmények

A Science folyóiratban közölt tanulmány szerint az o1 modell az esetek jelentős részében jobb vagy azonos szintű teljesítményt mutatott, mint a két szakorvos, illetve többször előzte meg a 4o modellt. Általánosságban az AI az esetek 67 százalékában adott „pontos, vagy nagyon közeli diagnózist” a rendelkezésére bocsátott információk alapján, míg a két emberi orvos 50–55 százalékos pontosságot ért el ugyanazon kritériumok szerint.

A különbségek elsősorban akkor voltak szembetűnők, amikor a beteg állapotáról rendelkezésre álló információ korlátozott volt — vagyis azokban a helyzetekben, amikor különösen nagy szükség van gyors és megbízható döntéshozatalra.

Mit jelentenek az eredmények?

A kutatók és a tanulmány szerzői hangsúlyozzák, hogy bár az eredmények bíztatóak, az AI jelenlegi állapotában még nem alkalmas arra, hogy önállóan, emberi felügyelet nélkül élet-halál jellegű döntéseket hozzon a sürgősségi osztályokon. Ugyanakkor a tanulmány azt sugallja, hogy érdemes tovább vizsgálni és integrálni a mesterséges intelligenciát az egészségügyi folyamatokba támogatói eszközként.

A szerzők nem feltételezik, hogy a jövőben a mesterséges intelligencia teljesen kiszorítaná az emberi orvosokat; a jelenlegi eredmények inkább arra utalnak, hogy az AI kiegészítő szerepet tölthet be a diagnosztikában, különösen olyan helyzetekben, ahol kevés információ áll rendelkezésre és gyors reagálás szükséges.