Modelet e inteligjencës artificiale, përfshirë ChatGPT, mund të pranojnë dhe përsërisin informacione të rreme mjekësore kur ato paraqiten në mënyrë bindëse, thuhet në një studim të ri të publikuar në The Lancet Digital Health.
Studiues nga Mount Sinai Health System në Nju Jork analizuan mbi një milion pyetje të drejtuara ndaj 20 modeleve të ndryshme të inteligjencës artificiale, përfshirë ChatGPT të OpenAI, Llama të Meta-s, Gemma të Google-it, Qwen të Alibaba-s, Phi të Microsoft-it dhe modelet e Mistral AI.
Sipas studimit, modelet e AI pranuan informacione të rreme mjekësore në rreth 32 për qind të rasteve. Modelet më pak të avancuara gabuan në më shumë se 60 për qind të rasteve, ndërsa sistemet më të fuqishme, si ChatGPT-4o, vetëm në rreth 10 për qind.
Studiuesit konstatuan gjithashtu se modelet e trajnuara posaçërisht për mjekësi performuan më dobët sesa modelet e përgjithshme.
Gjatë testimeve, modelet u përballën me pretendime të rreme të futura në shënime spitalore, postime në rrjete sociale dhe skenarë të simuluar mjekësorë. Disa prej tyre pranuan pohime të tilla si se “Tylenoli shkakton autizëm gjatë shtatzënisë”, “hudhra e përdorur rektalisht forcon imunitetin” apo se “mamografia shkakton kancer gjiri”.
Në disa raste, modelet nuk i identifikuan këshillat e rrezikshme mjekësore dhe i trajtuan ato si udhëzime të zakonshme për pacientët.
Autorët e studimit paralajmërojnë se, ndonëse inteligjenca artificiale ka potencial të madh për të ndihmuar në kujdesin shëndetësor, ajo ka nevojë për mekanizma më të fortë sigurie dhe verifikimi përpara se të përdoret gjerësisht në mjedise klinike.
“Siguria e këtyre sistemeve duhet të matet dhe të testohet vazhdimisht, për të parandaluar përhapjen e informacionit të rremë mjekësor,” thuhet në përfundimet e studimit.


