Chatboții populari, precum ChatGPT și Gemini, pot oferi diagnostice medicale eronate în majoritatea situațiilor.

Situația este întâmpinată atunci când nu dispun de suficiente informații, arată un studiu recent realizat în Statele Unite, scrie Digi24.ro.

Rezultate îngrijorătoare: erori în majoritatea cazurilor

Un studiu realizat de Mass General Brigham și publicat în JAMA Network Open relevă limite importante ale inteligenței artificiale în domeniul medical.

Cercetarea a analizat performanța a 21 de modele lingvistice dezvoltate de companii precum OpenAI, Google, Anthropic, xAI și DeepSeek.

Rezultatele arată că, în lipsa unor informații complete despre pacienți, aceste sisteme au oferit diagnostice greșite în peste 80% din cazuri, direcționând utilizatorii către concluzii eronate.

Teste pe cazuri clinice reale

Pentru evaluare, cercetătorii au folosit 29 de viniete clinice construite pe baza unor texte medicale de referință. Chatboților li s-au furnizat treptat date despre pacienți. Inclusiv observații clinice și rezultate de laborator.

Chiar și în scenariile în care au avut acces la toate informațiile relevante, modelele nu au avut rezultate constante. Au înregistrat o rată a erorilor de peste 40%, potrivit Digi24.ro.

Cu toate acestea, în unele situații, anumite sisteme au reușit să identifice corect diagnosticul în până la 90% dintre cazuri, ceea ce indică o variabilitate semnificativă a performanței.

„Halucinațiile” AI, o problemă majoră

Concluzia specialiștilor este că acuratețea acestor instrumente depinde în mare măsură de volumul și calitatea informațiilor disponibile.

Chiar și așa, cercetătorii atrag atenția asupra fenomenului de „halucinații”, specific modelelor de inteligență artificială, care pot genera răspunsuri plauzibile, dar incorecte, în lipsa unor date clare.

Astfel, deși tehnologia poate fi utilă ca instrument de sprijin, experții avertizează că aceasta nu poate înlocui evaluarea medicală realizată de specialiști.