Chatboții de inteligență artificială dau diagnostice greșite în peste 80% dintre cazurile în care nu au acces la toate informațiile unui pacient și rămân nesiguri chiar și cu date complete, înregistrând o rată a erorilor de peste 40%, arată un studiu realizat de Mass General Brigham din Massachusetts, publicat în JAMA Network Open.
Cercetătorii au testat 21 de modele lingvistice, inclusiv cele dezvoltate de OpenAI, Anthropic, Google, xAI și DeepSeek, folosind 29 de viniete clinice bazate pe texte medicale de referință. Modelelor le-au fost oferite progresiv informații despre câte un caz: constatări ale consultațiilor, rezultate de laborator și alte date relevante. Performanța AI depinde direct de volumul informațiilor disponibile, dar nici accesul la date complete nu garantează acuratețea, chiar și în cel mai bun scenariu, unele modele au oferit diagnosticul corect în 90% dintre cazuri, în timp ce altele au rămas sub această cifră.
Sursa problemei este fenomenul de halucinație, comun tuturor modelelor lingvistice actuale. În absența unui răspuns clar, sistemele inventează informații plauzibile în loc să recunoască incertitudinea. În context medical, unde diagnosticul greșit poate avea consecințe grave, limitarea e evidentă și relevantă pentru utilizatorii care apelează la chatboți pentru orientare medicală.
Fii la curent cu tot ce contează în business-ul din România și abonează-te la canalul nostru de Whatsapp Forbes Romania.