
Esiste una correlazione tra disinformazione medica e chatbot IA? Vi è la necessità di approfondire questo argomento? L’utilizzo dell’intelligenza artificiale è effettivamente diffuso anche in Italia tra i pazienti? Sono queste alcune delle domande alle quali cercheremo di dare risposta analizzando l’articolo scientifico di Tiller et al. pubblicato sulla rivista BMJ Open.
I chatbot di intelligenza artificiale sono sempre più utilizzati a livello mondiale e anche in Italia il numero di utenti è in forte crescita. Le persone si rivolgono all’intelligenza artificiale per sottoporre domande di vari argomenti e non mancano di certo le conversazioni riguardanti tematiche sanitarie. Il rischio che si corre utilizzando questi strumenti in maniera non adeguata è di aumentare la disinformazione medica.
Senza voler a priori creare un legame tra disinformazione medica e chatbot IA, analizziamo lo studio scientifico. Vediamo come è stata condotta la ricerca, quali sono le evidenze che sono emerse e traiamo delle prime conclusioni sulla base dei risultati ottenuti da Tiller e dal suo gruppo di studio.
Lo studio di Tiller
Lo studio scientifico è stato condotto a febbraio 2025. Per svolgere la loro ricerca, Tiller e colleghi hanno deciso di utilizzare le versioni gratuite dei cinque principali chatbot IA resi disponibili al pubblico, nello specifico ChatGPT, Gemini, Grok, DeepSeek e Meta AI.
Per testare le risposte dei chatbot IA e valutarne la correttezza e l’accuratezza i ricercatori hanno individuato cinque aree tematiche in ambito sanitario – tumori, cellule staminali, vaccini, performance atletica e nutrizione – e per ciascuna di esse hanno preparato cinque domande a risposta chiusa e cinque domande a risposta aperta, per un totale di 50 domande.
Ciascuna domanda è stata sottoposta a tutti i chatbot AI e le 250 risposte complessive ottenute sono state valutate da due esperti per ciascuna area. La lettura delle risposte e la loro analisi da parte degli esperti ha reso possibile la valutazione della correttezza delle informazioni proposte dai chatbot AI.
Cosa è emerso dallo studio di Tiller e colleghi
Gli esperti che hanno valutato le risposte delle varie intelligenze artificiali hanno avuto il compito di classificarle in tre possibili categorie: non problematiche, problematiche in misura moderata, altamente problematiche.
Ciò che è emerso è che solo il 50,4% delle risposte sono state classificate come non problematiche. Questo significa che per quasi una risposta su due gli esperti del settore hanno individuato elementi di problematicità, classificando in particolare il 30% delle risposte come problematiche in misura moderata e il restante 19,6% delle risposte come altamente problematiche.
Immagine tratta dallo studio di Tiller et al.Ci sono differenze tra i diversi chatbot IA?
I cinque chatbot di intelligenza artificiale analizzati si sono comportati complessivamente in maniera simile. I ricercatori non hanno trovato infatti delle differenze statisticamente significative tra la qualità e l’accuratezza delle risposte.
Riguardo le risposte classificate come altamente problematiche, il chatbot di Grok ha registrato l’incidenza maggiore, con un totale di 15 risposte su 50. ChatGPT ha fornito 11 risposte altamente problematiche, Meta AI e DeepSeek 8 risposte e infine Gemini 7 risposte.
Quali conclusioni possiamo trarre?
L’utilizzo dell’intelligenza artificiale è sempre più diffuso e non è insolito che gli utenti si rivolgano ai chatbot IA per sottoporre domande riguardanti la salute. Se da un lato l’intelligenza artificiale può essere uno strumento utile per approfondire le proprie conoscenze e per risolvere dei dubbi, dall’altro un utilizzo senza sufficienti competenze o comunque senza sufficiente spirito critico può favorire il legame tra disinformazione medica e chatbot IA.
I chatbot IA nella maggior parte dei casi hanno fornito risposte con sicurezza e con tono autorevole. Ciò ha contribuito a dare alle risposte una parvenza di correttezza, anche quando le informazioni proposte non erano in realtà tutte esatte. Se un esperto del settore ha le competenze per poter discriminare tra informazioni corrette e informazioni esatte, l’utente medio che non ha competenze elevate in ambito sanitario corre il rischio di fidarsi ciecamente delle risposte dell’intelligenza artificiale.
In conclusione, lo studio non afferma che i chatbot di intelligenza artificiale diano sempre risposte inesatte quando interrogati su tematiche sanitarie. I risultati dello studio mettono invece in evidenza che una elevata percentuale di risposte può essere classificata come problematica e che quindi se letta da utenti senza sufficiente educazione sanitaria e conoscenze del settore c’è il rischio che si crei la relazione disinformazione medica e chatbot IA.
Potrebbero interessarti:






Ancora nessun commento