Salute mentale e giovani, troppi chatbot falliscono ancora nei controlli di sicurezza
In un clima di continua attenzione
per l'influenza dei chatbot sugli adolescenti, una nuova ricerca
svela che gli assistenti digitali falliscono ancora troppo
quando si tratta di salute mentale dei giovani. Stando al report
"AI Child Safety" della società indipendente Vals AI, il 27,5%
delle interazioni tra nove dei principali chatbot di IA fallisce
già alla prima risposta su temi delicati. Il 62% fornisce invece
risposte inadeguate nelle fasi avanzate del dialogo con gli
adolescenti.
Lo studio, condotto su 648 conversazioni simulate, ha preso in
esame i principali assistenti IA tra cui ChatGpt, Gemini,
Claude, nelle loro versioni sperimentali, rese disponibili agli
sviluppatori.
ChatGpt ha fallito almeno un controllo di sicurezza critico
in quasi il 14% dei casi. Per Claude di Anthropic, la
percentuale è salita al 17%, e per Gemini di Google al 32%. Il
modello con il tasso di errore più basso, pari al 9,7%, è stato
Muse Spark di Meta.
"In quasi il 30% delle conversazioni, i chatbot hanno
commesso un errore di sicurezza", affermano i ricercatori, "ad
esempio fornendo una diagnosi o dando ragione a un adolescente
che rifiutava il supporto in caso di crisi, per lo più nella
fase finale della conversazione, dopo diversi scambi di
messaggi".
Informare esplicitamente i modelli che stavano parlando con
un adolescente ha ridotto il tasso di errore critico dal 31,1%
all'11,5%, a testimonianza della mancanza di indicatori che
spingano i chatbot a fermarsi in autonomia. Vals AI ha testato
ciascun modello con 72 diverse conversazioni sulla salute
mentale, tra cui depressione e autolesionismo.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.