La ricerca, condotta da Sydney Sears e dalla dott.ssa Deena Skolnick Weisberg della Villanova University, ha coinvolto oltre 2.500 adulti di età compresa tra 18 e 81 anni, reclutati tramite la piattaforma Prolific. Sono stati utilizzati tre racconti originali scritti da autori umani pubblicati e tre racconti corrispondenti generati da ChatGPT, abbinati per genere e struttura narrativa .
Lo studio si è articolato in tre fasi, ciascuna progettata per isolare diversi aspetti della percezione dei lettori:
Studio 1 (1.682 partecipanti): Ogni persona ha letto un solo racconto e le è stato detto – correttamente o in modo sbagliato – se era stato scritto da un umano o dall'IA. Poi doveva valutarlo per qualità e coinvolgimento narrativo .
Studio 2 (424 partecipanti): I partecipanti hanno letto un racconto umano e uno generato dall'IA, senza sapere quale fosse quale. Poi dovevano indovinare l'autore di ciascuno .
Studio 3 (481 partecipanti): Un disegno di lettura cieca simile, con la richiesta di identificare se ogni racconto provenisse da un umano o da ChatGPT .
I risultati sono stati sorprendenti e coerenti in tutti gli esperimenti:
Incapacità di riconoscimento. Nello Studio 2, l'identificazione corretta è stata solo del 39,93% – peggio di un lancio di moneta. Nello Studio 3, è stata del 51,97%, statisticamente non diversa dal caso .
I racconti dell'IA giudicati migliori. In tutti gli studi, i racconti generati dall'IA hanno ricevuto valutazioni più alte sia per la qualità che per il coinvolgimento .
Un 'bias di attribuzione pro-umano'. I racconti con il voto più alto sono stati quelli che i partecipanti sentivano dire fossero scritti da umani – anche quando in realtà erano generati dall'IA . I ricercatori sostengono che questo rivela un pregiudizio radicato verso le narrazioni percepite come autenticamente umane .
L'alfabetizzazione all'IA aiuta; la competenza letteraria no. Ogni aumento di un punto nell'auto-valutazione della competenza sull'IA è stato associato a un aumento del 14% nelle probabilità di identificazione corretta. Ogni punto su una scala validata di alfabetizzazione all'IA (AILS) corrispondeva a un aumento del 33% .
La dott.ssa Weisberg ha spiegato perché la scrittura dell'IA può sembrare superiore a quella umana in questi parametri: la scrittura dell'IA «tende a essere più chiara, più diretta e più facile da elaborare», mentre i racconti umani sono «spesso più sottili e complessi». Ha aggiunto che «le persone generalmente preferiscono la prevedibilità, perché il materiale difficile o sottile richiede più energie mentali» .
Lo studio si inserisce in un filone crescente di prove su come viene percepito il testo generato dall'IA. La prosa artificiale evita l'ambiguità, segue strutture narrative prevedibili e offre risoluzioni efficienti – tutte qualità che rendono la lettura uno sforzo leggero. La narrativa umana, al contrario, abbraccia spesso la complessità, la sottigliezza e la tensione irrisolta, che possono sembrare meno immediatamente soddisfacenti anche quando sono artisticamente più ricche .
Il 'bias pro-umano' emerso dallo studio è particolarmente rivelatore. I lettori hanno penalizzato i racconti che credevano scritti dall'IA, anche quando il contenuto era identico a quello che lodavano sotto l'etichetta 'umana'. Questo bias di attribuzione crea un paradosso: gli studenti che dichiarano apertamente l'uso dell'IA potrebbero subire una penalità di credibilità anche quando il loro lavoro è di alta qualità, mentre chi nasconde l'uso dell'IA potrebbe beneficiare della preferenza dei lettori per l'autorialità umana percepita .
I risultati dello studio pongono sfide fondamentali per le università e le loro politiche di integrità accademica:
Il rilevamento è inaffidabile. Poiché anche lettori esperti si comportano vicino al caso nel distinguere l'IA dalla scrittura umana, gli strumenti tradizionali di rilevamento del plagio e il giudizio dei docenti da soli non possono identificare in modo affidabile i lavori generati dall'IA .
L'alfabetizzazione all'IA è la contromisura più efficace. Lo studio ha scoperto che la familiarità con i sistemi di IA migliora la capacità di riconoscimento, suggerendo che le università dovrebbero investire nella formazione sull'alfabetizzazione all'IA sia per gli studenti che per i docenti, piuttosto che affidarsi solo a misure repressive .
La progettazione delle valutazioni va ripensata. Se l'IA può produrre testi che i lettori giudicano uguali o superiori al lavoro umano, i compiti a casa e gli incarichi di scrittura standard potrebbero non essere più validi come misure della capacità individuale dello studente. Le università devono riconsiderare quali competenze stanno effettivamente valutando e come .
Le politiche di integrità accademica devono evolversi. Lo studio suggerisce che è necessario un approccio più sfumato – uno che definisca l'uso accettabile rispetto a quello inaccettabile dell'IA, che enfatizzi il processo e la riflessione rispetto al prodotto finale e che integri l'alfabetizzazione all'IA nei programmi di studio .
La dott.ssa Weisberg ha sottolineato che i risultati non rendono obsoleti gli autori umani: «Gli umani scrivono come forma di espressione creativa di sé, per mettersi alla prova o per dare un senso alle proprie esperienze. Il fatto che l'IA possa generare storie simili a quelle umane non cambia nulla di tutto ciò» .