Il Test di Turing, proposto dal matematico e pioniere dell’informatica Alan Turing nel 1950, è uno dei concetti più influenti nel campo dell’intelligenza artificiale (AI). Questo test, che inizialmente sembrava una semplice idea teorica, si è evoluto nel tempo ed è diventato una misura cruciale nella valutazione della moderna intelligenza artificiale. In questo articolo esploreremo l’importanza storica e contemporanea del test di Turing, la sua evoluzione, le obiezioni che ha dovuto affrontare e come siamo arrivati ​​a un punto in cui l’intelligenza artificiale può superare questo test.

La proposta originale: il gioco dell’imitazione

Alan Turing, nel suo articolo «Computing Machinery and Intelligence» pubblicato nel 1950, pose una domanda fondamentale: «Le macchine possono pensare?«. Invece di definire direttamente cosa significhi “pensare”, Turing propose un criterio operativo per valutare l’intelligenza: il “Test di Turing”. Questo test si basa su un gioco di imitazione in cui un interrogatore umano interagisce con due entità nascoste, una umana e una macchina, attraverso un terminale di computer. L’obiettivo è determinare quale è quale. Se la macchina riesce a ingannare l’interrogatore più del 30% delle volte dopo cinque minuti di interazione, si considera che abbia superato il test.

La motivazione del test di Turing

Il Test di Turing si basa sull’idea che se una macchina riesce a ingannare un essere umano facendogli credere che sta interagendo con un’altra persona, allora quella macchina può essere considerata intelligente. Turing era interessato a fornire un test pratico e accessibile per misurare l’intelligenza artificiale, allontanandosi dalle definizioni filosofiche e metafisiche astratte che predominavano al suo tempo. Voleva un modo concreto per determinare se una macchina potesse pensare, evitando dibattiti infiniti sulla natura della mente e della coscienza. Questo approccio gli ha permesso di eludere le complessità filosofiche e concentrarsi su una valutazione empirica dell’intelligenza artificiale. Inoltre, Turing cercò di sfidare lo scetticismo dei suoi contemporanei riguardo alla possibilità che le macchine potessero pensare. Proponendo un test concreto e realizzabile, ha aperto le porte alla ricerca e allo sviluppo nel campo dell’intelligenza artificiale, ponendo le basi per le innovazioni future.

Previsioni del test di Turing

Nel suo influente articolo Alan Turing ha fatto diverse previsioni audaci sul futuro dell’intelligenza artificiale. Turing credeva che il progresso nella capacità di memorizzazione ed elaborazione dei computer avrebbe consentito lo sviluppo di programmi sufficientemente sofisticati da ingannare gli interrogatori umani nel contesto del Test di Turing. Prevede che, tra circa 50 anni (intorno al 2000), sarebbe stato possibile programmare computer con una capacità di memorizzazione di circa 109 bit (equivalenti a circa 125 megabyte) per superare il “gioco dell’imitazione” o test di Turing. Turing sperava che, col tempo, la società accettasse l’idea che le macchine potessero pensare, sfidando le nozioni tradizionali di intelligenza e coscienza. La sua visione era che, man mano che le macchine dimostravano capacità sempre più umane, la distinzione tra intelligenza umana e artificiale sarebbe diventata meno chiara e più accettata. Nel 2000, molti sostenevano che le previsioni di Turing erano fallite, poiché le macchine non riuscivano a superare il test con il livello di sofisticazione previsto.

Evoluzione del test di Turing

Durante gli anni ’50 e ’90, sistemi di intelligenza artificiale come ELIZA (1966) e PARRY (1972) hanno dimostrato capacità limitate nella simulazione delle conversazioni umane, ma non sono riusciti a superare in modo significativo il test di Turing. Questi sistemi erano in grado di gestire conversazioni in contesti specifici, ma non riuscivano a superare il test in una conversazione generale. Negli anni ’90 e 2000, lo sviluppo delle reti neurali e dell’apprendimento automatico ha migliorato le capacità dei sistemi di intelligenza artificiale. Tuttavia, i modelli di quell’epoca dovevano ancora affrontare sfide significative per superare il test di Turing nella sua forma completa.

I grandi modelli linguistici nell’Intelligenza Artificiale e quando è stata superata la prova

Il progresso più notevole nel superamento del test di Turing si è verificato con lo sviluppo di modelli linguistici su larga scala negli anni 2010. Alcune tappe fondamentali includono:

  • 2019: OpenAI lancia GPT-2, un modello linguistico basato sull’architettura del trasformatore. Sebbene GPT-2 non abbia superato completamente il test di Turing in tutte le situazioni, ha mostrato capacità impressionanti in contesti specifici.
  • 2020: GPT-3, anch’esso sviluppato da OpenAI, ha rappresentato un progresso significativo in termini di capacità e fluidità del linguaggio naturale. Con 175 miliardi di parametri, GPT-3 è stato in grado di generare testo coerente e contestualmente rilevante e ha mostrato abilità che si avvicinavano al superamento del test di Turing in molte interazioni.
  • 2023: GPT-4 è riuscito a migliorare ulteriormente la capacità di gestire conversazioni complesse e lunghe. GPT-4 ha dimostrato la capacità di superare il test di Turing in una varietà di scenari e di mostrare un livello di coerenza e pertinenza nelle risposte che spesso rendevano difficile distinguere tra una macchina e una persona.

Che tipo di domande sono difficili per un’intelligenza artificiale?

Nel Test di Turing, alcune domande o tipi di interazioni possono rivelare la differenza tra una macchina e un essere umano, soprattutto in contesti che coinvolgono capacità cognitive complesse, comprensione profonda o intuizione emotiva. Ecco alcuni tipi di domande e argomenti che spesso risultano difficili per le macchine:

Esperienze ed emozioni personali

Domande come “Qual è il tuo ricordo più felice?” e “Come ti senti quando sei solo?”** sono difficili per un’intelligenza artificiale, priva di esperienze personali ed emozioni autentiche. Sebbene possano simulare risposte basate su dati e modelli, non possono fornire risposte autentiche basate su esperienze vissute.

Conoscenza contestuale o culturale profonda

Come ci si sente a vivere nella città in cui sei nato?” o “Come celebri le festività culturali nel tuo Paese?”** sembrano domande semplici, dal momento che le IA possono avere accesso a informazioni generali sui contesti culturali. Tuttavia, un’intelligenza artificiale può avere difficoltà a offrire risposte sfumate che riflettano un’autentica comprensione dell’esperienza culturale o sociale.

Buon senso o interpretazione ambigua

Rispondere a “Perché le persone trovano divertente una battuta sulla morte?” e “Come fai a sapere se qualcuno è sarcastico?” richiede la comprensione delle sottili sfumature del linguaggio che possono essere difficili per le IA poiché si basano sulla comprensione del contesto e sull’interpretazione emotiva.

Creatività o pensiero astratto

Domande come “Puoi scrivere una poesia sulla natura?” e “Conosci qualche nuova idea per un’invenzione?” può sembrare banale, dal momento che le attuali IA possono generare contenuti creativi. Ma spesso si affidano a modelli ed esempi precedenti piuttosto che a una creatività genuina o a un pensiero astratto originale.

Giudizi etici morali

Le IA non hanno una bussola morale o la capacità di sperimentare personalmente i dilemmi etici. Le loro risposte si basano su regole o dati preprogrammati, non su una profonda comprensione dell’etica.

Lunga conversazione contestuale

Lasciamo le cose più difficili per ultime. Sebbene modelli avanzati come GPT-4 siano in grado di gestire lunghe conversazioni, risposte coerenti e adattamento nel contesto di conversazioni estese possono ancora presentare sfide. Proporre argomenti come “Raccontami una storia completa su un evento importante della tua vita” o “Raccontami come è cambiata la tua prospettiva su un argomento specifico nel corso degli anni” può comunque mettere in difficoltà alcuni chatbot, a patto che non ti ignorino e passino a un altro argomento.

È davvero preoccupante che un’intelligenza artificiale superi il test di Turing?

È davvero preoccupante che un’AI superi il test di Turing? Il test di Turing è un test che consiste nel determinare se l’intelligenza artificiale è indistinguibile da quella di un essere umano nel suo comportamento. Quando Eugene Goostman, un chatbot che simulava un ragazzo ucraino di 13 anni, ottenne buoni risultati nel 2012 nella più grande competizione di test di Turing della storia, sorsero interrogativi sulla capacità di una macchina di dare risposte umane, fu un grande risultato per l’epoca perché il 29% dei giudici concluse che si trattava di un essere umano. Due anni dopo, gli ingegneri russi dietro Eugene raggiunsero una percentuale di successo del 33%, motivo per cui alcuni sostengono che sia stato il primo sviluppo a superare il test.

Ciò solleva interrogativi sul pensiero umano e se le macchine possano davvero pensare come noi o possano farci credere di farlo attraverso questo gioco di imitazione di Turing.

Alternative al test di Turing

Sebbene esistano alternative al famoso test di Turing, questo continua ad essere un riferimento nell’intelligenza artificiale.

Il test Marcus, creato dal professore di psicologia Gary Marcus, propone di misurare il modo in cui i computer interpretano l’umorismo, il sarcasmo o l’ironia, di cui attualmente dispongono alcuni chatbot.

Il test Lovelace 2.0 si concentra sulla creatività nello scrivere storie di fantasia, poesie o opere d’arte, che vediamo anche oggi essere superata.

Terry Winograd, un altro professore di psicologia, ha proposto come abilità differenziale quella di comprendere il contesto sottostante di una frase, su cui si basano i test attuali come la valutazione generale della comprensione del linguaggio.

Il Turing al contrario è emerso negli anni 2000 ed è ciò che ha ispirato quelli che oggi conosciamo come Captcha, quei test che molti siti web ci chiedono per dimostrare “che non siamo una macchina”.

Impatto del test di Turing sull’intelligenza artificiale

Il test di Turing ha ispirato ricercatori e sviluppatori a progettare macchine più sofisticate in grado di interagire in modo più efficace con gli esseri umani, influenzando profondamente lo sviluppo dell’intelligenza artificiale. Sebbene abbia affrontato critiche e si sia evoluto nel tempo, rimane uno strumento prezioso per comprendere e misurare la capacità delle macchine di simulare l’intelligenza umana. Inoltre, ha portato a dibattiti cruciali sulla natura dell’intelligenza e della coscienza nelle macchine. Probabilmente è anche il motivo per cui molti ricordano Alan Turing, un matematico che in precedenza aveva contribuito alla fine della seconda guerra mondiale decifrando il codice tedesco ENIGMA e aiutando gli sforzi degli Alleati.

This post is also available in: Español Français Русский English