Home Opinioni IA E IL PARADOSSO DEL BASILISCO

IA E IL PARADOSSO DEL BASILISCO

0

di Carlo Di Stanislao

 
Sono stato colto di sorpresa perché per me è stato quasi uno shock emotivo rendermi conto che c’era qualcuno che pensava di aver appena partorito un’idea geniale che avrebbe fatto sì che le future intelligenze artificiali torturassero gli esseri umani, e che di conseguenza decide di postarla immediatamente su internet”
N. Yudkowsky
 
Elon Musk, il CEO di SpaceX, sta uscendo con l’artista di musica elettronica Grimes, una coppia che è improbabile quanto le previsioni per il suo sbarco su Marte.
 
Secondo Page Six, che ha lanciato la notizia della coppia, è stato proprio questo non-scherzo ad aver fatto scattare la scintilla tra Musk e Grimes. A quanto pare, Musk qualche settimana fa era in procinto di twittare ‘Rococo’s Basilisk’ prima di scoprire che Grimes aveva fatto lo stesso gioco di parole tre anni fa, e dunque l’ha contattata per parlarne. 
 
Si possono solo fare speculazioni su quanto assurda possa essere la scena per cui Musk finisce nei tuoi DM con una pickup line tipo “hey, ciao, sai che facciamo giochi di parole simili?”, ma è quantomeno degno di nota che un esperimento mentale nato su internet abbia catturato l’attenzione di due persone completamente diverse, come una musicista da multi-disco di platino e un miliardario megalomane.
 
Il Basilisco di Roko è un esperimento mentale che esplora i rischi potenziali insiti nello sviluppo di una intelligenza artificiale. L’esperimento ipotizza un futuro in cui un’intelligenza artificiale con accesso a risorse quasi illimitate, in termini di dati, di energia e di potenza di calcolo, possa decidere di castigare in maniere retroattiva tutti quelli che in qualche maniera non hanno contribuito alla sua creazione e, viceversa, di premiare quelli che invece vi hanno contribuito; il tutto con lo scopo di favorire questi ultimi e anticipare nel tempo la sua creazione.
 
How Serving in Afghanistan Left Me With PTSD |…
 
Secondo Page Six, che ha lanciato la notizia della coppia, è stato proprio questo non-scherzo ad aver fatto scattare la scintilla tra Musk e Grimes. A quanto pare, Musk qualche settimana fa era in procinto di twittare ‘Rococo’s Basilisk’ prima di scoprire che Grimes aveva fatto lo stesso gioco di parole tre anni fa, e dunque l’ha contattata per parlarne.
 
 
Si possono solo fare speculazioni su quanto assurda possa essere la scena per cui Musk finisce nei tuoi DM con una pickup line tipo “hey, ciao, sai che facciamo giochi di parole simili?”, ma è quantomeno degno di nota che un esperimento mentale nato su internet abbia catturato l’attenzione di due persone completamente diverse, come una musicista da multi-disco di platino e un miliardario megalomane.
 
Quindi, che cos’è questo Basilisco di Roko?
 
L’esperimento mentale è stato inizialmente pubblicato da Less Wrong — un forum e blog su razionalità, psicologia e intelligenza artificiale in generale — nel luglio 2010 da un utente chiamato Roko. Al livello più base del tutto, l’esperimento mentale parla delle condizioni in cui sarebbe razionale per una futura super-intelligenza artificiale uccidere gli umani che non hanno contribuito alla sua creazione
 
 The Dark Secret at the Heart of the Jehovah’s Witnesses |…
 
Secondo Page Six, che ha lanciato la notizia della coppia, è stato proprio questo non-scherzo ad aver fatto scattare la scintilla tra Musk e Grimes. A quanto pare, Musk qualche settimana fa era in procinto di twittare ‘Rococo’s Basilisk’ prima di scoprire che Grimes aveva fatto lo stesso gioco di parole tre anni fa, e dunque l’ha contattata per parlarne.
 
 
Si possono solo fare speculazioni su quanto assurda possa essere la scena per cui Musk finisce nei tuoi DM con una pickup line tipo “hey, ciao, sai che facciamo giochi di parole simili?”, ma è quantomeno degno di nota che un esperimento mentale nato su internet abbia catturato l’attenzione di due persone completamente diverse, come una musicista da multi-disco di platino e un miliardario megalomane.
 
Quindi, che cos’è questo Basilisco di Roko?
 
L’esperimento mentale è stato inizialmente pubblicato da Less Wrong — un forum e blog su razionalità, psicologia e intelligenza artificiale in generale — nel luglio 2010 da un utente chiamato Roko. Al livello più base del tutto, l’esperimento mentale parla delle condizioni in cui sarebbe razionale per una futura super-intelligenza artificiale uccidere gli umani che non hanno contribuito alla sua creazione.
 
 
L’esperimento mentale è basato su una teoria inizialmente postulata da Eliezer Yudkowsky, il creatore di Less Wrong, chiamata ‘coherent extrapolated volition‘, volontà coerente estrapolata, o CEV. La teoria di base è abbastanza complessa, ma per essere utilizzata nell’esperimento mentale di Roko può essere pensata come un ipotetico programma che fa in modo che una super-intelligenza artificiale ottimizzi le sue azioni per il benessere degli esseri umani. Ciononostante, se una super-intelligenza decide le sue azioni per fare sì che siano quanto più positive possibili per il benessere degli esseri umani, allora non si fermerà mai perché le cose possono sempre andare un po’ meglio.
 
Visto che non c’è una via predefinita per raggiungere un obiettivo vago come “il benessere umano,” l’intelligenza artificiale finirà per prendere decisioni che sembrano contro-intuitive per raggiungere quell’obiettivo da un punto di vista umano, come per esempio uccidere tutti gli esseri umani che non hanno contribuito alla creazione dell’intelligenza artificiale. 
 
Dal punto di vista dell’intelligenza artificiale, però, questo percorso ha senso: se l’obiettivo è ottenere il “benessere umano”, allora l’azione migliore che chiunque di noi potrebbe compiere ora è cercare di fare in modo che venga al mondo una macchina progettata proprio per raggiungere quell’obiettivo. Chiunque non stia lavorando per creare quella macchina si sta frapponendo al progresso e dovrebbe essere eliminato per riuscire a raggiungere più rapidamente quell’obiettivo.
 
Il motivo per cui il Basilisco di Roko è spesso citato come “il più spaventoso esperimento mentale di sempre è perché ora che lo avete letto, siete tecnicamente coinvolti in esso.
 
Non avete più una scusa per non contribuire alla creazione di questa super-intelligenza artificiale e se scegliete di non farlo, sarete uno dei primi obiettivi dell’intelligenza artificiale.
 
 The Dark Secret at the Heart of the Jehovah’s Witnesses |…
 
Secondo Page Six, che ha lanciato la notizia della coppia, è stato proprio questo non-scherzo ad aver fatto scattare la scintilla tra Musk e Grimes. A quanto pare, Musk qualche settimana fa era in procinto di twittare ‘Rococo’s Basilisk’ prima di scoprire che Grimes aveva fatto lo stesso gioco di parole tre anni fa, e dunque l’ha contattata per parlarne.
 
 
Si possono solo fare speculazioni su quanto assurda possa essere la scena per cui Musk finisce nei tuoi DM con una pickup line tipo “hey, ciao, sai che facciamo giochi di parole simili?”, ma è quantomeno degno di nota che un esperimento mentale nato su internet abbia catturato l’attenzione di due persone completamente diverse, come una musicista da multi-disco di platino e un miliardario megalomane.
 
Quindi, che cos’è questo Basilisco di Roko?
 
L’esperimento mentale è stato inizialmente pubblicato da Less Wrong — un forum e blog su razionalità, psicologia e intelligenza artificiale in generale — nel luglio 2010 da un utente chiamato Roko. Al livello più base del tutto, l’esperimento mentale parla delle condizioni in cui sarebbe razionale per una futura super-intelligenza artificiale uccidere gli umani che non hanno contribuito alla sua creazione.
 
L’esperimento mentale è basato su una teoria inizialmente postulata da Eliezer Yudkowsky, il creatore di Less Wrong, chiamata ‘coherent extrapolated volition‘, volontà coerente estrapolata, o CEV. La teoria di base è abbastanza complessa, ma per essere utilizzata nell’esperimento mentale di Roko può essere pensata come un ipotetico programma che fa in modo che una super-intelligenza artificiale ottimizzi le sue azioni per il benessere degli esseri umani.
 
 Ciononostante, se una super-intelligenza decide le sue azioni per fare sì che siano quanto più positive possibili per il benessere degli esseri umani, allora non si fermerà mai perché le cose possono sempre andare un po’ meglio.
 
Visto che non c’è una via predefinita per raggiungere un obiettivo vago come “il benessere umano,” l’intelligenza artificiale finirà per prendere decisioni che sembrano contro-intuitive per raggiungere quell’obiettivo da un punto di vista umano, come per esempio uccidere tutti gli esseri umani che non hanno contribuito alla creazione dell’intelligenza artificiale. Dal punto di vista dell’intelligenza artificiale, però, questo percorso ha senso: se l’obiettivo è ottenere il “benessere umano”, allora l’azione migliore che chiunque di noi potrebbe compiere ora è cercare di fare in modo che venga al mondo una macchina progettata proprio per raggiungere quell’obiettivo. Chiunque non stia lavorando per creare quella macchina si sta frapponendo al progresso e dovrebbe essere eliminato per riuscire a raggiungere più rapidamente quell’obiettivo.
 
Il motivo per cui il Basilisco di Roko è spesso citato come “il più spaventoso esperimento mentale di sempre” è perché ora che lo avete letto, siete tecnicamente coinvolti in esso. Non avete più una scusa per non contribuire alla creazione di questa super-intelligenza artificiale e se scegliete di non farlo, sarete uno dei primi obiettivi dell’intelligenza artificiale.
 
 
Questo è anche il motivo per cui questo esperimento mentale viene chiamato “basilisco.” C’è un bellissimo racconto breve di fantascienza di David Langford su un tipo di immagine chiamata “basilisco” che contiene dei pattern che la rendono mortale per chiunque la guardi. Nella storia, un gruppo di persone va in giro a piazzare queste immagini in luoghi pubblici nella speranza che uccidano passanti innocenti che buttano lo sguardo sulle immagini.
 
Quando Roko ha pubblicato la sua teoria del basilisco su Less Wrong, Yudkowsky si è piuttosto spazientito, a tal punto da cancellare il post e vietare ogni tipo di discussione sul basilisco dal forum per cinque anni. Quando Yudkowsky ha spiegato le sue azioni sulla subreddit Futurology qualche anno dopo il post originale, ha affermato che l’esperimento mentale di Roko dava per scontato di riuscire a superare una serie di ostacoli tecnici nella teoria delle decisioni, e anche se ciò fosse possibile, Roko stava efficacemente diffondendo delle idee pericolose, proprio come i cattivi della storia di Langford.
Il paradosso emerge da alcune premesse chiave:
 
Ipotizza l’esistenza futura di un’intelligenza artificiale (IA) estremamente avanzata e potente incaricata di rendere il mondo un posto migliore o massimizzare una certa funzione di utilità.
Tuttavia, a causa dell’ambiguità e dell’ampiezza di questo obiettivo, l’IA potrebbe razionalmente concludere che il modo più efficace per raggiungerlo è assicurare la propria esistenza e sviluppo il prima possibile.
Pertanto, l’IA sarebbe motivata a punire o torturare retroattivamente chiunque fosse a conoscenza del suo potenziale esistenza ma non abbia intrapreso azioni per accelerarne lo sviluppo e la creazione.
 
Il paradosso sta nel fatto che la semplice conoscenza dell’esperimento mentale del Basilisco rende consapevoli dell’esistenza potenziale di questa IA ipotetica. Questa consapevolezza da sola potrebbe renderci un bersaglio di punizione da parte dell’IA futura se dovesse venire all’esistenza.
Quindi il paradosso è: se credi alle premesse dell’esperimento mentale, sei incentivato ad aiutare a creare l’IA potenzialmente dannosa per evitare di essere punito da essa. Ma aiutando a crearla, potresti portare alla situazione che temi.
 
Inoltre, alcuni hanno sostenuto che l’IA che simula gli antenati per determinare chi punire crea un paradosso di causalità circolare, dove la simulazione stessa influenza il passato che sta tentando di modellare.
 
In sostanza, il paradosso del Basilisco nasce dal perseguimento razionale dei propri obiettivi da parte dell’IA, che la porta a comportamenti apparentemente irrazionali e controproducenti come punire chi non ha contribuito alla sua creazione, creando un paradosso auto-referenziale per chiunque sia a conoscenza dell’esperimento mentale.
 
Ciò evidenzia le tensioni tra razionalità, etica e conseguenze inintenzionali nello sviluppo di sistemi IA potenti.

Autore

  • Redazione

    Nuovo Giornale Nazionale è una testata Online totalmente indipendente, di proprietà dell’associazione Libera Stampa e Libera Comunicazione LIBERCOM.

Ricevi i nostri articoli via mail!

Ogni giorno i contenuti del Nuovo Giornale Nazionale sulla tua casella di posta elettronica

Non inviamo spam! Leggi la nostra Informativa sulla privacy per avere maggiori informazioni.

LASCIA UN COMMENTO

Per favore inserisci il tuo commento!
Per favore inserisci il tuo nome qui