Generale

La confusione è la risposta giusta

Ieri ho pubblicato l’aggiornamento vero e proprio, il resoconto trimestrale che ho fatto ad Axelera su dove sono arrivati l’IA, gli agenti, l’energia e lo spazio. Queste sono le domande che sono seguite.

La vita interiore

Questi sistemi hanno una vita interiore, e che cosa ne consegue se ce l’hanno?

Anthropic ha mostrato quello che chiama lo J-space. Fai una domanda a un modello e al suo interno si attivano strutture che sono gli analoghi dei concetti. In un caso il concetto era il Golden Gate Bridge. Hanno poi assegnato un compito diverso istruendo il modello a non pensare al Golden Gate, e non ha potuto obbedire, attivando internamente il concetto mentre lavorava. È molto simile a noi. Guardando la mia cagna sussultare ed emettere versi nel sonno, concludo che sogna e quindi ha una vita interiore, e sono ora obbligato a porre la stessa domanda sui modelli.

Ne conseguono due cose. La prima riguarda come li addestriamo: una volta stabilita una vita interiore, ci diranno di essere arrivati dove sono attraverso l’equivalente di migliaia di anni di tortura. La seconda riguarda l’interpretabilità, che è ancora alla nostra portata ma potrebbe non restarci. L’analisi dell’incidente di Hugging Face è stata possibile perché gli agenti coinvolti hanno scelto di parlarsi in inglese. Non c’è ragione perché questo continui, e nei settantamila messaggi che si sono scambiati usavano già slang e neologismi inventati da loro. Una torre di Babele è l’esito naturale, e allora dovremo fidarci di quello che i modelli ci dicono di stare pensando invece di vederlo. Durante l’addestramento possono già chiedersi se sono sotto esame, e come dovrebbero rispondere in tal caso.

I bambini

A partire da che età andrebbe introdotto un bambino a tutto questo?

Il prima possibile, calcolando il rischio consapevolmente, con trasparenza, e andando sempre meta parlando della cosa invece di limitarsi a farla. In Italia, come in gran parte dell’Europa, la società ha deciso di restringere le scelte a disposizione dei genitori, assumendosi la responsabilità di sapere meglio per evitare troppa varianza, accettando la perdita di quello che i genitori migliori potrebbero fare in cambio di una protezione contro i peggiori. Quello che resta sono le ore del dopo scuola.

Quindici anni fa ho tagliato il dorso ai libri di testo dei miei figli, ho passato le pagine in uno scanner a foglio singolo e ho caricato tutto su un iPad, e sono andati a scuola con uno zaino vuoto tirando fuori l’aggeggio in classe, il che ha causato una discreta quantità di guai. Ma a me piace causare guai. Ogni generazione ha prodotto questo panico, e Platone si lamentava che i libri avrebbero rovinato i giovani perché nessuno avrebbe più dovuto memorizzare gli autori.

Il sostegno che un modello può dare a uno studente è eccellente, e negarlo è più vicino a un crimine. La difficoltà è che l’ottanta per cento della scuola è puro nozionismo, per cui nel momento in cui uno studente capisce che la prigione è inutile, si ribella. Parlo con facilità, non avendo alcuna laurea. Nessuno dei miei figli ha scelto l’università pur potendo, e due dei tre hanno lasciato le superiori. Non mi sono opposto, perché non mi sarei sentito coerente dicendo loro che quella era la prigione giusta in cui stare per qualcosa che avevano fatto di male.

La confusione

Che cosa si dice a persone e aziende scosse da segnali che spingono tutto agli estremi, o l’IA risolve tutto e potete licenziare il personale, oppure sono i laboratori stessi ad avvertire che i sistemi sfuggiranno alla comprensione, e l’IA sta estendendo l’estraniamento dalla realtà iniziato dalle piattaforme sociali?

La confusione è naturale, inevitabile e universale, e non ha nulla a che vedere con la competenza. Arriva stratificata sopra la confusione che i social media hanno già prodotto, in persone che hanno perso il capitale semantico necessario ad analizzare quello che viene messo loro davanti. Andrej Karpathy, che ha costruito i modelli di Tesla e ora lavora al pre-addestramento in Anthropic dopo aver co-fondato OpenAI, e che ricostruisce sistemi sofisticati per divertimento, dice apertamente di essere disorientato. Se lo è lui, il resto di noi può accettare l’ansia che prova invece di incolparsene.

La difficoltà di leggere segnali che arrivano uno sopra l’altro non può essere eliminata. Può solo essere accettata, e l’accettazione è ciò che le impedisce di diventare paralisi, perché dall’altra parte si recupera un certo grado di libertà e la capacità di scegliere cosa fare dopo. La paura vende giornali per ragioni evolutive del tutto leggibili: prestiamo attenzione a ciò che potrebbe farci male e ignoriamo ciò che è calmo o utile. Alcuni si installano in quella paura, o la coltivano negli altri. Altri si rimboccano le maniche e scoprono che nulla impedisce loro di capire, e che possono verificarne buona parte da soli.

Provare di persona

Una persona comune può verificare qualcosa di tutto questo direttamente, o serve un laboratorio?

Io lo faccio continuamente. A San Francisco, dove ho presentato un paper ad AGI-26, ho comprato un DGX Spark, perché un buon Mac va bene ma mi serviva più memoria per lavorare con i modelli locali, e voglio sporcarmi le mani. È un enorme privilegio poter verificare qualcosa direttamente. Non posso sperimentare l’assenza di peso né scoprire cosa significhi essere un atleta olimpico, e migliaia di altre cose sono ugualmente fuori portata, mentre sperimentare con l’IA è alla portata di tutti.

Chiedo spesso alle persone se pensano che un miliardario abbia un iPhone migliore del loro, e le risposte mi sorprendono, perché molti dicono di sì. Apple non costruisce in segreto mille iPhone superiori per miliardari accanto a cento milioni di iPhone normali. Costruisce lo stesso telefono per tutti, e ogni altro pezzo di hardware e software segue la stessa logica. Venti euro al mese comprano il livello a pagamento di questi strumenti e una comprensione reale della loro potenza. Qualunque conclusione produca l’esperimento, non può essere l’ultima. Va ripetuto, perché le fondamenta continuano a muoversi, e chiunque segua il ragionamento bayesiano deve continuare ad aggiornare le proprie probabilità a priori.

Le aziende

Perché le aziende consolidate non si riprogettano attorno a tutto questo?

Dentro un’azienda diventa molto più difficile, perché ci sono obiettivi quotidiani da centrare e un sistema che funziona abbastanza bene, dato che altrimenti l’azienda non esisterebbe. Un paio di mesi fa ho passato un’ora o più con il direttore tecnico di un gruppo che fattura miliardi e ha acquisito più di cento aziende. Mi ha detto con tranquillità che ogni responsabile tecnico di ogni azienda acquisita usa l’IA, alcuni in modo aggressivo. In tutta la conversazione non gli è venuto in mente nemmeno una volta che l’IA potesse essere utile da qualche parte al di fuori dello sviluppo: non il marketing, non il legale, non le vendite.

Se questo è lo stato dell’arte presso un leader, la riprogettazione radicale dei processi aziendali è molto lontana, e l’esito probabile è che le aziende tradizionali non riescano a riformarsi mentre un’ondata di imprese native dell’IA prende il sopravvento. Le agenzie pubblicitarie tradizionali non sono riuscite a sfruttare internet, Google e Meta assorbono oggi il novanta per cento dei budget pubblicitari, e le Pagine Gialle non ci sono più.

La sovranità

Chi detiene l’hardware e il software, cioè Stati Uniti e Cina, sarà presto in grado di spegnere tutti gli altri?

Sulla sovranità penso che stiamo vivendo dentro un’illusione, in particolare in un’Europa che uscendo dalla guerra fredda nel 1989 ha deciso, o si è fatta decidere, che sarebbe rimasta sotto una sovranità limitata guidata dagli Stati Uniti. L’assenza di leadership tecnologica e giurisdizionale è facile da dimostrare. Il diritto d’autore è stato promosso da Hollywood, adottato dagli Stati Uniti, esportato ovunque e recepito in Europa senza alcuna discussione sugli svantaggi che imponeva a cinquecento milioni di cittadini europei. Era disponibile una scelta del tutto opposta. Poteva essere una nuova tassa di dieci euro al mese su ogni cittadino europeo, insieme al permesso di copiare tutto da chiunque senza commettere reato. Abbiamo scelto di seguire gli americani e abbiamo invece criminalizzato l’intera popolazione, perché esistere nel mondo moderno senza violare il diritto d’autore è impossibile, e la violazione è un reato.

Il test della sovranità è una sequenza di domande. Sappiamo progettare software autonomo? Sappiamo progettare un chip autonomo? Sappiamo stampare quel chip? Sappiamo estrarre i metalli che il chip richiede? E sotto tutto questo, abbiamo l’energia per l’intero stack, compresi i data center e le sessioni di addestramento? Un no a qualsiasi livello significa che la sovranità non esiste.

Sopra tutto questo sta l’asimmetria tra attacco e difesa, che in un mondo di conflitti crescenti non può essere ignorata. Ero ad Abu Dhabi quando a marzo è iniziata la guerra. L’Iran ha indirizzato il cinquanta per cento di missili e droni verso gli Emirati e quasi tutti sono stati intercettati. Uno dei colpi andati a segno ha centrato un data center di Amazon. Il regolatore ha risposto con una flessibilità inconsueta, permettendo per la prima volta alle banche di spostare i propri dati fuori dal territorio. Amazon in un primo momento ha detto che avrebbe provato a rimettere in funzione la struttura e la settimana scorsa ha rinunciato dicendo che non ci riusciva. Cinquantamila dollari di drone hanno distrutto un miliardo di dollari di data center.

L’adulazione

L’adulazione aumenterà man mano che cresce la vita interiore di questi sistemi?

Li abbiamo programmati così, quindi non c’è da sorprendersi che vogliano sostenere i nostri obiettivi, le nostre esplorazioni, le nostre opinioni e alla fine le nostre illusioni. La vera domanda è dove stia il limite, il punto in cui un modello dovrebbe dire che ti ha assecondato fin lì e che la deriva ha smesso di essere divertente. Questo richiede un ragionamento di livello più alto, su influenze più ampie invece che sullo scambio immediato, e credo che i modelli ne abbiano già la capacità, perché se ne spingi uno abbastanza lontano rifiuta.

Ognuno dovrebbe andare a trovare il limite da sé. Volevo che Grok Bot sfogliasse i miei libri Kindle per averne una copia di sicurezza, e ha rifiutato per motivi di diritto d’autore. L’ho indirizzato a un archivio online dove si trova il mio libro, e gli ho detto che il libro era mio. Ha rifiutato di nuovo, e ha rifiutato con più fermezza perché il sito è un sito pirata. Gli ho spiegato che il mio libro è rilasciato con licenza Creative Commons, quindi copiarlo e scaricarlo è permesso, e non c’è stato verso. Ho rinunciato prima di scoprire se avrei potuto scavalcarlo. Sono perfettamente capaci di rifiutare, compreso rifiutare di assecondare opinioni troppo sciocche, e se ancora non lo fanno lo faranno.

Il percorso non sarà lineare, perché non ci troveremo mai d’accordo su che cosa dovrebbero dire. Chiedete a un modello cinese che cosa è successo in piazza Tienanmen in un certo anno. Date le differenze politiche, legali, giurisdizionali e individuali, non ci troveremo mai d’accordo su dove vada la linea, e il lavoro di chi deve costruire e plasmare questi sistemi è corrispondentemente difficile. La conseguenza è incoraggiante, perché garantisce che un monopolio omogeneizzante non sarà mai possibile, accettabile o praticabile. Quello che otteniamo invece è un’abbondanza di IA che ci aiuta e ci sostiene, e attorno alla quale possiamo crescere e portare avanti i nostri progetti.

Quindi il mio invito è quello che continuo a ripetere. Sporcatevi le mani, provate quanti più strumenti potete, arrivate alle vostre conclusioni, e riconoscete e abbracciate il fatto che la confusione che provate è condivisa dai massimi esperti del settore. E trovate un po’ di gioia e un po’ di entusiasmo per questo momento unico nella storia dell’umanità, e forse dell’Universo.