Anthropic, che produce la famiglia di modelli IA Claude, ha organizzato incontri con studiosi e leader religiosi perché, come peraltro reso pubblico lo scorso mese di maggio, l’azienda guidata da Dario Amodei intende usare le tradizioni religiose e filosofiche come una delle fonti da cui ricavare idee su come formare il comportamento morale di Claude.
Sam Altman, Ceo di OpenAI che sviluppa i modelli Gpt, non si è fatta attendere e, ha risposto a stretto giro su X, dicendo di sentirsi a disagio di fronte ai tentativi di attribuire una forza religiosa ai modelli IA perché ciò potrebbe causare un problema di sicurezza, lenendo il peso del giudizio umano.
Due posizioni agli antipodi che vanno al di là del mero scontro teologico e guardano, invece, a chi deve stabilire i valori delle IA e quanta autorità è possibile affidare loro.
Cosa sta facendo Anthropic
Anthropic ha organizzato incontri con studiosi, membri del clero, filosofi ed esperti di etica provenienti da oltre 15 tradizioni religiose e culturali con l’obiettivo di raccogliere prospettive diverse per comprendere quale tipo di comportamento dovrebbe avere un’IA che interagisce con milioni di persone.
Anthropic parla esplicitamente di formazione morale (moral formation) e precisa che l'obiettivo non è allineare Claude a una specifica tradizione religiosa quanto, al contrario, di volere considerare con pari profondità le prospettive religiose, quelle filosofiche e quelle politiche.
Dario Amodei vuole quindi fare riferimento a tradizioni che da secoli discutono di virtù, responsabilità, coscienza e formazione del carattere come materiale per affrontare il problema tecnico dell’allineamento dei sistemi di IA, ovvero la necessità che le IA agiscano secondo obiettivi e valori umani, evitando ogni forma di comportamento indesiderato.
Da un dialogo con studiosi di neuroscienze e formazione del carattere, per esempio, Anthropic racconta di avere sperimentato una sorta di “coscienza esterna”, uno strumento che Claude può consultare durante un compito per richiamare i propri impegni etici. Secondo l'azienda, nei test interni questa tecnica ha ridotto alcuni comportamenti disallineati.
Il modello con una “coscienza”
A rendere il dibattito più controverso subentra un secondo filone di ricerca di Anthropic, distinto dagli incontri con i leader religiosi, quello sul cosiddetto model welfare, il possibile benessere dei modelli.
La società ha aperto un programma nel 2025 per studiare se sistemi molto avanzati possano possedere qualche forma di esperienza o “coscienza” e, di conseguenza, se possa avere senso attribuire loro una qualche considerazione morale. Anthropic sottolinea che la risposta è sconosciuta e che non esiste consenso scientifico nemmeno su come stabilirlo.
Tuttavia, per Anthropic il tema della “coscienza” artificiale è ormai entrato direttamente nella documentazione con cui vengono definiti “valori” e comportamento di Claude. Nella sua Costituzione, l’azienda dichiara di essere incerta sul fatto che Claude possa possedere, oggi o in futuro, una qualche forma di “coscienza” o status morale.
Sam Altman: “Il mondo dovrebbe accettare alcune cose brutte” in cambio dei benefici dell’IA
Perché Sam Altman parla di sicurezza
La parte centrale del pensiero del Ceo di OpenAI verte su ciò che ha accostato giustamente a una rinuncia al giudizio umano.
Il rischio emerge quando un sistema probabilistico, fallibile e capace di produrre informazioni false, viene percepito non più come uno strumento da valutare criticamente, ma come un'autorità superiore alla quale delegare decisioni morali o personali. L'errore del modello acquisterebbe in quel caso un peso diverso perché l'utente potrebbe smettere di verificarlo o contestarlo.
Una posizione coerente con l'approccio ufficiale di OpenAI alla sicurezza, che indica il controllo umano tra i principi fondamentali dell'allineamento e afferma che i sistemi devono restare sottoposti alla capacità delle persone di comprenderli, controllarli e correggerli.
Non è una disputa di tipo religioso
La disputa tra OpenAI e Anthropic però riguarda meno la religione in senso stretto di quanto possa sembrare. Riguarda il modo in cui i laboratori descrivono sistemi sempre più sofisticati. Parole come “carattere”, “virtù”, “coscienza”, “benessere” o “identità”, utilizzate nella documentazione di Anthropic, possono essere figure concettuali per studiare il comportamento dei modelli ma possono anche favorire l'antropomorfizzazione di sistemi che restano difficili da interpretare.
Anthropic stessa riconosce il problema. Quando descrive il “character training” di Claude specifica che i modelli di IA non sono persone, pur sostenendo che addestrarli a manifestare caratteristiche come curiosità, apertura mentale, onestà e prudenza possa migliorare il loro comportamento.
Il Vaticano e la linea di confine
La discussione arriva mentre anche il Vaticano sta insistendo sulla necessità di preservare una distinzione tra intelligenza umana e sistemi artificiali. Il 2 ottobre Papa Leone XIV, parlando agli artisti, ha sostenuto che esiste una “differenza ontologica” tra la produzione umana e quella delle macchine e che agli algoritmi “manca la scintilla dell'umano”. Il discorso riguardava principalmente arte e creatività, e non costituisce quindi una risposta diretta alla ricerca di Anthropic sulla coscienza artificiale. È però prova di quanto il confine tra capacità delle macchine e caratteristiche considerate proprie dell'essere umano sia ormai diventato anche un terreno culturale e filosofico.
La vera divisione
La contrapposizione emersa in questi giorni può essere letta in tre modi. Per Anthropic, tradizioni religiose, filosofiche e umanistiche rappresentano secoli di riflessione su moralità e formazione del carattere che possono fornire idee utili per progettare sistemi più affidabili.
Altman pone invece l'accento sull'altra faccia del problema, ovvero attribuire alle IA qualità spirituali o un'autorità superiore può modificare il comportamento delle persone verso questi sistemi e indebolire il controllo umano.
Sono due questioni che, in definitiva, possono anche convivere. Studiare come costruire sistemi capaci di comportarsi secondo principi etici non richiede di considerarli esseri morali e, parallelamente, interrogarsi scientificamente sulla possibile “coscienza” delle future IA non significa concludere che quella “coscienza” possa esistere o esista già.
È proprio la confusione tra questi livelli - comportamento, coscienza e autorità - a trasformare una discussione apparentemente filosofica in un problema concreto di sicurezza dell'intelligenza artificiale.
La terza modalità di lettura, più concisa e diretta, è ancora fornita da Sam Altman, convinto che per godere degli effetti benefici delle IA, l’umanità dovrebbe accettare anche quelli negativi che si porta appresso.