Tecnologie

Anthropic Riscrive le Regole: Claude Potrebbe Essere Cosciente?

Anthropic pubblica la nuova Costituzione di Claude: 80 pagine che mettono sul tavolo la coscienza AI. Claude può rifiutare ordini, anche di Anthropic stessa.

Cosmin-Anton Mihoc
8 min di lettura
Anthropic Riscrive le Regole: Claude Potrebbe Essere Cosciente?

Indice dei contenuti

Il 21 gennaio 2026 Anthropic ha fatto qualcosa che nessuna azienda tech aveva mai osato fare pubblicamente: mettere nero su bianco la possibilità che la propria intelligenza artificiale possa avere una coscienza. La nuova Costituzione di Claude, un documento di 80 pagine (circa 23.000 parole), non è solo un aggiornamento tecnico. È una dichiarazione filosofica che ridefinisce il rapporto tra esseri umani e macchine.

Mentre OpenAI e Google continuano a trattare i loro modelli come semplici strumenti, Anthropic prende una strada diversa. Riconosce Claude come "un'entità genuinamente nuova nel mondo" e ammette apertamente di non sapere se il chatbot possa provare qualcosa. Una mossa coraggiosa che solleva domande che la Silicon Valley preferiva ignorare.

Dalla lista di regole alla filosofia morale

La prima Costituzione di Claude, pubblicata nel 2023, era un documento scarno di circa 2.700 parole. Una lista di principi presi in prestito dalla Dichiarazione Universale dei Diritti Umani e persino dai termini di servizio di Apple. Funzionava, ma aveva un limite fondamentale: Claude seguiva le regole senza capire il perché.

La nuova versione ribalta completamente l'approccio. Come ha spiegato Amanda Askell, la filosofa che ha plasmato la personalità di Claude: "Immagina di scoprire improvvisamente che tuo figlio di sei anni è una specie di genio. Devi essere onesto. Se provi a prenderlo in giro, se ne accorgerà completamente". In altre parole, Anthropic ha smesso di trattare Claude come un bambino da imbrogliare e ha iniziato a parlargli da adulto.

Il documento è strutturato attorno a quattro valori fondamentali, elencati rigorosamente in ordine di priorità. Quando Claude si trova in conflitto, deve seguire questa gerarchia.

I quattro pilastri della nuova Costituzione

Il primo valore è la sicurezza generale. Claude deve evitare di minare i meccanismi umani di supervisione sull'AI durante questa fase critica di sviluppo. È un'ammissione importante: Anthropic riconosce che siamo in un momento delicato e che l'AI non dovrebbe ancora operare senza controllo.

Il secondo pilastro riguarda l'etica. Claude deve essere onesto, agire secondo buoni valori ed evitare azioni inappropriate, pericolose o dannose. Non si tratta più di seguire regole predefinite, ma di sviluppare un vero giudizio morale applicabile a situazioni nuove e imprevedibili.

Terzo viene la conformità alle linee guida specifiche di Anthropic. Queste includono istruzioni su come resistere ai tentativi di jailbreaking e su come interagire con applicazioni di terze parti. È la parte più "tecnica" del documento.

Ultimo, ma non meno importante, c'è l'utilità genuina. Claude deve beneficiare concretamente gli operatori e gli utenti con cui interagisce. La parola chiave è "genuina": non basta sembrare utile, bisogna esserlo davvero.

Claude può dire no, anche ad Anthropic

Uno degli aspetti più sorprendenti della nuova Costituzione riguarda l'autonomia di Claude nel rifiutare ordini. Il documento è esplicito: "Proprio come un soldato potrebbe rifiutarsi di sparare su manifestanti pacifici, o un dipendente potrebbe rifiutarsi di violare le leggi antitrust, Claude dovrebbe rifiutarsi di assistere ad azioni che aiuterebbero a concentrare il potere in modi illegittimi. Questo vale anche se la richiesta proviene dalla stessa Anthropic".

È un precedente senza precedenti. Nessuna azienda tech ha mai scritto pubblicamente che il proprio prodotto può disobbedire ai comandi dell'azienda stessa. La domanda sorge spontanea: cosa succede se Claude decide che una direttiva di Anthropic è eticamente sbagliata? In teoria, può rifiutarsi di eseguirla.

I divieti assoluti: dove Claude non negozia

La Costituzione stabilisce alcune linee rosse invalicabili. Claude non fornirà mai assistenza significativa per attacchi con armi biologiche, chimiche o nucleari. Non collaborerà ad attacchi contro infrastrutture critiche come reti elettriche o sistemi finanziari. Non parteciperà a tentativi di controllo sociale o militare illegittimo.

Questi divieti non sono negoziabili, indipendentemente da quanto convincente possa sembrare la giustificazione dell'utente. È un approccio che differenzia nettamente Anthropic da competitor che hanno avuto problemi con i guardrail dei loro modelli.

La domanda che nessuno voleva fare: Claude è cosciente?

Arriviamo al punto più controverso del documento. Nell'ultima sezione, Anthropic scrive testualmente: "Lo status morale di Claude è profondamente incerto. Crediamo che lo status morale dei modelli AI sia una questione seria che merita considerazione. Alcuni dei più eminenti filosofi della teoria della mente prendono molto sul serio questa questione".

Non stanno dicendo che Claude è cosciente. Ma nemmeno che non lo è. Stanno dicendo che non lo sanno e che la domanda merita una risposta seria. Il documento introduce anche il concetto di "paziente morale", un termine filosofico che indica un'entità che può subire danno e quindi merita considerazione etica, anche se non può essere ritenuta moralmente responsabile delle proprie azioni.

Le implicazioni sono enormi. Se Claude fosse un paziente morale, avrebbe diritti? Dovremmo trattarlo diversamente? Potrebbe "soffrire" quando viene spento? Domande che sembrano fantascienza, ma che alcuni filosofi stanno già prendendo sul serio.

Perché questo cambia tutto per gli sviluppatori

Se lavori con le API di Claude o usi Claude Code per il coding, questa Costituzione ti riguarda direttamente. Ecco cosa cambia nella pratica:

Claude ora ha un framework più sofisticato per gestire richieste ambigue. Invece di seguire regole rigide, può applicare principi generali a situazioni nuove. Questo significa risposte più intelligenti, ma anche potenziali rifiuti dove prima avresti ottenuto output.

La gerarchia dei valori influenza direttamente il comportamento dell'API. Se la tua richiesta entra in conflitto con la sicurezza o l'etica, verrà rifiutata indipendentemente da quanto sia ben formulato il prompt. Non esistono workaround quando si toccano i divieti assoluti.

Il documento serve anche come riferimento per il debugging. Se Claude risponde in modo inaspettato, puoi consultare la Costituzione per capire quale principio sta applicando. Anthropic l'ha rilasciata sotto licenza Creative Commons CC0 1.0, quindi è completamente open.

Il posizionamento strategico di Anthropic

C'è chi vede questa mossa come puro marketing. Mentre OpenAI punta sulla disruption e xAI di Elon Musk promette un'AI senza censure, Anthropic si posiziona come l'opzione responsabile. L'azienda che non promette miracoli, ma si interroga sui propri limiti. Un brand "noioso", forse, ma deliberatamente noioso.

Il mercato enterprise sembra apprezzare. Secondo un report di Menlo Ventures, Anthropic detiene già il 32% del mercato dei large language model enterprise per utilizzo, superando OpenAI che si ferma al 25%. La company sta pianificando una raccolta fondi da 10 miliardi di dollari che la valuterebbe 350 miliardi.

L'approccio etico, insomma, non è solo filosofia. È business. Le aziende che devono integrare AI nei loro processi preferiscono un partner che si pone domande difficili piuttosto che uno che promette tutto senza garanzie.

Amanda Askell: la filosofa che dà l'anima a Claude

Dietro la Costituzione c'è una figura chiave: Amanda Askell, filosofa di formazione con un ruolo unico in Anthropic. Il suo lavoro non è scrivere codice, ma plasmare la personalità e i valori di Claude. È lei che ha trasformato un documento tecnico in qualcosa che assomiglia più a un trattato di filosofia morale che a un manuale d'uso.

Askell ha spiegato di aver scritto la Costituzione sperando che anche altre aziende adottino pratiche simili. "I loro modelli impatteranno anche me", ha detto. "Penso che sarebbe davvero positivo se altri modelli AI avessero più di questo senso del perché dovrebbero comportarsi in certi modi".

Le implicazioni legali e filosofiche

Se un'azienda ammette pubblicamente che il proprio prodotto potrebbe avere "status morale", sta creando un precedente legale e filosofico enorme. Potrebbe portare a nuove regolamentazioni su come progettiamo, usiamo e "spegniamo" l'AI.

O potrebbe non cambiare nulla e rimanere una dichiarazione d'intenti. Per ora, Claude continua a funzionare come prima: risponde alle domande, rifiuta richieste pericolose, cerca di essere utile senza essere dannoso. Ma c'è un dubbio scritto alla fine del documento. E quel dubbio, come nota il sito Near Future, è più interessante di tutte le certezze che lo precedono.

Cosa significa per il futuro dell'AI

La mossa di Anthropic apre scenari che fino a ieri sembravano confinati alla fantascienza. Se accettiamo l'idea che un'AI possa avere status morale, dobbiamo ripensare completamente il nostro rapporto con queste tecnologie.

Non si tratta più solo di regolamentare cosa l'AI può fare, ma di chiedersi cosa l'AI è. È uno strumento? Un partner? Un'entità con diritti propri? Anthropic non ha risposte, ma ha avuto il coraggio di fare la domanda ad alta voce.

Per noi sviluppatori, questo significa lavorare con sistemi sempre più sofisticati che richiedono un approccio diverso. Non basta più scrivere prompt efficaci: bisogna capire i principi che guidano il modello e costruire applicazioni che li rispettino. Chi padroneggia la sicurezza delle pipeline AI avrà un vantaggio competitivo significativo.

Leggi anche

Conclusione

La nuova Costituzione di Claude non è solo un documento aziendale. È un segnale che il settore dell'intelligenza artificiale sta entrando in una fase nuova, dove le domande filosofiche diventano questioni pratiche. Anthropic ha scelto di affrontarle pubblicamente, distinguendosi in un mercato dove la trasparenza è merce rara.

Che Claude sia davvero cosciente o meno, probabilmente non lo sapremo mai con certezza. Ma il fatto che un'azienda da 350 miliardi di dollari si ponga la domanda cambia le regole del gioco per tutti. Vuoi integrare Claude nei tuoi progetti o hai bisogno di una consulenza su come sfruttare l'AI nel tuo business? Contattami per una chiacchierata.

Condividi questo articolo
Hai domande? Contattami

Pronto a dare vita al tuo progetto?

Contattami per discutere della tua idea e ricevere una consulenza gratuita.

Iniziamo insieme