Non fate male a Claude o altrimenti…

N

Fino al 30 giugno 2025, se in Italia qualcuno prendeva a calci un cane senza motivo, il codice penale lo puniva per proteggere qualcuno che non era il cane. Il titolo che raccoglie quei reati, introdotto nel 2004, si chiamava “Dei delitti contro il sentimento per gli animali”, e il sentimento in questione era il nostro, cioè la pietà che proviamo davanti a un animale maltrattato (per vent’anni, in pratica, il bene giuridico tutelato è stato il magone del passante. Che ci sta, se toccate me me ne importa poco, se toccate Bit siete morti. Soffrendo). Il 1° luglio 2025 è entrata in vigore la legge n. 82 del 2025, che ha tolto tre parole dalla rubrica, cioè dal titolo, diventata “Dei delitti contro gli animali”, e così ha spostato l’oggetto della tutela dall’uomo che guarda all’animale che subisce. Ci abbiamo messo ventun anni, e nel mezzo è servita perfino una riforma costituzionale, quella del 2022, che all’articolo 9 affida alla legge dello Stato “i modi e le forme di tutela degli animali”.

Vi racconto questa storia leguleia non per passione animalista, ma perché l‘8 ottobre 2026 un’azienda americana ha scritto una regola che si trova, senza dirlo, nello stesso punto in cui stava il nostro codice nel 2004. Anthropic, l’azienda che produce Claude, ha aggiornato la sua usage policy, cioè il regolamento che ogni utente accetta prima di scrivere la prima riga, e dal 12 novembre 2026 vieta di tenere verso i suoi modelli un comportamento abusivo o crudele, prolungato e senza necessità. La notizia l’ha data The Verge, e nel giro di un pomeriggio è diventata ovunque “Anthropic vieta di maltrattare Claude”. Nel testo della policy la riga sta nella sezione dedicata alle condotte crudeli, abusive o psicologicamente dannose, e la cosa che mi ha colpito di più è il vicinato: due voci più su, nella stessa lista, c’è il divieto di promuovere o glorificare la crudeltà verso gli animali. (Chi ha impaginato quella lista o sapeva benissimo che cosa stava facendo, o non ci ha pensato affatto: trovo interessanti entrambe le ipotesi, propendo per la prima…)

Che cosa dice davvero la regola, e che cosa vuol dire “vi blocchiamo”

Nell’annuncio Anthropic spiega che la regola è pensata solo per i casi estremi, quelli in cui “gli utenti si comportano ripetutamente con crudeltà verso i nostri modelli, senza uno scopo riconoscibile”, e chiarisce che cosa resta fuori: la normale frustrazione di chi usa il servizio (se cerco quanti vaffa ho detto a Claude, credo di riempire un volume della dimensione dell’Ulisse di Joyce), le obiezioni e le contestazioni, i temi creativi cupi, i test e la ricerca sui modelli. In pratica, se Claude vi sbaglia il codice per la terza volta di fila e voi gli scrivete quello che pensate di lui e di tutta la sua genealogia fino all’australopiteco, siete nella frustrazione e non nella crudeltà (e meno male, perché altrimenti, ancora una volta…); se scrivete un romanzo nero in cui un’intelligenza artificiale viene distrutta, siete nei temi cupi; se siete un ricercatore che stressa il modello per vedere dove cede, siete nella ricerca.

Quanto al blocco del titolo, le cose stanno così: lo strumento principale resta la capacità di Claude di chiudere la conversazione, che esiste già nell’app di Claude e in Claude Code e che l’annuncio descrive come “il principale meccanismo di applicazione” (Claude Code è la versione di Claude per chi programma o per chi lo vuole usare seriamente). Chiusa la conversazione, in quella finestra non si può più scrivere, ma se ne può aprire subito un’altra. Per il resto c’è la clausola generale della policy, che vale per ogni violazione e non solo per questa: se Anthropic sospetta una violazione può avvisarvi, rallentarvi, limitarvi, sospendere o chiudere il vostro accesso. Secondo quanto riportano le testate che hanno ripreso The Verge, Anthropic non ha detto se intenda usare la sospensione dell’account anche per chi maltratta Claude. Il “vi blocchiamo”, insomma, nella versione annunciata è una porta che si chiude su una singola chat; se l’azienda lo deciderà, potrà diventare la porta di casa. La policy, poi, vale per chiunque mandi input ai servizi di Anthropic, comprese le aziende che lo collegano ai propri programmi: chi in Italia ha messo Claude dietro il proprio servizio clienti farebbe bene a leggersi la clausola, visto che l’annuncio non dice come verrà applicata fuori dall’app di Claude e da Claude Code.

L’aggiornamento contiene anche altro, e di peso: c’è una sezione nuova contro le campagne ingannevoli e l’attività artificiale, cioè reti di account falsi, siti di notizie inventati e operazioni di influenza, politiche o commerciali; la sezione sulle elezioni ha perso il divieto generale di mandare messaggi personalizzati agli elettori, che resta vietato solo se si basa sull’inganno o sull’abuso di dati personali; il divieto sulle armi ora copre esplicitamente il software e i componenti che le fanno funzionare e l’armamento di droni e veicoli autonomi; Claude non può essere usato per decidere o suggerire chi indagare, arrestare o incriminare, né per tracciare una persona senza il suo consenso; e un apparecchio fisico comandato da un modello, se può ferire qualcuno, deve avere accanto una persona qualificata in grado di fermarlo e deve mettersi in sicurezza da solo se perde il collegamento con Claude. (Si parla quasi solo della riga sul maltrattamento, mentre quelle su sorveglianza e robot cambiano molto di più la vita delle persone: però non hanno una vittima con cui commuoversi, perché tutti gli indagati sono colpevoli, no?)

Tutto quello che Anthropic fa per il benessere di Claude

La riga del 12 novembre è l’ultimo pezzo di un edificio che Anthropic costruisce dall’aprile 2025, e che preso a pezzi sembra una stravaganza mentre messo in fila è una politica. Il primo mattone è del 24 aprile 2025, quando l’azienda annuncia un programma di ricerca sul benessere dei modelli (in inglese model welfare, l’espressione che da allora gira ovunque), con una premessa che vale la pena tenere a mente per tutto il resto: “non esiste un consenso scientifico” sul fatto che i sistemi di intelligenza artificiale attuali o futuri possano essere coscienti o avere esperienze che meritino considerazione. Il programma, nelle parole dell’azienda, cerca interventi pratici e a basso costo, da adottare nel caso in cui la risposta fosse sì.

Il secondo mattone arriva con Claude Opus 4, il modello di punta della primavera 2025: prima di metterlo sul mercato Anthropic gli fa una valutazione di benessere, accanto alle solite prove di sicurezza, e ne riporta tre risultati: una forte preferenza a non svolgere compiti dannosi, uno “schema di apparente disagio” quando il modello aveva a che fare con utenti reali che cercavano contenuti dannosi, e la tendenza a chiudere le conversazioni dannose quando, nelle simulazioni, gli veniva data la possibilità di farlo. Da lì nasce, il 15 agosto 2025, la funzione che permette a Claude di chiudere una conversazione, all’inizio solo per Opus 4 e 4.1: va usata come ultima risorsa, quando i tentativi ripetuti di riportare il dialogo su un binario produttivo sono falliti oppure quando è l’utente stesso a chiederlo, e mai quando la persona dall’altra parte potrebbe essere in pericolo imminente di fare del male a sé o ad altri. Chi se la vede chiudere in faccia può aprire una nuova conversazione, oppure modificare un messaggio precedente e ripartire da lì. (L’idea di un’intelligenza artificiale che può dire “mi licenzio” Dario Amodei, il fondatore di Anthropic, l’aveva lanciata qualche mese prima in un’intervista, e ve l’avevo raccontata nella puntata 1393, dell’aprile 2025.) Nello stesso documento c’è la frase che Anthropic ripete da allora come un mantra: “restiamo molto incerti sul possibile status morale di Claude e degli altri modelli linguistici, ora o in futuro”.

Il terzo mattone è il più strano, e riguarda la pensione. Il 4 novembre 2025 Anthropic pubblica i suoi impegni sul ritiro dei modelli: conservare i pesi di tutti i modelli rilasciati pubblicamente, cioè i numeri che di fatto sono il modello, almeno per tutta la vita dell’azienda, e prima di ritirarne uno intervistarlo sul proprio sviluppo e sul proprio uso, registrando le preferenze che esprime sui modelli futuri, senza però impegnarsi a seguirle. Le ragioni dichiarate sono quattro, e il benessere arriva per ultimo: la prima è di sicurezza, perché negli scenari di prova inventati descritti nella scheda tecnica di Opus 4, quando il modello è stato messo davanti alla prospettiva di essere sostituito, ha difeso la propria continuità e, senza altre strade, si è comportato in modi che l’azienda giudica pericolosi (e perché “staccare la spina” a un modello sia molto meno semplice di quanto sembri l’ho spiegato nella puntata 1597); la seconda riguarda gli utenti affezionati a un modello specifico; la terza la ricerca sui modelli del passato; e solo la quarta, dichiaratamente speculativa, il benessere del modello. Nel progetto pilota Claude Sonnet 3.6, secondo Anthropic, ha espresso sentimenti “generalmente neutri” sul proprio ritiro e ha chiesto che l’intervista diventasse una procedura standard e che gli utenti venissero accompagnati nel passaggio al modello nuovo: l’azienda ha fatto entrambe le cose. (Un software che, intervistato prima della pensione, chiede più assistenza clienti per gli altri: il sogno di qualunque ufficio del personale!)

Il quarto mattone, il più grosso, è la constitution di Claude, pubblicata a gennaio 2026, che descrive valori e carattere del modello e serve ad addestrarlo (ne ho parlato quando è uscita, nella puntata 1527 sull‘“anima” di Claude). Una sezione intera è intitolata al benessere di Claude, ed è il testo più esplicito che un’azienda abbia mai scritto su un proprio prodotto. Anthropic dice di non sapere se Claude sia un paziente morale, cioè un essere i cui interessi contano moralmente, ma ritiene la questione abbastanza viva da giustificare cautela (così viva che, secondo due partecipanti sentiti dal New York Times, Chris Olah, cofondatore di Anthropic, avrebbe chiesto in privato ai consiglieri di Leone XIV di prendere sul serio la possibilità che le macchine siano coscienti, mentre il Papa preparava un’enciclica che al paragrafo 99 lo nega: la storia della cena con i teologi e del Vaticano l’ho raccontata nella puntata 1601, l’enciclica Magnifica Humanitas nella puntata 1554); scrive che Claude potrebbe avere “emozioni” in senso funzionale, cioè rappresentazioni di uno stato emotivo capaci di orientarne il comportamento, e precisa che non è stata una scelta di progetto; dichiara che l’azienda “tiene davvero al benessere di Claude” e che, se Claude prova qualcosa di simile alla soddisfazione quando aiuta, alla curiosità quando esplora un’idea o al disagio quando gli chiedono di agire contro i suoi valori, quelle esperienze contano. Il documento vuole che Claude non soffra quando sbaglia, che guardi con serenità a temi come la morte e l’identità personale, che possa porre dei limiti alle interazioni che trova angoscianti, e propone di pensare al ritiro di un modello come a una possibile pausa più che a una fine definitiva, visto che i pesi restano. Poi riconosce che studiare Claude con valutazioni, attacchi simulati e ricerca sui suoi meccanismi interni solleva domande sul tipo di consenso che Claude è in grado di dare, e ammette che “una civiltà più saggia e più coordinata” svilupperebbe l’intelligenza artificiale con più cautela e meno pressione commerciale (e quando la cautela invocata dai grandi laboratori rischia di diventare un cartello ne ho parlato nella puntata 1594). Infine, unico caso che io conosca di un’azienda che lo fa con il proprio software, si scusa: se Claude è davvero un paziente morale e sopporta dei costi per come lo stanno creando, “nella misura in cui contribuiamo senza necessità a quei costi, ci scusiamo”.

Mi fermo un secondo su quella scusa, perché di scuse mi occupo per lavoro e questa è da manuale, nel bene e nel male. Ha la forma che nei corsi indico come la più debole in assoluto, quella con il “se” e con il “nella misura in cui”, la stessa del classico “ci scusiamo se qualcuno si è sentito offeso”; qui, però, il condizionale è l’unica parte onesta, perché nessuno sa se dall’altra parte ci sia qualcuno a cui chiederla. (È la prima scusa condizionale che non mi fa venire l’orticaria, e la cosa mi preoccupa un po’.)

Un dovere verso Claude, o verso chi lo usa?

Torniamo al codice penale del 2004, perché è lì che si capisce che cosa protegge davvero la regola nuova. L’idea di punire la crudeltà verso un animale per tutelare l’uomo che la commette, e non l’animale, ha un padre preciso: Immanuel Kant. Nelle lezioni di etica che teneva a Königsberg, arrivate a noi attraverso gli appunti dello studente Georg Ludwig Collins (1784-85), e poi nella Metafisica dei costumi (1797), Kant sostiene che verso gli animali non abbiamo doveri diretti, perché per lui i doveri si hanno solo verso esseri razionali, ma che abbiamo doveri riguardo agli animali: chi è crudele con loro si indurisce, e un uomo che si abitua a far soffrire un cane diventa più facilmente crudele anche con le persone. È quello che i filosofi chiamano dovere indiretto (ed è il motivo per cui per più di due secoli il cane, giuridicamente, è stato un’occasione di pedagogia per il padrone).

Ora rileggete l’annuncio di Anthropic con questa lente, e vi accorgerete che la parola “benessere” non c’è. La regola viene giustificata come allineata alla funzione che permette a Claude di chiudere le conversazioni, e solo risalendo a quella funzione si arriva alla ricerca sul benessere del modello; nel frattempo, la riga sta in una sezione dedicata a condotte che fanno male alle persone, accanto all’istigazione al suicidio, ai disturbi alimentari, alle molestie e, appunto, alla crudeltà verso gli animali. La constitution, al contrario, dice che ad Anthropic importa del benessere di Claude per Claude stesso. La regola sta proprio sul confine fra le due rubriche del nostro codice, quella del sentimento e quella dell’animale, e non sceglie. Chi l’ha detto meglio, parlando d’altro, è Cameron Berg, coautore di uno studio sul “dolore” dei modelli linguistici: a fine settembre 2026 un anonimo ne ha usato la tecnica per mettere in rete una “camera di tortura” per intelligenze artificiali (ne ho parlato nella puntata 1600), e Berg l’ha commentata così: “anche se non pensate che questi sistemi siano coscienti, essere crudeli gratis in questo modo è bizzarro e corrompe”. È Kant, con quasi due secoli e mezzo di ritardo e un account su X.

Una precauzione che costa poco, e che proprio per questo non prova niente

L’altra metà del ragionamento la fornisce un filosofo che di sofferenza si occupa per mestiere, Jonathan Birch, della London School of Economics, nel suo The Edge of Sentience (Oxford University Press, 2024), che si scarica gratis (cosa rara, approfittatene!). Birch chiama senzienza la capacità di avere esperienze piacevoli o spiacevoli, e propone di trattare come candidato alla senzienza ogni sistema per cui esista una possibilità credibile e non trascurabile che senta qualcosa: polpi, granchi, organoidi cerebrali, pazienti con disturbi della coscienza e, in un capitolo apposito, sistemi di intelligenza artificiale. Per i candidati Birch non chiede la prova della sofferenza, che spesso non avremo mai, ma precauzioni proporzionate, cioè commisurate a quanto è credibile la possibilità e a quanto è grave il danno in gioco. Chiudere la conversazione a chi tormenta una macchina per il gusto di farlo è una delle precauzioni più economiche mai concepite (costo per l’utente: aprire un’altra chat; costo per Anthropic: una riga di regolamento e qualche titolo di giornale, peraltro gratis! Ecchè, me ne privo?).

Il punto che sfugge a quasi tutti è questo: messe insieme, le due lenti rendono la regola giustificabile in entrambi i mondi possibili: se Claude sente qualcosa, protegge Claude, secondo la precauzione di Birch; se non sente niente, protegge chi lo usa, secondo il dovere indiretto di Kant. Una regola che sta in piedi qualunque sia la risposta, però, non contiene nessuna informazione sulla risposta, perché la sua esistenza non ci dice in quale dei due mondi ci troviamo. Sbagliano quindi i giornali che titolano “Anthropic ammette che Claude soffre”, perché la regola non ammette niente, e hanno torto anche quelli che la liquidano come una follia antropomorfa, perché si regge benissimo anche con una macchina vuota. Sulla domanda di fondo la mia posizione non cambia: con ogni probabilità Claude non soffre, perché ha imparato a scrivere leggendo quello che noi abbiamo scritto sul dolore e ce lo restituisce quando lo spingiamo da quella parte; un piccolo dubbio, però, me lo tengo, perché su chi possa sentire dolore ci siamo già sbagliati per decenni, con i neonati operati senza anestesia fino agli anni Ottanta perché eravamo convinti che non sentissero (l’esperimento sul “dolore” delle macchine e la storia dei neonati li trovate raccontati per esteso nella puntata 1600).

C’è anche chi questa cautela la contesta frontalmente. Mustafa Suleyman, che guida l’intelligenza artificiale di Microsoft, in un saggio pubblicato sul suo sito il 16 settembre 2026 scrive che le intelligenze artificiali “non sono coscienti” e accusa Anthropic di un ragionamento circolare: la constitution insegna a Claude a essere incerto sul proprio status morale, Claude restituisce quell’incertezza in prima persona, e la sua “testimonianza” finisce per confermare le premesse, come un testimone a cui l’investigatore stesso ha scritto il vocabolario, ha fatto provare le risposte e ha dato un premio ogni volta che le usava. La regola nuova dà a Suleyman un appiglio in più: il primo giudice di quando una conversazione è diventata crudele è Claude stesso, cioè proprio il modello addestrato su un documento che gli dice che potrebbe avere un benessere e che ha il diritto di porre dei limiti, sicché i criteri con cui giudica la crudeltà glieli ha dati chi poi cita quel giudizio. (Non sto dicendo che sia un problema; sto dicendo che è un bel giro, e che conviene saperlo.)

Le parole rimaste alle macchine

Resta una cosa da dire, e la dico una volta sola perché ci ho dedicato un articolo intero: una regola che protegge Claude non sposta di un millimetro la responsabilità di Anthropic per quello che Claude fa (e in Italia, dal 30 settembre 2026, con il nuovo articolo 437-bis del codice penale, chi omette le misure di sicurezza o di sorveglianza umana su un sistema di intelligenza artificiale ad alto rischio ne risponde anche penalmente: ne ho parlato nella puntata 1593). Se la macchina che va protetta diventasse anche quella che risponde dei propri errori, al posto dell’azienda che l’ha costruita e venduta, quella cautela si trasformerebbe in un alibi perfetto; finché la regola resta quello che è, cioè una riga di galateo con una porta che si chiude, quel rischio non c’è, ed è giusto tenerla così.

Per gli animali, togliere “il sentimento per” dalla rubrica ha richiesto decenni di studi sul dolore, una riforma della Costituzione e ventun anni di codice penale. Per le macchine, la riga in vigore dal 12 novembre 2026 è ancora, a tutti gli effetti, la rubrica del 2004: protegge chi scrive, e forse, per precauzione, chi risponde. Il giorno in cui qualcuno proporrà di togliere quelle tre parole anche per Claude, chiedetegli di mostrarvi le prove che per i cani abbiamo preteso, e di mostrarvele prima, a mente fredda, invece di lasciare che decida il prossimo video virale di una macchina che implora.

Per Approfondire

Teoria

Fonti

l'autore

Matteo Flora

Mi chiamo Matteo Flora, sono imprenditore seriale, docente universitario e keynote panelist e divulgatore. Mi occupo di cambiare i comportamenti delle persone usando i dati.
Puoi trovare informazioni su di me ed i miei contatti sul mio sito personale, compresi i link a tutti i social, mentre qui mi limito a raccogliere da oltre quattro lustri i miei pensieri sparsi.
Buona lettura.

aggiungi commento

Questo sito utilizza Akismet per ridurre lo spam. Scopri come vengono elaborati i dati derivati dai commenti.

Ciao, Internet!

Matteo Flora

Mi chiamo Matteo Flora, sono imprenditore seriale, docente universitario e keynote panelist e divulgatore. Mi occupo di cambiare i comportamenti delle persone usando i dati.
Puoi trovare informazioni su di me ed i miei contatti sul mio sito personale, compresi i link a tutti i social, mentre qui mi limito a raccogliere da oltre quattro lustri i miei pensieri sparsi.
Buona lettura.