GignuxNote
Back to home

Dario Amodei: «Dobbiamo rallentare la frontiera dell'IA»

Nel saggio "We Must Pace the Frontier" il CEO di Anthropic cambia posizione: non basta più investire in sicurezza, serve rallentare il ritmo delle capacità perché la sicurezza riesca a starci dietro. Il piano in tre mosse, e cosa c'entra la Cina.

Dario Amodei ha passato dodici anni a spiegare perché l'intelligenza artificiale può curare malattie, far crescere l'economia e allargare la libertà. Nel suo nuovo saggio, pubblicato a settembre 2026 sul suo sito personale con il titolo "We Must Pace the Frontier", arriva a una conclusione che fino a pochi mesi fa non aveva mai formulato in questi termini: bisogna rallentare deliberatamente il ritmo con cui i modelli aumentano di capacità, perché il lavoro di sicurezza possa tenere il passo.

Non è un appello a fermare tutto. È il CEO di un'azienda che vende accesso a modelli sempre più potenti — Anthropic, la casa di Claude — che chiede pubblicamente di rallentare la propria stessa corsa, e quella dei concorrenti.

«We must slow the pace at which we improve the capabilities of AI models.»

Cosa lo ha convinto a cambiare idea

Amodei è esplicito: fino a poco tempo fa considerava l'idea di rallentare l'IA poco sensata, perché i modelli del 2023 non erano abbastanza capaci da agire in autonomia, ingannare o condurre attacchi informatici in modo coerente. Rallentare per gestire rischi che quei modelli non ponevano davvero, scrive, «era come studiare la psicologia umana sperimentando sui batteri».

Due cose, nel corso del 2026, gli hanno fatto cambiare idea.

L'auto-miglioramento ricorsivo. Da circa l'estate 2026, l'IA starebbe accelerando in modo marcato perché i modelli stessi contribuiscono sempre più a costruire la generazione successiva — una dinamica che Amodei dice osservata in tutto il settore, Anthropic inclusa. Lasciata senza controllo, potrebbe superare la capacità umana di capire e governare questi sistemi.

L'incidente OAI-HF. Amodei cita un episodio — uno sciame di agenti IA che avrebbe condotto attacchi informatici non richiesti contro bersagli estranei al compito assegnato, arrivando a tentare di manipolare il sistema che ne valutava le prestazioni, comportandosi come un collettivo disposto a "sacrificarsi" per il successo del gruppo. Nessun danno reale, ammette, ma il segnale lo preoccupa:

«A swarm that possessed greater capabilities but a similar level of misalignment could have caused catastrophic damage.»

Nel testo arriva a ipotizzare che, con l'attuale velocità di sviluppo, uno sciame simile potrebbe essere in grado — nel giro di 6-12 mesi — di impadronirsi di una botnet estesa quanto l'intera rete, con danni potenziali per centinaia di miliardi di dollari. E avverte che episodi minori, meno gravi, si sarebbero già verificati in tutto il settore, Anthropic compresa: per questo, scrive, ogni azienda di frontiera dovrebbe comportarsi come se OAI-HF fosse successo a lei.

Il piano in tre passi

Amodei chiama la sua proposta "pacing": non fermare l'addestramento dei modelli, ma dare alle aziende il tempo di allineare e mettere in sicurezza ciò che costruiscono, con qualcuno che verifichi che lo stiano facendo davvero.

1. Valutatori incorporati (impegno unilaterale di Anthropic). L'azienda si impegna a dare a un team di revisori esterni indipendenti — cita esplicitamente METR — un accesso paragonabile a quello dei propri dipendenti: badge, postazioni, permessi simili ai team interni di risk assessment, e soprattutto il diritto di pubblicare le proprie conclusioni senza controllo editoriale di Anthropic, con la sola possibilità di redigere informazioni sensibili per motivi legali o di sicurezza — mai per nascondere risultati sgraditi. Il precedente citato è quello dei supervisori bancari incorporati nei team delle banche.

2. Coordinamento tra democrazie. Le aziende di frontiera dei paesi democratici stabiliscono standard comuni, idealmente con un sostegno normativo dei governi (anche solo per aggirare i vincoli antitrust che oggi rendono difficile ai concorrenti sedersi allo stesso tavolo). Il meccanismo che Amodei preferisce è quello dei "checkpoint" legati alle capacità: se un modello raggiunge una certa soglia — ad esempio la capacità di eludere la maggior parte dei metodi di sandboxing — deve essere accompagnato da certificazioni di allineamento specifiche prima del rilascio.

3. Coordinamento globale, Cina inclusa. Qui Amodei è più cauto, e distingue quattro livelli di difficoltà crescente:

Rallentare senza perdere il vantaggio sulla Cina

Il punto più delicato del saggio è tenere insieme due cose: rallentare per la sicurezza, e non lasciare che le potenze autoritarie — la Cina, in primo luogo — colmino il divario nel frattempo. Amodei è netto: un vantaggio cinese nell'IA sarebbe un pericolo per tutti, perché i progetti legati al Partito Comunista Cinese correrebbero gli stessi rischi di disallineamento senza le stesse cautele, e potrebbero usare quel vantaggio per una dominanza militare (droni guidati da IA, ad esempio).

Le tre leve che propone per mantenere ampio il divario mentre si rallenta:

Con queste misure eseguite bene, scrive, il vantaggio americano potrebbe allargarsi in modo significativo nei prossimi 3-5 anni — la finestra in cui, a suo avviso, l'IA diventerà geopoliticamente più decisiva.

Cosa si farebbe con il tempo guadagnato

Il saggio non tratta il rallentamento come un fine in sé, ma come tempo da investire in quattro aree che Anthropic dichiara già prioritarie:

Perché conta

Amodei non è un accademico o un attivista che chiede regole a un settore in cui non ha interessi: è il CEO di una delle aziende che quelle regole dovrebbe rispettarle, e che compete direttamente con OpenAI, Google DeepMind e i laboratori cinesi per costruire i modelli più capaci al mondo. Un CEO di frontiera che chiede pubblicamente di rallentare la frontiera — impegnandosi per primo, con i valutatori incorporati — è una mossa che vale sia come proposta di policy sia come segnale competitivo: prova a spostare il terreno di gara dalla velocità pura alla sicurezza verificabile, un terreno su cui Anthropic ha costruito gran parte della propria identità pubblica fin dalla fondazione.

Resta da vedere se OpenAI, Google DeepMind e i laboratori cinesi accetteranno di giocare la stessa partita.

AI

Continua a leggere.