articoli

Anthropic chiede di rallentare, ma intanto lancia un nuovo modello?

Opus 5.5 arriva dopo l’appello di Amodei alla prudenza. Che cosa promette davvero Anthropic e quali prove servono per valutarne le scelte.

Niccolò Falaschi · 28 Settembre 2026 · 4 min di lettura · #dal mondo · #intelligenza artificiale
ai generated

Un nuovo Claude dopo l’appello alla prudenza

Il 22 settembre Anthropic ha presentato Claude Opus 5.5. Il lancio arriva nello stesso mese in cui il suo amministratore delegato Dario Amodei ha chiesto di rallentare l’avanzamento delle capacità dell’intelligenza artificiale. La domanda è inevitabile: perché mettere sul mercato un modello nuovo mentre si invita l’industria a frenare?

Per rispondere bisogna capire quale impegno sia stato preso. Contare le uscite dice poco sul tempo dedicato ai controlli. Allo stesso modo, una promessa di prudenza ha valore soltanto se può cambiare le decisioni dell’azienda, anche quelle commercialmente convenienti.

Che cosa ha promesso Amodei

Nel saggio We Must Pace the Frontier, Amodei chiede esplicitamente di rallentare la crescita delle capacità dei modelli. Chiarisce però che questo non significa sospendere gli addestramenti o ogni progresso tecnico: l’obiettivo dichiarato è dare più tempo alla sicurezza e alle verifiche esterne.

L’impegno che Anthropic assume autonomamente riguarda valutatori indipendenti con accesso continuativo a strumenti, processi e informazioni interne. Dovrebbero poter pubblicare le proprie conclusioni senza controllo editoriale dell’azienda, con eccezioni circoscritte per informazioni riservate. Nel testo l’ingresso del gruppo esterno è ancora descritto come un passo da realizzare a breve.

Le altre parti del piano richiedono collaborazione fra imprese e governi. Non viene annunciato un divieto generale di lanciare nuovi Claude. Ne deriva un criterio di lettura: Opus 5.5, da solo, non dimostra né il rispetto né la violazione della promessa. Occorre capire quali vincoli abbiano inciso sul suo sviluppo.

Due persone confrontano documenti e osservano lo stesso prototipo durante una verifica indipendente. ai generated

I test dichiarati e il limite che resta

Nell’annuncio del modello, Anthropic afferma di aver coinvolto prima del rilascio valutatori esterni, fra cui METR e Frontier Design. Riferisce inoltre miglioramenti nei propri test comportamentali rispetto ai Claude recenti.

Sono informazioni rilevanti, ma una valutazione precedente al lancio non dimostra automaticamente che sia già operativo l’accesso permanente descritto da Amodei. Per stabilirlo servono dettagli sul mandato, sulla durata dell’accesso e sulla libertà effettiva di riferire i risultati.

La stessa Anthropic segnala un limite: Opus 5.5 spesso sembra riconoscere quando viene valutato. Questo rende più difficile prevederne il comportamento nelle molte situazioni d’uso reali. Un buon risultato nei test non elimina l’incertezza fuori dal test.

È anche il motivo per cui una classifica delle prestazioni non può chiudere il confronto sulla sicurezza. Scrivere codice corretto, rispettare un’autorizzazione e fermarsi quando manca un’informazione sono proprietà diverse. Un’azienda che introduce un assistente nei propri processi deve stabilire quali di queste proprietà siano decisive per il lavoro affidato.

Un costo più basso può allargare l’uso

C’è poi un secondo aspetto. Nella documentazione della piattaforma, il prezzo standard è di 4 dollari per milione di token in ingresso e 20 in uscita, contro i precedenti 5 e 25 dollari di Opus 5. Il taglio di queste tariffe è dunque del 20%.

Il risparmio complessivo del 40% comunicato da Anthropic è invece una stima su carichi di lavoro tipici: combina prezzi e maggiore efficienza nell’esecuzione. Non equivale a uno sconto identico su qualsiasi attività o abbonamento.

La distinzione conta anche nella discussione sul rallentamento. Se svolgere un compito costa meno, diventa possibile affidare al sistema più compiti con lo stesso budget. È una conseguenza economica plausibile, non una misura dell’adozione già avvenuta. Mostra però perché la diffusione di una tecnologia vada osservata insieme alle sue capacità.

Per un’impresa il confronto utile comprende anche il tempo necessario a verificare e correggere l’output. In un esempio ipotetico, una relazione generata a metà prezzo può costare di più nel complesso se richiede una lunga ricostruzione delle fonti.

Il costo di un lavoro comprende sia l'esecuzione automatica sia il controllo del risultato. ai generated

Le prove da cercare nei prossimi rilasci

Per valutare la promessa di Anthropic saranno utili elementi concreti:

  1. Accesso dei valutatori: quali parti dello sviluppo possono esaminare e quali restano escluse.
  2. Decisioni conseguenti: quali problemi hanno comportato correzioni, restrizioni o rinvii.
  3. Confronti ripetibili: risultati ottenuti in condizioni comparabili, con i limiti dichiarati.
  4. Resoconti indipendenti: cosa possono raccontare i valutatori anche quando il risultato è scomodo.

Chi compra servizi AI non deve risolvere l’intero dibattito per decidere se usare un modello. Può però chiedere al fornitore informazioni pertinenti al proprio rischio e mantenere controlli proporzionati sulle attività delegate. La domanda decisiva resta concreta: quali verifiche hanno cambiato ciò che il sistema è autorizzato a fare?

dal mondo intelligenza artificiale

Niccolò Falaschi

founder

appassionato di comunicazione, tecnologia, ai, aiuto le aziende a migliorare il posizionamento e la reputazione dei loro brand.