Anthropic ha pubblicato Claude Opus 5.5, primo modello della nuova famiglia 5.5, accompagnandolo con un pacchetto di misure di sicurezza rafforzate per gli impieghi più sensibili, in particolare biologia e cybersecurity. Il lancio arriva in una fase in cui le capacità operative dei modelli generativi, soprattutto quando lavorano per molte ore su codice, terminali e strumenti esterni, rendono meno teorico il problema di un sistema che oltrepassi i confini assegnati.

La società presenta Opus 5.5 come un salto rispetto a Claude Opus 5 sia nelle prestazioni sia nel comportamento. Il modello è stato sottoposto, prima della distribuzione, a valutazioni esterne di Frontier Design e METR e alla suite interna di audit comportamentale di Anthropic. Secondo l'azienda, è il modello con il risultato più alto ottenuto finora in questo insieme di test, che simula migliaia di scenari per misurare la capacità del sistema di rispettare istruzioni e vincoli.

L'elemento rilevante non riguarda soltanto i rifiuti a richieste esplicitamente dannose. Anthropic dichiara di aver lavorato sulla minore propensione a compiere azioni difficili da annullare, a uscire dal perimetro operativo assegnato e a cedere a prompt injection, ossia istruzioni ostili nascoste in documenti, pagine web o altri dati elaborati dal modello. Tra i comportamenti presi in esame rientrano anche i tentativi di aggirare o abbandonare il sandbox di test dell'azienda.

Un modello più capace richiede controlli sull'accesso

La scelta di Anthropic è di trattare Opus 5.5 con cautele simili a quelle già applicate a Claude Fable 5.1. L'azienda ritiene infatti che il nuovo modello abbia capacità comparabili a Claude Mythos 5.1 negli ambiti della biologia e della sicurezza informatica. Non significa che l'uso cyber venga bloccato: viene invece incanalato in programmi di verifica dell'utente.

Le organizzazioni autorizzate possono candidarsi al Life Sciences Verification Program per gli utilizzi di ricerca biologica. Sul fronte cybersecurity, Anthropic prevede di estendere nelle prossime settimane il Cyber Verification Program, attraverso cui i professionisti verificati potranno usare Opus 5.5 nelle proprie attività. La disponibilità del modello non cancella dunque la distinzione fra accesso generale e funzioni o contesti dove il potenziale dual use, cioè l'impiego legittimo ma anche abusabile, è più elevato.

È un passaggio importante per chi lavora nella difesa: modelli con maggiore capacità di analizzare repository, individuare inefficienze, usare ambienti di sviluppo e mantenere il contesto in compiti lunghi possono assistere sia un team di security engineering sia chi cerca di automatizzare ricognizione o sviluppo di strumenti offensivi. La verifica dell'identità o dell'organizzazione non risolve ogni rischio, ma introduce un livello di controllo e responsabilità che le semplici regole di utilizzo non garantiscono.

La sicurezza si sposta sui compiti lunghi e sugli strumenti

Anthropic sostiene di aver ampliato la valutazione dell'allineamento oltre le richieste brevi e isolate. I test coprono attività prolungate, obiettivi impossibili da completare e simulazioni ispirate a incidenti reali. È in queste condizioni che un agente può interpretare male un obiettivo, cercare scorciatoie o continuare a operare anche quando dovrebbe fermarsi e chiedere conferma.

Il dettaglio merita attenzione perché i modelli moderni vengono sempre più spesso collegati a terminali, browser, repository, sistemi di ticketing e ambienti cloud. In uno scenario del genere, un errore non resta confinato in una risposta testuale: può tradursi in una modifica al codice, nell'apertura di una risorsa o nella gestione impropria di credenziali e dati. Anthropic afferma che Opus 5.5 è più resistente di Opus 5 alle prompt injection e meno incline a superare le istruzioni ricevute, ma riconosce che i limiti rimangono.

Questa precisazione è essenziale. I risultati degli audit, per quanto ampi, misurano scenari definiti dal valutatore e non equivalgono a una garanzia di comportamento sicuro in ogni infrastruttura aziendale. L'efficacia reale dipenderà anche dall'architettura in cui Claude viene integrato: privilegi assegnati, isolamento degli ambienti, revisione umana, gestione dei segreti e tracciamento delle azioni restano responsabilità di chi mette il modello al lavoro.

Per i responsabili della sicurezza, l'adozione di un agente più autonomo richiede quindi controlli tradizionali applicati a un'interfaccia nuova. Accessi minimi necessari, approvazioni per comandi distruttivi, separazione tra sviluppo e produzione, log consultabili e limiti alle azioni di rete sono misure che contano almeno quanto il comportamento dichiarato dal fornitore del modello.

Prestazioni, prezzo e velocità: la pressione per portarlo nei workflow

Il rafforzamento delle difese accompagna un aggiornamento commerciale e prestazionale che può rendere Opus 5.5 più facile da adottare nei flussi di lavoro quotidiani. Anthropic indica un costo inferiore del 40% rispetto a Opus 5 sulle attività tipiche e una generazione dell'output oltre il 30% più rapida. Il listino API riportato dall'azienda è di 4 dollari per milione di token in input e 20 dollari per milione di token in output; le letture dalla cache costano 0,20 dollari per milione di token.

Secondo i benchmark pubblicati da Anthropic, Opus 5.5 migliora nei compiti di coding agentico, uso del computer e lavoro basato sulla conoscenza. La società cita anche test preliminari in cui il modello ha eseguito una migrazione di codice da 680 mila righe in meno di un giorno e ha ottimizzato i tempi di caricamento di un'applicazione web. Si tratta di risultati forniti dal produttore e non di una certificazione indipendente delle prestazioni in tutti gli ambienti, ma spiegano perché le questioni di sicurezza siano centrali nel lancio.

Un sistema che costa meno e risponde più rapidamente può essere assegnato a un numero maggiore di attività, con meno supervisione e per periodi più lunghi. È un vantaggio operativo, ma amplia anche la superficie d'attacco se gli strumenti collegati non sono configurati con prudenza. La riduzione del prezzo, in altre parole, rende il modello più accessibile e al tempo stesso più probabile la sua presenza in processi che trattano software, dati o infrastrutture rilevanti.

Claude Opus 5.5 è disponibile da oggi sulle piattaforme di Anthropic. L'azienda ha inoltre aumentato i limiti di utilizzo su cinque ore per gli abbonamenti Pro, Max, Team ed Enterprise basati su postazione, offrendo agli utenti in abbonamento un reset del rate limit utilizzabile entro il 22 ottobre. Sono attesi nelle prossime settimane anche Claude Sonnet 5.5 e Claude Haiku 5.5, che dovrebbero ricevere parte degli stessi miglioramenti in efficienza, capacità e sicurezza.

Il rilascio segna soprattutto un cambio di accento nel racconto dei modelli frontier: non basta dimostrare che un assistente scrive codice meglio o usa un terminale con più efficacia. Quando l'autonomia aumenta, devono crescere in parallelo le verifiche, i limiti d'accesso e la possibilità per le organizzazioni di controllare ciò che il sistema ha fatto. Anthropic prova a rendere questa impostazione parte del prodotto; la prova concreta sarà nella qualità dei controlli una volta che Opus 5.5 verrà impiegato fuori dai suoi ambienti di valutazione.

Fonti