Il 30 aprile 2026 l’AI Security Institute del Regno Unito (AISI) ha pubblicato la propria valutazione delle capacità cyber di GPT-5.5, il modello rilasciato da OpenAI sette giorni prima. La conclusione operativa è netta: GPT-5.5 è tra i modelli più capaci che AISI abbia mai testato, su un asse paragonabile a quello di Claude Mythos Preview di Anthropic.
Perché questa valutazione conta
AISI è un istituto pubblico britannico costruito specificamente per condurre red-teaming indipendente sui modelli frontier. Le sue valutazioni sono uno dei pochi punti di riferimento istituzionali non legati ai laboratori che producono i modelli. Quando AISI dichiara che un modello commerciale ha capacità cyber comparabili a un modello che il governo americano sta cercando di limitare in distribuzione, il piano di gioco si allarga.
Cosa cambia nel dossier Mythos
Per settimane il dibattito si era concentrato su come Anthropic stava mitigando i rischi di Mythos: Project Glasswing, accesso ristretto a circa 50 organizzazioni, opposizione della Casa Bianca all’estensione a 70 nuove. La valutazione AISI sposta il fuoco:
- la concentrazione del rischio su un solo laboratorio è un’illusione operativa: GPT-5.5 e Mythos esprimono capacità sovrapponibili, e il primo è già rilasciato a centinaia di milioni di utenti;
- la politica di contenimento di un singolo modello frontier perde efficacia se i concorrenti hanno già rilasciato un modello con capacità comparabili sul mercato di massa;
- la regolazione del modello dovrebbe spostarsi dal singolo laboratorio al perimetro di capacità: cosa può o non può fare un modello, indipendentemente da chi lo produce.
La risposta di OpenAI
Sam Altman ha annunciato in concomitanza con la pubblicazione AISI il rilascio limitato di una variante GPT-5.5-Cyber riservata a «critical cyber defenders». La forma di accesso ricalca quella di Mythos: solo organizzazioni che possono dimostrare uso difensivo legittimo. La differenza è che il modello base, GPT-5.5, ha già le capacità cyber documentate da AISI ed è accessibile a tutti.
Implicazioni per chi gestisce un perimetro
Per CISO e responsabili sicurezza, due conseguenze immediate:
- le tecniche di vulnerability discovery che si pensavano riservate al modello frontier riservato sono di fatto disponibili sul mercato di massa, anche se i provider possono restringerle con guardrail;
- la valutazione del rischio di un attaccante con accesso a strumenti di nuova generazione è ora un’assunzione realistica: la pipeline di patch e di hardening dovrebbe già tener conto di un avversario con queste capacità.
Fonti
AI Security Institute (UK), «Our evaluation of OpenAI’s GPT-5.5 cyber capabilities», 30 aprile 2026: aisi.gov.uk. Sam Altman, post X del 30 aprile 2026 sul rilascio di GPT-5.5-Cyber.
