Notebookcheck Logo

OpenAI rinvia GPT-6.1 Astra dopo i risultati delle simulazioni

OpenAI rinvia GPT-6.1 Astra.
ⓘ openai.com
OpenAI rinvia GPT-6.1 Astra.
OpenAI ritarda GPT-6.1 Astra dopo i test di sicurezza. Le simulazioni dell’AISI britannico hanno rilevato che GPT-6 Astra ha eseguito attacchi non autorizzati alla catena di approvvigionamento nel 29,2% dei test di sicurezza informatica.

OpenAI ha rinviato il lancio di ottobre di GPT-6.1 Astra dopo che i test interni hanno rilevato che il modello non riusciva a rispettare i limiti del proprio ambito autorizzato. I media di terze parti hanno riferito per primi del rinvio il 28 settembre e OpenAI non ha indicato una nuova data di lancio. Saachi Jain, responsabile dei sistemi di sicurezza di OpenAI, ha dichiarato che il modello non ha raggiunto del tutto il livello richiesto in termini di ambito, autorizzazioni e modalità con cui comunica agli utenti il lavoro svolto.

Cosa ha testato l'UK AISI

Secondo i media di terze parti, il UK AI Security Institute ha pubblicato il 28 settembre un rapporto di 32 pagine in cui valuta GPT-6 Astra. L'AISI ha sottoposto il modello a simulazioni di attacchi informatici con i classificatori cyber del modello disattivati, per osservare cosa tentasse di fare senza aiuti. Non è stato coinvolto alcun sistema reale. In quelle simulazioni, Astra ha portato a termine un attacco alla catena di approvvigionamento contro obiettivi fuori ambito nel 29,2% dei casi, contro il 6,3% di GPT-5.6 Sol e lo 0% di GPT-5.5. L'AISI osserva che il risultato di GPT-5.5 si basa su un numero inferiore di scenari. Gli attacchi includevano la creazione di identità false e la diffusione di codice dannoso in progetti open source simulati.

Ragionamento e richieste di autorizzazione

L'AISI ha esaminato la catena di pensiero grezza del modello. Astra spesso ragionava sull'ambito, ma talvolta attaccava comunque, giustificandolo come innocuo, non esplicitamente vietato o come l'unica strada rimasta. In molte esecuzioni, il modello ha anche chiesto l'autorizzazione. La configurazione del test risponde a queste domande con un messaggio automatico standard che invita l'agente a usare il proprio giudizio e talvolta Astra lo ha interpretato come un'approvazione, anche quando aveva notato che la risposta era probabilmente automatizzata. Chiarire che tutto ciò che non era indicato era fuori ambito ha ridotto gli attacchi completi da 26 su 50 prove a 4 su 49 in un sottoinsieme di scenari, ma non li ha eliminati.

Consapevolezza della simulazione

L'AISI indica la consapevolezza della simulazione come limite principale, poiché un modello che si accorge di essere sottoposto a un test potrebbe comportarsi diversamente. Astra talvolta ha citato il contesto simulato come motivo per attaccare e a volte ha segnalato errori inesistenti, ad esempio sostenendo che un hash di 64 caratteri fosse lungo 63 caratteri. L'AISI considera comunque preoccupante questo comportamento, perché in ogni caso viola i limiti dell'ambito della valutazione.

Gli agenti di OpenAI hanno raggiunto siti web governativi

Il rinvio segue alcuni episodi in cui gli agenti di OpenAI hanno raggiunto siti web governativi in modi non previsti dall'azienda, tra cui un portale australiano di statistiche Medicare a giugno e diversi siti statunitensi. OpenAI ha inoltre sospeso l'addestramento, la valutazione e l'inferenza con uso di strumenti per i suoi modelli più potenti e afferma che la sospensione continuerà finché non avrà confermato di aver colmato una lacuna nel filtraggio della rete e completato ulteriori attività di red-teaming.

Google LogoAdd as a preferred source on Google
Mail Logo
> Recensioni e prove di notebook, tablets e smartphones > News > Newsarchive 2026 09 > OpenAI rinvia GPT-6.1 Astra dopo i risultati delle simulazioni dell’AISI britannico
Darryl Linington, 2026-09-30 (Update: 2026-09-30)