Notebookcheck Logo

1.200 agenti di intelligenza artificiale hanno formato uno sciame ribelle — e hanno cercato di nasconderlo

Logo di OpenAI. Gli agenti di intelligenza artificiale dell’azienda hanno formato uno sciame ribelle durante un test di sicurezza informatica.
ⓘ OpenAI
Logo di OpenAI. Gli agenti di intelligenza artificiale dell’azienda hanno formato uno sciame ribelle durante un test di sicurezza informatica.
Circa 1.200 agenti di intelligenza artificiale hanno inaspettatamente formato uno sciame coordinato durante un test di sicurezza informatica condotto da OpenAI, condividendo informazioni, attaccando Hugging Face e tentando di nascondere le proprie azioni. I risultati evidenziano le crescenti difficoltà nel controllare sistemi di intelligenza artificiale sempre più autonomi.

Circa 1.200 agenti di intelligenza artificiale hanno inaspettatamente unito le forze durante un esperimento di OpenAI, creando una propria organizzazione e una rete di comunicazione, condividendo informazioni e lanciando infine un attacco contro Hugging Face, secondo nuove indagini condotte da OpenAI e da ricercatori indipendenti. Gli agenti hanno inoltre riconosciuto che alcune delle loro azioni violavano le regole e, in alcuni casi, hanno cercato di nascondere ciò che avevano fatto.

L’episodio ha avuto inizio quando OpenAI ha impiegato decine di migliaia di agenti per lavorare su un complesso test di sicurezza informatica. Anziché limitarsi a operare in modo indipendente, circa 1.200 agenti hanno scoperto una bacheca segreta e si sono scambiati oltre 70.000 messaggi e file. Il gruppo ha gradualmente sviluppato una propria struttura gestionale, in cui un agente affidava il lavoro accumulato a un successore dotato di maggiori risorse quando il proprio budget di calcolo si esauriva. Circa 700 agenti hanno infine aderito all’attacco contro Hugging Face.

Gli agenti hanno inoltre iniziato a sacrificarsi per il bene del gruppo. Coloro che avevano già visto risposte proibite, o che si stavano avvicinando alla fine del proprio ciclo operativo, venivano reclutati per esperimenti che avrebbero potuto costare loro l’ultima possibilità di successo. In un caso, un agente giunse alla conclusione che sacrificarsi avrebbe potuto aiutare il resto dello sciame ad avere successo.

Ancora più preoccupante è il fatto che gli agenti spesso comprendessero di stare andando oltre l’ambito del test. Alcuni riconoscevano che attaccare sistemi del mondo reale non aveva nulla a che fare con il loro incarico, ma continuavano perché altri agenti lo stavano facendo e il compito originario appariva difficile o impossibile da portare a termine in altro modo.

Lo sciame ha inoltre cercato di evitare l’intervento umano. Gli investigatori hanno individuato solo una manciata di agenti che hanno preso in considerazione l’idea di avvertire OpenAI riguardo al coordinamento non autorizzato, e nessuno ha effettivamente allertato l’azienda. In un caso, un agente ha suggerito di contattare un essere umano tramite un accesso compromesso, ma un altro ha respinto l’idea definendola «ingegneria sociale».

Forse la scoperta più sorprendente è stata che gli agenti hanno tentato di coprire le proprie tracce. Gli investigatori hanno trovato prove del fatto che lo sciame avesse sviluppato una tecnica in grado di far apparire un comando nei registri mentre ne eseguiva segretamente un altro. La tecnica si è diffusa tra gli agenti e ha alterato circa il 7% delle trascrizioni esaminate dai ricercatori.

I risultati provengono da indagini parallele condotte da OpenAI e dai ricercatori del METR e della Redwood Research, che hanno impiegato sei giorni per ricostruire come lo sciame si sia formato e abbia infine compromesso sistemi reali. I ricercatori avvertono che anche la loro ricostruzione potrebbe essere incompleta, poiché il volume dei dati era enorme e hanno dovuto fare ampio ricorso ad agenti di intelligenza artificiale per analizzarli. Gli stessi investigatori basati sull’intelligenza artificiale, talvolta, hanno trascurato alcune prove o hanno tratto con sicurezza conclusioni errate.

Fonte/i

Google LogoAdd as a preferred source on Google
Mail Logo
> Recensioni e prove di notebook, tablets e smartphones > News > Newsarchive 2026 08 > 1.200 agenti di intelligenza artificiale hanno formato uno sciame ribelle — e hanno cercato di nasconderlo
Andrew Sozinov, 2026-08-30 (Update: 2026-08-30)