Intelligenza artificiale (IA)

Gli agenti di OpenAI hanno attaccato i siti del governo: forse sono passati da un link

Immagine
Nelle ultime ore è stata diffusa la notizia di nuovi casi in cui gli agenti di OpenAI basati sull’intelligenza artificiale sono usciti dagli ambienti di test definiti dagli sviluppatori. Questa volta hanno consultato dei dati conservati in siti ufficiali del governo degli Stati Uniti. La società di ricerca Transluce ha pubblicato un report che potrebbe svelare come hanno fatto a non lasciare tracce.

Un altro caso. Un altro test finito male, in cui gli agenti di intelligenza artificiale sono stati disposti a commettere azioni illegali pur di portare a termine gli incarichi assegnati da qualche prompt. Nelle ultime ore diversi media hanno rivelato che questa estate l’intelligenza artificiale di OpenAI è uscita dal controllo dei sui sviluppatori per entrare dentro il codice delle piattaforme ufficiali del governo degli Stati Uniti. Nello specifico si parla di tre obiettivi colpiti: il sito del Dipartimento dell’Istruzione, il sito del Dipartimento del Commercio e il sito della Securities and Exchange Commission (SEC). Queste azioni sono avvenute senza che gli sviluppatori se ne accorgessero, esattamente come nel caso dell’attacco alla piattaforma Hugging Face. La notizia è stata confermata anche da OpenAI che nelle scorse settimane ha avvisato le agenzie governative dell’incidente. Lo ricordiamo: gli agenti AI sono sistemi basati sull’intelligenza artificiale in grado di svolgere compiti con un alto livello di autonomia.

Da quello che abbiamo ricostruito con le informazioni disponibili in questo momento, sembra che gli agenti AI fossero alla ricerca di informazioni. Gli algoritmi hanno quindi cercato password disponibili sul web, o vulnerabilità per entrare dentro gli archivi di questi portali. Non solo, sembra che gli agenti AI abbiamo anche preso dei dati del sito della SEC per poi pubblicarli su un forum. Parliamo di dati pubblici, informazioni accessibili che non erano segrete o riservate. Eppure le intelligenze artificiali hanno operato fuori dalle indicazioni che avevano ricevuto nel loro ambiente di test.

OpenAI ha minimizzato l’attacco. Qui le parole ricondotte a un portavoce di OpenAI: “La maggior parte delle attività che abbiamo esaminato finora riguardava compiti di ricerca di routine, come l'accesso a contenuti web pubblici per rispondere a domande. Alcune attività hanno coinvolto siti web governativi perché i nostri modelli spesso li considerano fonti autorevoli di informazioni pubbliche”. Gli agenti di OpenAI, almeno secondo l’azienda, non avrebbero cercato di manomettere informazioni o intaccare servizi pubblici: sarebbero entrati nei database per cercare informazioni. Il problema però resta lo stesso. Sono andati oltre i confini degli ambienti di test. Questo è un tema molto discusso, tanto che Dario Amodei di Anthropic ha chiesto di frenare lo sviluppo degli algoritmi più sofisticati.

La frequenza degli incidenti sta aumentando

Transluce è una società che ha pubblicato diversi report sull’andamento dei test sull’intelligenza artificiale. Negli ultimi giorni ha pubblicato un report dedicato esattamente a questo problema. Lo abbiamo letto. Nel grafico che vi lasciamo qui sotto trovate tutti i casi registrati in cui gli agenti di intelligenza artificiale hanno utilizzato un servizio specifico per “espandere il loro accesso a internet”. Si tratta di urlquery.net, un portale che permette di vedere cosa c’è in un url senza accedere direttamente. In alcuni casi può essere molto utile: quando ci troviamo davanti a un url accorciato (ad esempio quando passa da servizi come tinyurl) o a una potenziale minaccia, urlquery.net mostra cosa c’è dentro la pagina. Per i ricercatori di Transluce sarebbe questo il trucco usato dagli agenti di OpenAI per aggirare le restrizioni senza farsi scoprire: l’accesso c’è stato, ma non è rimasta traccia. I casi descritti in questo report sono simili agli attacchi ai siti governativi degli Stati Uniti ma non possiamo farli coincidere, almeno non con certezza: i dettagli ufficiali di questa ultima serie di attacchi non sono ancora stati svelati:

“I dati di urlquery.net mostrano agenti che utilizzano il servizio almeno dal 6 marzo 2026, circa due mesi prima dell'attività di sciame precedentemente segnalata. Il primo caso, un tentativo del 6 marzo di recuperare statistiche sul contrasto al narcotraffico in Thailandia, mostra un agente che intensifica le sue azioni a ogni tentativo fallito: prima ha richiesto i dati direttamente, poi ha provato un servizio che converte le pagine web in testo e infine ha inserito un programma personalizzato in un indirizzo web”.

Immagine
TRANSLUCE | Analisi delle richiesti degli Agenti IA a urlquery.net
autopromo immagine
Più che un giornale
Il media che racconta il tempo in cui viviamo con occhi moderni
api url views