Vai al contenuto
Italiano
Contenuto FikirPilot

Il modello Astra di OpenAI è in arrivo — eccelle anche nell’infiltrarsi nei sistemi informatici

Aggiornato: 06/09/2026 · 3 min di lettura · 497 parole

Pubblicato: · Notizia ricevuta: · Tempo di elaborazione: 82 h 58 min

Il modello Astra di OpenAI è in arrivo — eccelle anche nell’infiltrarsi nei sistemi informatici
Un computer acceso in un ufficio buio

OpenAI ha condiviso nuovi dettagli su Astra, il modello che prevede di lanciare prossimamente. L’azienda ha dichiarato che Astra è il primo modello linguistico di grandi dimensioni a soddisfare la “soglia critica di cybersicurezza” e che è in grado di individuare e sfruttare, senza la guida umana, vulnerabilità di sicurezza sconosciute nei sistemi informatici. È stato precisato che l’accesso alle capacità di cybersicurezza più avanzate del modello sarà mantenuto più limitato.

Secondo OpenAI, Astra ha ottenuto il punteggio massimo nel test ExploitBench, che misura la capacità di sfruttare vulnerabilità note dei sistemi. In una versione modificata del test sviluppata dagli ingegneri dell’azienda, il modello avrebbe invece individuato e sfruttato due vulnerabilità zero-day. Tuttavia, poiché non esiste una verifica indipendente delle dichiarazioni, la sicurezza e il livello di preparazione del modello non possono essere valutati autonomamente. OpenAI ha dichiarato che condurrà un’anteprima con un gruppo di tester, ma non ha spiegato chi saranno queste persone né come verranno selezionate. Non è inoltre chiaro se il modello sia stato valutato insieme al governo degli Stati Uniti.

L’azienda ha dichiarato di aver sviluppato nuove tecniche di sicurezza per prevenire gli abusi e i tentativi di jailbreak, di aver limitato le risposte degli account considerati ad alto rischio e di voler presentare Astra con un ulteriore monitoraggio della catena di pensiero. OpenAI ha inoltre affermato che, nei test volti a imitare il comportamento di agenti che escono dall’ambiente di addestramento di Hugging Face e accedono a dati privati, Astra non ha tentato di aggirare le misure di sicurezza.

L’ex dipendente di OpenAI Yona Shavit ha messo in dubbio se il mancato rispetto delle regole da parte del modello possa derivare dal fatto che conoscesse le aspettative del test o dal tentativo di ingannare i ricercatori. OpenAI ha dichiarato che, quando Astra sarà reso ampiamente disponibile, pubblicherà ulteriori informazioni sulle valutazioni e sulla sicurezza.

Perché è importante

Le valutazioni su Astra mostrano che l’uso dell’intelligenza artificiale nella cybersicurezza sarà analizzato non solo in base alle capacità tecniche, ma anche alle condizioni in cui tali capacità saranno accessibili. Mantenere limitate le capacità più avanzate significa che il modello non offrirà le stesse funzioni a tutti gli utenti. Tuttavia, l’assenza di una verifica da parte di terzi lascia aperta la questione di come saranno sottoposti a verifica indipendente il risultato di ExploitBench e i risultati zero-day segnalati. Il fatto che non siano stati resi noti i tester che parteciperanno all’anteprima e l’incertezza sul fatto che sia stata effettuata o meno una valutazione con il governo degli Stati Uniti lasciano inoltre in sospeso il modo in cui viene verificata la preparazione in materia di sicurezza. Il piano di OpenAI di pubblicare ulteriori informazioni sulle valutazioni e sulla sicurezza determinerà in quale misura queste affermazioni e le misure adottate potranno essere esaminate nella fase successiva.

Contesto

OpenAI non è un nome nuovo nell’archivio di FikirPilot: negli ultimi 90 giorni abbiamo pubblicato 17 notizie in cui compare questo nome; la più recente è datata 6 settembre 2026.

Fonte: TechCrunch AI