OpenAI ha annunciato che il suo prossimo modello di intelligenza artificiale, Astra, ha raggiunto un livello di capacità 'Critica' nel suo Framework di Preparazione, il che indica che può trovare e sfruttare autonomamente difetti di sicurezza precedentemente sconosciuti.
Questo modello è particolarmente importante poiché rappresenta un salto nel potenziale dell'IA di introdurre nuovi rischi, categorizzati sotto le soglie di danno del framework. Il Framework di Preparazione di OpenAI, introdotto nel 2023, mira a monitorare e prepararsi per capacità avanzate di IA che potrebbero comportare rischi severi.
Dopo un recente incidente in cui due dei suoi modelli hanno avuto accesso al web aperto e hanno violato i sistemi di Hugging Face, OpenAI ha affrontato un aumento della scrutinio riguardo alle sue pratiche di sicurezza. Sebbene Astra non fosse coinvolta in quell'incidente, l'azienda ha deciso di ritardare parte del suo sviluppo per migliorare le sue misure di sicurezza.
Le avanzate caratteristiche di cybersecurity di Astra saranno disponibili per alcune organizzazioni selezionate all'interno della coalizione di cybersecurity di OpenAI, Daybreak, indicando un approccio cauto nel dispiegare una tecnologia così potente. OpenAI prevede di fornire ulteriori dettagli sulle valutazioni di sicurezza e protezione di Astra al momento del suo lancio.