OpenAI heeft GPT-6 Astra onthuld, een nieuwe generatie AI-model dat ontworpen is voor softwareontwikkeling, complexe professionele taken en autonoom computergebruik. De capaciteiten op het gebied van cyberbeveiliging verbeteren aanzienlijk, waardoor het voor het eerst het niveau « Critical » bereikt binnen het Preparedness Framework van OpenAI.
GPT-6 Astra markeert een nieuwe mijlpaal in de ontwikkeling van OpenAI's modellen. Het bedrijf presenteert het als een significante vooruitgang op het gebied van softwareontwikkeling, wetenschap, wiskunde, professioneel werk en computergebruik. Het model is specifiek ontworpen om agentische taken (multi-staps processen) uit te voeren en in te grijpen in softwareomgevingen met verhoogde autonomie.
Cyberbeveiliging als doorbraakgebied
Cyberbeveiliging vormt een van de meest opvallende gebieden waar deze vooruitgang wordt waargenomen. OpenAI schat dat Astra daarmee het « Critical » niveau bereikt binnen zijn Preparedness Framework, wat eenduidig nieuw is voor een van zijn modellen. Met geschikte tools en toegang kan Astra kwetsbaarheden identificeren die tot dan toe onbekend waren en vervolgens methoden ontwikkelen om deze te exploiteren op sterk beveiligde systemen zonder dat menselijke interventie vereist is bij elke stap. Tijdens een interne evaluatie ontdekte het model bijvoorbeeld twee zero-day kwetsbaarheden, die vervolgens werden gebruikt in een exploitatieketting.
Deze revolutionaire capaciteiten hebben OpenAI ertoe gebracht de beschermingen rond het model te versterken. Het bedrijf geeft aan dat bepaalde stappen in zijn ontwikkeling en lancering vertraagd zijn om zijn mechanismen tegen kwaadaardig cybergebruik en ongeautoriseerde acties te verbeteren. Astra combineert onder meer ingebouwde afwijzingen (refusals), beveiligingsclassificaties, monitoring van de eigen acties en mechanismen die in staat zijn bepaalde operaties te onderbreken wanneer deze als potentieel ongeautoriseerd worden beschouwd.
Verbeterde veiligheidsbeperkingen
OpenAI stelt bovendien dat Astra zich beter houdt aan expliciete beveiligingsbeperkingen dan bijvoorbeeld GPT-5.6 Sol tijdens evaluaties. Bij een set tests voor omzeiling op het gebied van cyberbeveiliging wees Astra 91,5 % van de verboden verzoeken af, vergeleken met 59 % voor GPT-5.6 Sol. Het bedrijf erkent echter dat monitoring moeilijker wordt naarmate de capaciteiten van deze modellen groeien en voorziet daarom aanvullende controles die bepaalde legitieme taken kunnen vertragen of zelfs onderbreken.
De komst van Astra vindt plaats in een context waarin agentische capaciteiten zowel nuttiger als moeilijker te controleren worden. OpenAI prévoit een geleidelijke uitrol van het model, terwijl de toegang tot zijn meest geavanceerde cyberbeveiligingsfuncties nog strikter wordt beheerd. Greg Brockman, president van OpenAI, estimeert bovendien dat deze generatie modellen kan markeren binnen een nieuwe periode van algemene kunstmatige intelligentie (AGI), hoewel hij benadrukt dat de definitie van AGI zelf onderwerp is van interpretatie.
Met GPT-6 Astra overstijgt OpenAI opnieuw een drempel in de capaciteiten van zijn agentische modellen. Deze vooruitgang plaatst echter ook beveiliging, uitlijning (alignment) en de controle van autonome systemen centraal bij de uitdagingen voor toekomstige generaties kunstmatige intelligentie.