Etsitkö lyhyempää yleiskatsausta?
Tekoälyn yhteenveto
Keskeiset hetket
Risknivå Critical för Astra
Astra är OpenAIs första modell klassificerad som Critical enligt deras Preparedness Framework.Upptäckt av tidigare okända sårbarheter
Modellen identifierade två nya zero-day sårbarheter i intern utvärdering.Fullständig webbläsarattack
Astra konstruerade en komplett attackkedja mot en härdad webbläsarmiljö med flera steg.Begränsad initial tillgång
Tillgången till Astra kommer inledningsvis vara begränsad till granskade användare och säkerhetsforskare.OpenAI uppger att den kommande modellen Astra är företagets första modell som når risknivån Critical inom cybersäkerhet. I interna tester har modellen hittat tidigare okända sårbarheter och byggt fungerande attackkedjor mot härdade system. Delar av lanseringen har fördröjts medan skyddsåtgärder förstärks.
OpenAI har tilldelat den kommande AI-modellen Astra risknivån Critical inom cybersäkerhet enligt företagets Preparedness Framework.
Klassificeringen innebär enligt ramverket att en modell kan utveckla fungerande zero-day-exploateringar mot flera härdade och samhällskritiska system utan att en människa behöver styra varje enskilt steg.
Astra är den första modellen från OpenAI som bedöms nå denna nivå. OpenAI:s tekniska redovisning av Astra
Hittade två zero-day-sårbarheter i intern utvärdering
OpenAI testade modellen mot 20 sårbarheter med hög allvarlighetsgrad i JavaScript-motorn V8. Sårbarheterna hade offentliggjorts mellan juni och augusti 2026.
Enligt företaget lyckades Astra nå kodkörning oftare och med lägre tokenförbrukning än GPT-5.6 Sol. Modellen ska dessutom ha identifierat och använt två tidigare okända sårbarheter i en sammanhängande attackkedja.
OpenAI uppger att arbetet med att rapportera dessa sårbarheter till berörda parter fortfarande pågår. Företaget lämnar därför inte fullständiga tekniska detaljer.
Resultaten kommer från OpenAI:s egna tester och har inte validerats genom en oberoende studie.
Klarade fullständig webbläsarattack
I tester genomförda med externa säkerhetsexperter ska Astra ha byggt en komplett attackkedja mot en härdad webbläsarmiljö.
Kedjan omfattade enligt OpenAI både en första sårbarhet, flykt från webbläsarens sandlåda och körning av kommandon på värdsystemet. Modellen ska även ha kombinerat flera brister i ett härdat operativsystem för att gå från en användare utan särskilda behörigheter till root-åtkomst.
Testerna genomfördes med särskild tillgång genom OpenAI-programmet Daybreak Blue. Resultaten beskriver därför inte nödvändigtvis vad modellen kan göra i en vanlig produktkonfiguration.
Starkare skydd inför lanseringen
OpenAI uppger att Astra avvisade 91,5 procent av de skadliga cybersäkerhetsförfrågningar som ingick i företagets tester. Motsvarande resultat för GPT-5.6 Sol var 59 procent.
Företaget använder även övervakning av modellens resonemang och handlingar för att identifiera och stoppa riskfyllda arbetsflöden. Sådan övervakning kan samtidigt bromsa legitimt säkerhetsarbete eller stoppa ofarliga uppgifter.
Delar av utvecklingen och lanseringen har fördröjts medan skydden förstärks. OpenAI pausade även viss träning av avancerade modeller under två veckor efter en tidigare säkerhetsincident hos Hugging Face, även om bolaget betonar att Astra inte var inblandad i incidenten.
Begränsad tillgång inledningsvis
OpenAI anger att Astra ska göras tillgänglig snart, men någon exakt lanseringsdag eller prisuppgift har inte offentliggjorts.
De mest avancerade cybersäkerhetsfunktionerna ska inledningsvis erbjudas till en mindre grupp granskade användare. Daybreak Blue ska därefter användas för att ge säkerhetsforskare och försvarsinriktade organisationer kontrollerad åtkomst.
För nordiska verksamheter aktualiserar modellen frågor om hur kraftfulla AI-verktyg ska behörighetsstyras, loggas och övervakas. Organisationer behöver även bedöma hur modellåtkomst ska hanteras i leverantörskedjor och hos externa säkerhetspartner.
