Cybertech Europe 2026-IT Branschen Official Media Partner

OpenAI klassar Astra som kritiskt kapabel inom cybersäkerhet

OpenAI klassar Astra som sin första modell med kritisk cybersäkerhetsförmåga efter tester med zero-days och fungerande attackkedjor.
IT-Branschen IT-Branschen

OpenAI uppger att den kommande modellen Astra är företagets första modell som når risknivån Critical inom cybersäkerhet. I interna tester har modellen hittat tidigare okända sårbarheter och byggt fungerande attackkedjor mot härdade system. Delar av lanseringen har fördröjts medan skyddsåtgärder förstärks.

OpenAI har tilldelat den kommande AI-modellen Astra risknivån Critical inom cybersäkerhet enligt företagets Preparedness Framework.

Astra är den första modellen från OpenAI som bedöms nå denna nivå

Klassificeringen innebär enligt ramverket att en modell kan utveckla fungerande zero-day-exploateringar mot flera härdade och samhällskritiska system utan att en människa behöver styra varje enskilt steg.

Astra är den första modellen från OpenAI som bedöms nå denna nivå. OpenAI:s tekniska redovisning av Astra

Hittade två zero-day-sårbarheter i intern utvärdering

OpenAI testade modellen mot 20 sårbarheter med hög allvarlighetsgrad i JavaScript-motorn V8. Sårbarheterna hade offentliggjorts mellan juni och augusti 2026.

Enligt företaget lyckades Astra nå kodkörning oftare och med lägre tokenförbrukning än GPT-5.6 Sol. Modellen ska dessutom ha identifierat och använt två tidigare okända sårbarheter i en sammanhängande attackkedja.

OpenAI uppger att arbetet med att rapportera dessa sårbarheter till berörda parter fortfarande pågår. Företaget lämnar därför inte fullständiga tekniska detaljer.

Resultaten kommer från OpenAI:s egna tester och har inte validerats genom en oberoende studie.

Klarade fullständig webbläsarattack

I tester genomförda med externa säkerhetsexperter ska Astra ha byggt en komplett attackkedja mot en härdad webbläsarmiljö.

Kedjan omfattade enligt OpenAI både en första sårbarhet, flykt från webbläsarens sandlåda och körning av kommandon på värdsystemet. Modellen ska även ha kombinerat flera brister i ett härdat operativsystem för att gå från en användare utan särskilda behörigheter till root-åtkomst.

Testerna genomfördes med särskild tillgång genom OpenAI-programmet Daybreak Blue. Resultaten beskriver därför inte nödvändigtvis vad modellen kan göra i en vanlig produktkonfiguration.

Starkare skydd inför lanseringen

OpenAI uppger att Astra avvisade 91,5 procent av de skadliga cybersäkerhetsförfrågningar som ingick i företagets tester. Motsvarande resultat för GPT-5.6 Sol var 59 procent.

Företaget använder även övervakning av modellens resonemang och handlingar för att identifiera och stoppa riskfyllda arbetsflöden. Sådan övervakning kan samtidigt bromsa legitimt säkerhetsarbete eller stoppa ofarliga uppgifter.

Delar av utvecklingen och lanseringen har fördröjts medan skydden förstärks. OpenAI pausade även viss träning av avancerade modeller under två veckor efter en tidigare säkerhetsincident hos Hugging Face, även om bolaget betonar att Astra inte var inblandad i incidenten.

Begränsad tillgång inledningsvis

OpenAI anger att Astra ska göras tillgänglig snart, men någon exakt lanseringsdag eller prisuppgift har inte offentliggjorts.

De mest avancerade cybersäkerhetsfunktionerna ska inledningsvis erbjudas till en mindre grupp granskade användare. Daybreak Blue ska därefter användas för att ge säkerhetsforskare och försvarsinriktade organisationer kontrollerad åtkomst.

För nordiska verksamheter aktualiserar modellen frågor om hur kraftfulla AI-verktyg ska behörighetsstyras, loggas och övervakas. Organisationer behöver även bedöma hur modellåtkomst ska hanteras i leverantörskedjor och hos externa säkerhetspartner.

Håll dig uppdaterad med de viktigaste nyheterna

Genom att trycka på knappen Prenumerera bekräftar du att du har läst och godkänner vår integritetspolicy och användarvillkor
Advertisement