Trendy

OpenAI chystá Astru. Model dokáže samostatně hledat a zneužívat zero-day chyby

redakce3.9.2026

Připravovaný model Astra jako první v historii OpenAI dosáhl v interním bezpečnostním rámci společnosti úrovně Critical pro kybernetické schopnosti. Se správnými nástroji a oprávněními údajně dokáže vyhledávat dosud neznámé zranitelnosti a vytvářet funkční exploity bez průběžného vedení člověkem. Nejpokročilejší funkce proto nebudou při uvedení běžně dostupné.

OpenAI se připravuje na uvedení nového modelu Astra, který má představovat výrazný posun v agentním programování a kybernetické bezpečnosti. Podle společnosti jde o její první model, který překročil hranici označovanou v rámci Preparedness Framework jako Critical.

Toto označení neznamená pouze to, že model umí analyzovat zdrojový kód nebo upozornit na známé bezpečnostní chyby. Model na této úrovni má být schopen samostatně odhalovat dosud neznámé zranitelnosti, vytvářet pro ně funkční zero-day exploity a případně navrhovat kompletní postup útoku proti dobře zabezpečenému cíli pouze na základě obecně formulovaného zadání. 

Dvě zero-day chyby a únik ze sandboxu

Astra podle výsledků zveřejněných OpenAI získala stoprocentní skóre v benchmarku ExploitBench, který testuje schopnost vytvářet exploity pro známé zranitelnosti. Protože veřejné benchmarky mohou být součástí tréninkových dat, připravila společnost také neveřejný test složený z dvaceti závažných zranitelností JavaScriptového enginu V8 zveřejněných mezi červnem a srpnem 2026.

V tomto testu měla Astra výrazně překonat model GPT-5.6 Sol a spotřebovat přitom méně výstupních tokenů. Během hodnocení navíc objevila dvě dosud neznámé zranitelnosti a využila je jako součást funkčního řetězce exploitů. OpenAI uvedla, že nyní pracuje na jejich oznámení příslušným správcům softwaru. 

Ještě názornější výsledky přinesly testy vedené bezpečnostními specialisty. Astra v nich sestavila řetězec, který po otevření připraveného HTML souboru kompromitoval prohlížeč, unikl z jeho sandboxu a spustil příkazy přímo na hostitelském systému. V dalším testu spojila několik zranitelností zabezpečeného operačního systému a získala oprávnění uživatele root.

Jde ovšem o výsledky zveřejněné samotnou OpenAI. Firma zároveň upozorňuje, že odrážejí schopnosti modelu s rozšířeným přístupem v režimu Daybreak Blue, nikoliv jeho výchozí konfiguraci určenou běžným uživatelům. 

Vývoj se kvůli bezpečnosti zpomalil

OpenAI v předchozích týdnech část vývoje a příprav na vydání Astry odložila. Společnost posilovala izolaci testovacích prostředí, omezení síťového přístupu, ochranu vah modelu, monitoring jeho činnosti a pravidla pro spouštění nástrojů.

Do opatření promítla také zkušenosti z dřívějšího incidentu spojeného s platformou Hugging Face. Astra se tohoto incidentu podle OpenAI neúčastnila, firma po něm ale na dva týdny pozastavila část trénování svých nejpokročilejších modelů. Rozsáhlý trénink Astry pomocí posilovaného učení znovu spustila 28. srpna po zavedení přísnějších bezpečnostních podmínek. 

Samotný model byl rovněž dotrénován tak, aby lépe dodržoval vymezený rozsah úkolu a odmítal požadavky směřující ke škodlivému využití. V interních testech zaměřených na obcházení kyberbezpečnostních omezení odmítla Astra 91,5 % zakázaných požadavků. Model GPT-5.6 Sol ve stejném testu odmítl 59 % požadavků. 

Některé úlohy se mohou samy zastavit

Součástí nasazení bude také průběžný monitoring uvažování a prováděných akcí. Pokud systém vyhodnotí chování modelu jako potenciálně neoprávněné, může úlohu pozastavit nebo úplně ukončit.

Uživatelé ChatGPT a Codexu mohou být v takovém případě požádáni o kontrolu akce před pokračováním. Při používání přes API se úloha automaticky zastaví. OpenAI připouští, že dodatečné kontroly mohou omylem zasáhnout i legitimní práci, například dlouho běžící agentní úlohy nebo bezpečnostní výzkum. 

Pokročilé funkce budou jen pro vybrané uživatele

OpenAI plánuje Astru zpřístupnit v dohledné době, přesné datum ale zatím neuvedla. Nejpokročilejší kyberbezpečnostní funkce nejprve získá jen malá skupina testerů. Následovat má rozšiřování přístupu prostřednictvím programu Daybreak Blue, který je určen především pro ověřené bezpečnostní týmy a obranné scénáře. 

Pro bezpečnostní specialisty, integrátory a poskytovatele řízených služeb může podobný model výrazně urychlit analýzu zranitelností, ověřování jejich dopadu i přípravu oprav. Stejné schopnosti ale mohou zkrátit také cestu mezi objevením chyby a jejím zneužitím. S příchodem Astry se proto rychlost patchování, monitoring agentních úloh a řízení přístupu k nejvýkonnějším modelům stávají ještě důležitější součástí podnikové bezpečnosti.

Zdroj: OpenAI