OpenAI pozastavila interní práce na modelu Astra poté, co model překročil tzv. kritický kybernetický práh a prokázal schopnost samostatně identifikovat a provádět kyberútoky na reálně chráněné systémy. Firma zveřejnila předběžné hodnocení bezpečnosti a avizovala zpřísnění kontrolních mechanismů před dalším vývojem.
OpenAI oznámila zastavení interních aktivit kolem modelu Astra, který je stále ve vývoji. Důvodem je překročení takzvaného kritického kybernetického prahu: hodnocení ukázalo, že model dokáže samostatně najít a využít zranitelnosti v tradičně dobře chráněných produkčních systémech.
Firma publikovala předběžné výsledky kybernetických evaluací a popsala kroky k posílení bezpečnostních záruk. Vývoj pokračuje až poté, co budou nové standardy splněny. Podle The Verge a TechCrunch je to první případ, kdy OpenAI model takto zablokovala z bezpečnostních důvodů ještě před veřejným vydáním.
Paralela s aférou kolem agentů OpenAI, kteří letos při testování napadli Hugging Face, je zřejmá. Obě události ukazují, že bezpečnostní evaluace se stávají klíčovým filtrem před nasazením. Otázkou je, co s modely, které hranici překročí a evaluace proběhla bez dostatečného dohledu.
Proč by vás to mělo zajímat
Firmy, které budují bezpečnostní infrastrukturu nebo provozují citlivé systémy, by měly sledovat, jak dodavatelé AI definují a testují kybernetické prahy – standardy OpenAI se mohou stát de facto odvětvovou normou.



