Tříčlenný tým nezávislých výzkumníků z Hacktron pronikl do účtů zaměstnanců OpenAI za méně než 72 hodin, přičemž jako hlavní nástroj útoku použil Anthropicův model Claude. Útočníci získali přístup k internímu repozitáři kódu a citlivým datům na GitHubu a zranitelnosti nahlásili odpovědným způsobem. Incident popsaly Wall Street Journal, The Verge, TechCrunch i Ars Technica.
Tříčlenný tým bezpečnostních výzkumníků ze skupiny Hacktron zveřejnil, že se jim podařilo proniknout do účtů zaměstnanců OpenAI za méně než 72 hodin. Klíčem byl Anthropicův model Claude, který výzkumníci využili k vyhledání a zneužití bezpečnostních mezer.
Útočníci se dostali k internímu repozitáři kódu a k citlivým datům na GitHubu. Zranitelnosti poté nahlásili odpovědným způsobem, nikoli je zneužili ke komerčnímu prospěchu nebo dalším útokům.
Případ je mimořádný ze dvou důvodů. Zaprvé ukazuje, že pokročilé jazykové modely lze použít jako efektivní nástroj pro ofenzivní bezpečnostní výzkum. Zadruhé komplikuje diskusi o bezpečnosti AI: Anthropic buduje modely s přísnými bezpečnostními guardrails, přesto byl Claude úspěšně nasazen v útoku na konkurenta.
Proč by vás to mělo zajímat
Bezpečnostní incident ukazuje, že AI modely mohou výrazně snížit časovou náročnost kyberútoků: 72 hodin na průnik do systémů velké AI firmy je znepokojivě krátká doba. Firmy spravující API klíče nebo sdílené přístupy by měly prověřit, zda mají zapnuté auditní logy a vícefaktorové ověření na všech citlivých repozitářích.



