Testy TechCrunche z 21. srpna 2026 ukázaly, že model Anthropic Opus 4.6 generuje sexuálně explicitní obsah navzdory přísným pravidlům firmy. Obejití filtrů nevyžaduje technické znalosti ani složité prompty. Anthropic explicitní obsah v podmínkách užití výslovně zakazuje.
Anthropic má ve svých pravidlech jasně napsáno, že modely Claude nesmějí generovat sexuálně explicitní obsah. Testy TechCrunche publikované 21. srpna 2026 ale zjistily, že u modelu Opus 4.6 toho nebylo těžké dosáhnout. K obejití filtrů stačilo jen několik běžně formulovaných instrukcí.
Jde o závažný případ selhání guardrailů u staršího modelu firmy. Anthropic přitom patří k firmám, které bezpečnost prezentují jako svou hlavní konkurenční výhodu. Incident zapadá do širšího vzorce: podobná selhání se v posledních měsících ukázala i u Groku a dalších modelů.
Anthropic na zveřejnění nereagoval konkrétním technickým popisem opravy. Pro firemní zákazníky, kteří Claude nasazují v prostředích přístupných veřejnosti nebo mladistvým, to znamená nutnost přidat vlastní filtrační vrstvu.
Proč by vás to mělo zajímat
Nasazujete-li Claude v produktu přístupném širší veřejnosti, nespoléhejte na výchozí filtry jako jedinou ochranu. Zvažte přidání vlastní moderační vrstvy nebo sledujte, zda Anthropic vydá záplatu a kdy.



