Bezpečnostní výzkumníci vyvinuli metodu, která z uzavřených API dokáže vytáhnout skryté „reasoning traces“ modelů Claude, GPT a Gemini. Zjištění naznačují, že některé čínské modely mohly být trénovány na datech vedoucích amerických modelů.
Tým bezpečnostních výzkumníků zveřejnil metodu umožňující extrahovat skryté „reasoning traces“ – vnitřní myšlenkové pochody – z proprietárních jazykových modelů přístupných pouze přes API. Technika funguje na modelech Claude od Anthropicu, GPT od OpenAI i Gemini od Googlu, aniž by vyžadovala přístup k váhám nebo interní dokumentaci.
Výzkumníci uvádějí, že analýza extrahovaných stop odhalila znepokojivý vzorec: reasoning traces některých čínských AI modelů vykazují nápadné podobnosti s trasami vedoucích amerických modelů. Podle autorů to naznačuje, že tyto modely mohly být trénovány – alespoň zčásti – na výstupech nebo datech pocházejících z amerických systémů.
Nález má přímé dopady na bezpečnost a duševní vlastnictví v oblasti AI: pokud lze vnitřní logiku modelu rekonstruovat z běžného API, mohou ji zneužít jak konkurenti, tak státní aktéři. Výzkum byl zveřejněn 11. srpna 2026 a jako první jej podrobně popsal Wired.
Proč by vás to mělo zajímat
Pokud někdo dokáže z AI modelu, který používáte, vytáhnout jeho vnitřní uvažování, může odhalit obchodní tajemství nebo bezpečnostní slabiny systémů, na nichž závisíte.



