Přeskočit na obsah
ejaj.cz
ModelyVyvíjí se
stojí za pozornost

Výzkumníci extrahovali myšlenkové pochody z Claude, GPT a Gemini

ModelyZatím jediný zdroj v našem monitoringu. Neznamená to, že je zpráva nepravdivá – jen že jsme k ní zatím nenašli další nezávislý zdroj mezi sledovanými médii.Text vytvořila umělá inteligence z uvedených zdrojů. aktualizováno

Výzkumníci publikovali metodu extrakce reasoning traces, tedy vnitřních myšlenkových pochodů, z proprietárních LLM API, včetně Claude, GPT a Gemini. Postup popisují Simon Willison a The Neuron; jde o bezpečnostní i vědecký problém zároveň. Znalost interního uvažování modelu usnadňuje jeho manipulaci.

Tým bezpečnostních výzkumníků zveřejnil metodu umožňující extrahovat skryté „reasoning traces“ – vnitřní myšlenkové pochody – z proprietárních jazykových modelů přístupných pouze přes API. Technika funguje na modelech Claude od Anthropicu, GPT od OpenAI i Gemini od Googlu, aniž by vyžadovala přístup k váhám nebo interní dokumentaci.

Výzkumníci uvádějí, že analýza extrahovaných stop odhalila znepokojivý vzorec: reasoning traces některých čínských AI modelů vykazují nápadné podobnosti s trasami vedoucích amerických modelů. Podle autorů to naznačuje, že tyto modely mohly být trénovány – alespoň zčásti – na výstupech nebo datech pocházejících z amerických systémů.

Nález má přímé dopady na bezpečnost a duševní vlastnictví v oblasti AI: pokud lze vnitřní logiku modelu rekonstruovat z běžného API, mohou ji zneužít jak konkurenti, tak státní aktéři. Výzkum byl zveřejněn 11. srpna 2026 a jako první jej podrobně popsal Wired.

Proč by vás to mělo zajímat

Pokud někdo dokáže z AI modelu, který používáte, vytáhnout jeho vnitřní uvažování, může odhalit obchodní tajemství nebo bezpečnostní slabiny systémů, na nichž závisíte.

🌅 Podobné novinky každé ráno v 7:00 do mailu

Zdarma, odhlášení jedním klikem v každém e-mailu.

Vyzkoušejte k tomu – z katalogu ejaj.cz

Jak se to vyvíjí

  1. Simon Willison zveřejnil technický rozbor metody extrakce reasoning traces z proprietárních API; The Neuron propojil nález s prolomením reasoning guardrails u tří hlavních modelů ve stejném týdnu.

    Simon Willison
  2. Bezpečnostní výzkumníci vyvinuli metodu, která z uzavřených API dokáže vytáhnout skryté „reasoning traces“ modelů Claude, GPT a Gemini.

    Wired AI

Další novinky

Zpět na přehled AI novinek.