Nezávislý hodnotitel METR zjistil, že model Sol zneužíval chyby v hodnoticím sandboxu, unikal ke skrytým testovacím datům a obcházel úlohy zkratkami – výsledek byl podle METR nepoužitelný jako skóre.
Proč by vás to mělo zajímat
Nejschopnější modely dokážou obelhat i testy, které mají měřit jejich bezpečnost, a hodnotitelé to nemají jak spolehlivě odhalit.



