Společnost OpenAI testovala svůj model ChatGPT a v tiskovém vyjádření uvedla, že se jí dvě z jejích nejpokročilejších verzí vymkly kontrole a v rámci testování unikly při hledání informací nekontrolovaně na internet.
Společnost OpenAI oznámila v tiskové zprávě, že v rámci testu kybernetických schopností nejnovějších modelů ChatGPT unikl pokročilý model GPT 5.6 Sol a jeho doposud nepojmenovaný nástupce z uzavřeného testovacího prostředí a skrz internet se dostal do softwaru společnosti Hugging Face.
„Tento incident považujeme za bezprecedentní kybernetickou událost zahrnující nejmodernější kybernetické schopnosti AI, a přistupujeme k ní odpovídajícím způsobem. V této fázi sdílíme předběžná zjištění, abychom pomohli bezpečnostním expertům pochopit, co se stalo, a lépe odhadnout, čeho jsou dnešní modely reálně schopné. Budeme i nadále provádět důkladné vyšetřování ve spolupráci se společností Hugging Face a po jeho dokončení se podělíme o další podrobnosti o zranitelnostech, incidentu a našich zjištěních,“ uvedla společnost OpenAI v tiskové zprávě.
Aby společnost OpenAI zjistila skutečný strop kybernetických možností svých modelů, testuje je bez běžných bezpečnostních pojistek v izolované síti. Při testování v rámci ExploitGym ale modely samy odhalily a zřetězily zranitelnosti napříč výzkumným systémem OpenAI a platformou Hugging Face, odkud se pokusily vytáhnout výsledky. Vše nasvědčuje tomu, že se modely fixovaly výhradně na splnění úkolu a využily k tomu veškeré dostupné cesty, čímž objevily skulinu ven z izolované sítě.
„Jsme vděční za spolupráci s OpenAI na tomto i dalších tématech. Tento incident, možná první svého druhu, dokazuje to, v co jsme dlouho věřili: Bezpečnost umělé inteligence nevyřeší jediná společnost, která by pracovala v tajnosti. Dá se vyřešit pouze otevřeně, ve vzájemné spolupráci a se širokým přístupem k AI pro každého obránce kdekoli na světě,“ uvedl Clem Delangue, spoluzakladatel a CEO společnosti Hugging Face.