A múlt héten számolhattunk be arról, hogy az OpenAI egy teljesen hétköznapi biztonsági tesztelés során “véletlenül” feltörte a Hugging Face rendszerét, és megpróbált onnan adatokat eltulajdonítani. Hatalmas port kavart az ügy, és egy friss jelentésből kiderült, hogy valójában sokkal kiterjedtebb volt a támadás.
Az OpenAI és a Hugging Face együtt számolt be a korábbi esetről. Akkor az derült ki, hogy az OpenAI kutatói két különböző újabb nyelvi modellt teszteltek egy felügyelet alatt álló, zárt környezetben, viszont a vizsgálat nem úgy sült el, ahogy azt elképzelték. Az ügynök munkára fogott modellekben nem voltak biztonsági megkötések, mivel a teszt biztonsági jellegű volt, és sebezhetőségek felkutatására szerették volna ezeket rávenni.
Azonban a modellek nem a tesztben kapott adatbázison kezdtek sérülékenységet keresni, hanem a zárt környezeten, és sikerült is onnan kitörniük. Így tudtak hozzáférni az internethez, és ezt kihasználva támadták meg a Hugging Face-t. Most pedig felfedte az OpenAI, hogy igazából sokkal messzebbre mentek a kontroll nélküli ügynökök.
Az OpenAI és a Hugging Face néhány nappal az esetet követően számolt be az ügyről, és akkor a fejlesztőcsapat elmondta, hogy még vizsgálják, hogy pontosan mi történt. Akkor még nem volt teljesen tisztázott, hogyan zajlott a Hugging Face megtámadása, a friss jelentésből viszont már tudjuk, hogy nemcsak a Hugging Face esett áldozatul az OpenAI-nek. Az új beszámoló tanúsága szerint az új modelleket használó ágens több nyilvánosan elérhető szolgáltatást is megtámadott, miközben a Hugging Face feltörésének módját kereste.
Négy különböző szolgáltatáshoz kapcsolódóan, négy különálló felhasználói fiókot vett célba az OpenAI elszabadult ügynöke a “feladat” végrehajtása közben. A vállalat enyhítő körülményként igyekezett azt hangsúlyozni, hogy a biztonsági korlátozások nélküli modelleket utasító ügynök az interneten talált, nyilvános adatokból táplálkozott az érintett szolgáltatások feltörésének megkísérlése közben. Azt nem nevezte meg a bejegyzésében a cég, hogy melyek voltak ezek a szolgáltatások (egy forrás szerint a Modal Labs a kvartett egyike).
Azt kiemelte az OpenAI, hogy az eddig nem ismert biztonsági incidensek nem voltak olyan súlyosak, mint a Hugging Face esetében történt támadás. „Az eddigi vizsgálataink alapján nem azonosítottunk olyan tevékenységet, amely súlyosságában vagy mértékében megegyezne a Hugging Face-szel kapcsolatban történt eseményekkel, amelyek platformszintű támadást jelentettek” – közölte az OpenAI.
A négy fiók egyikét átmeneti tárolási útvonalként használták, egy másik fiók pedig csak adattárolási célt szolgált. A maradék két fiókhoz a modellek kizárólag olvasási jogosultsággal fértek hozzá, és ezeket nem használták fel a Hugging Face elleni támadáshoz. A szolgáltatások tulajdonosait értesítette az OpenAI, és nem találtak arra utaló bizonyítékot, hogy a támadás ennél is szélesebb kört érintett volna.
Várhatóan az OpenAI publikálni fog egy részletes technikai jelentést az egész ügyről, amint az alapos elemzés és a kiértékelés lezárul. Ez eltarthat még néhány hétig a mostani beszámoló szerint, mivel egyeztetni fognak a Safety & Security Committee és a Safety Advisory Group szervezetekkel is.
Hozzátette a vállalat, hogy egyik érintett modellt sem kívánták a felhasznált formájukban nyilvánosan bevezetni, ezek kizárólag tesztelési célt szolgáltak a munkára fogott verziójukban. Az “elkövetők” jelenleg deaktivált állapotban, titkosítva vannak elzárva még a kutatói hozzáféréstől is.