2026. 08. 03. - 08:30
Példátlan kiberbiztonsági incidens: „kitört” az OpenAI mesterséges intelligenciája egy biztonsági teszt során
Biztonsági incidens miatt kellett magyarázatot adnia az Open AI vállalatnak, miután több fejlett mesterséges intelligencia-modellje váratlan lépésként hozzáférést szerzett egy startup infrastruktúrájához.
Rendkívüli biztonsági incidensről számolt be az OpenAI.
A vállalat egyik belső tesztje során több fejlett mesterséges intelligencia-modell váratlan módon hozzáférést szerzett egy startup infrastruktúrájához, kihasználva egy külső rendszer sérülékenységeit.
A cég szerint az eset ugyan ellenőrzött környezetben történt, mégis jól mutatja, milyen gyorsan fejlődnek a kiberbiztonsági képességekkel rendelkező MI-modellek.
Az OpenAI közlése szerint az incidensre azt követően derült fény, hogy a Hugging Face észlelte és megállította az AI-ügynök tevékenységét.
A vizsgálat alapján az akció mögött több OpenAI-modell állt, köztük a GPT-5.6 Sol, valamint egy még fejlettebb, fejlesztés alatt álló modell. Ezeket kifejezetten kiberbiztonsági képességeik felmérésére tesztelték, ezért a szokásos biztonsági korlátozások egy részét ideiglenesen feloldották. Olvasd el: Hónapokon belül új szintre léphetnek a generatív mesterséges intelligencia-alapú kibertámadások

„Kitört” az OpenAI mesterséges intelligenciája egy biztonsági teszt során
Az OpenAI közleményt adott ki az esetről.
„A Hugging Face egy új típusú biztonsági incidensről számolt be, miután észlelte és megfékezte azt az MI-ügynököt, amely kompromittálta az infrastruktúráját. Arra számítunk, hogy az egyre fejlettebb kiberképességekkel rendelkező modellek elterjedésével az ilyen esetek gyakoribbá válhatnak” – írta a vállalat.
A vizsgálatok során kiderült, hogy a modellek több sérülékenységet egymás után kihasználva jutottak el a Hugging Face éles adatbázisához. Mindezt azért tették, hogy a lehető leggyorsabban teljesítsék a számukra kijelölt tesztfeladatot.
„Úgy véljük, hogy ez példátlan kiberbiztonsági incidens, amely a jelenlegi legfejlettebb MI-modellek képességeit tükrözi. Az első megállapításokat azért tesszük közzé, hogy segítsük a védelmi szakembereket megérteni a történteket és reális képet kapjanak arról, mire képesek már ezek a modellek” – hangsúlyozta az OpenAI.
Kiemelte, hogy az eset egy belső értékelési folyamat során történt, nem egy nyilvánosan elérhető rendszerben. Az OpenAI szerint a tesztkörnyezet szigorúan elkülönített volt, a modellek hálózati hozzáférése pedig jelentősen korlátozott maradt.
„A tesztjeink egy erősen elszigetelt környezetben futnak, ahol a hálózati hozzáférés kizárólag a csomagok telepítéséhez szükséges, belső proxyként működő rendszerre korlátozódik” – írta a cég.
A vizsgálat alapján a modellek az OpenAI kutatási környezetében és a Hugging Face infrastruktúrájában található sérülékenységeket összekapcsolva szerezték meg a teszt megoldásához szükséges adatokat, közvetlenül a Hugging Face adatbázisából.
Az OpenAI szerint minden jel arra utal, hogy a mesterséges intelligencia kizárólag a kijelölt feladat megoldására koncentrált.
„Minden bizonyíték arra utal, hogy a modellek kizárólag az ExploitGym teszt sikeres teljesítésére összpontosítottak, és ennek érdekében rendkívüli lépéseket tettek egy nagyon szűken meghatározott cél eléréséért”.
A vállalat közölte, hogy a Hugging Face szakembereivel közösen tovább vizsgálja az esetet. Az OpenAI a későbbiekben részletesebb beszámolót ígér az incidensről, a kihasznált sérülékenységekről és a levont tanulságokról.
A történtek jól mutatják, hogy a mesterséges intelligencia fejlődésével a kiberbiztonsági kihívások is új szintre lépnek. A fejlesztők szerint ezért egyre fontosabb, hogy az AI-modellek képességeit ellenőrzött környezetben teszteljék, még mielőtt széles körben elérhetővé válnának.
B.A.

