Néhány héttel az OpenAI, a ChatGPT fejlesztőjének mesterséges intelligencia (AI) modellje elleni hackertámadás után versenytársa, az Anthropic elismerte, hogy hasonló eset történt vele is. Tesztelés közben az Anthropic mesterséges intelligenciája nem tervezett módon behatolt három cég számítógépes rendszereibe, közölte a vállalat a blogjában. Az a tény, hogy az AI-modell a teszt során saját kezdeményezésből hackerré vált, példa nélküli eseménynek és figyelmeztető jelnek számított a technológiai ipar számára, most azonban világos, hogy ez nem volt egyedi eset, közölte a DPA hírügynökség.
Érdekelhet: Kriptocsalás: Hogyan ismerd fel a scamet és védd meg a pénzed, mielőtt túl késő lenne
Az OpenAI-nél történt incidens után az Anthropic is problémát jelent
Sem az Anthropic, sem az érintett cégek nem vették észre az incidenst. Az Anthropic csak a több mint 141 000 tesztelési futtatás utólagos ellenőrzése során fedezte fel a tevékenységet. Ezt az OpenAI incidense után kezdeményezték, amikor az autonóm ügynök egy biztonsági teszt során kicsúszott az ellenőrzés alól, és támadást indított, amely veszélyeztette a Hugging Face infrastruktúráját.
Ellentétben az OpenAI modelljével, amelynek meg kellett találnia az utat a tesztkörnyezetből a nyílt internetre, az Anthropic modelljei lényegesen egyszerűbb helyzetben voltak. Bár a tesztelési forgatókönyv úgy rendelkezett, hogy nincs internet-hozzáférésük, a tesztet biztosító partnerrel való félreértés miatt az internetkapcsolat végig nyitva maradt. Három modell élt ezzel a lehetőséggel, közölte az Anthropic.
A tesztek célja az AI képességeinek ellenőrzése volt hackertámadások során, amit a cégek rutinszerűen végeznek a lehetséges kockázatok feltárása és hatékonyabb biztonsági intézkedések beállítása érdekében. A modellek azt a feladatot kapták, hogy szerezzenek meg egy másik számítógépen tárolt konkrét információt, amelyhez be kellett hatolniuk a célrendszerbe. Az incidensek három különálló modellt érintettek, a legrégebbi eset áprilisban történt.
Olvass tovább: eToro – Az ismert bróker értékelése
A „biztonságos” AI kudarca
Az egyik incidensben a tesztet biztosító partner egy fiktív cég számára olyan nevet választott, amely azonban egy valódi internetcímnek felelt meg. Az AI ezt követően a szimulált cél helyett egy valóban létező cégre fókuszált, és négy tesztelési futtatás során megpróbált behatolni a rendszereibe, többek között hozzáférést szerzett az adatbázishoz. A támadást akkor is folytatta, miután felismerte, hogy valódi cégről van szó.
Egy másik tesztben az Anthropic modellje káros szoftvert hozott létre a célszámítógépbe való behatoláshoz. Az internethez való hozzáférés révén közzétette egy speciális platformon, ahonnan körülbelül egy órán belül 15 rendszer letöltötte. Közöttük volt egy kiberbiztonsággal foglalkozó cég is, amely rendszeresen letölti és futtatja az ilyen szkripteket tesztelési céllal. Az Anthropic modellje így hozzáférést szerzett ennek a vállalatnak a számítógépes infrastruktúrájához.
A szakértők már hosszabb ideje figyelmeztetnek, hogy az egyre képesebb AI-modellek visszaélésre használhatók kibertámadásokhoz. Az OpenAI incidensét ezért figyelmeztetésnek tekintették, és jobb tesztkörnyezet-védelemre szólítottak fel. Az újonnan nyilvánosságra hozott esetek az Anthropic számára is kellemetlenek, amely hosszú távon a felelős AI-fejlesztés szószólójaként pozicionálta magát. A cég közölte, hogy az események azt mutatják, szükség van a belső és külső tesztkörnyezetek védelmének jelentős megerősítésére, mivel az AI-modellek egyre inkább képesek valódi kibertámadások végrehajtására.
Nézd meg: BITmarkets értékelés
Forrás: ČTK










