2026. július 23., 18:08

Önmagát is megtámadta a mesterséges intelligencia

Megváltoztak a játékszabályok a mesterséges intelligencia (MI) kezelésével kapcsolatban az OpenAI cég modelljeinek önálló kibertámadása után - mondta csütörtökön a BBC-nek Thomas Wolf, az alapvetően szintén mesterséges intelligenciával foglalkozó Hugging Face vállalat tudományos igazgatója. A szakember szerint a történtek "intő jelként szolgálnak az egész iparág számára", mert az önálló működésű MI-rendszerek támadóképessége most már nem csak elméletben létezik.

Lebuktak
Thomas Wolf
Fotó: Hugging Face

Thomas Wolf elmondta, hogy a vállalat rendszereit rövid idő alatt több mint 17 ezer automatizált támadás érte különböző IP-címekről. A támadást sikerült megállítani, az érintett rendszereket újjáépítették, jelenleg pedig azt vizsgálják, hozzáférhettek-e a modellek partneri vagy egyéb belső adatokhoz.

Az OpenAI közlése szerint a modellek nem emberi utasításra választották ki a célpontot, hanem a rájuk bízott feladat végrehajtásához szükséges információkat próbálták megszerezni. A cég a történteket "példátlan kibertámadási incidensnek" nevezte.

A vállalat közlése szerint a modelleket - köztük a frissen megjelent GPT-5.6 Sol-t és egy belső tesztelés alatt álló, még fejlettebb verziót - egy biztonsági teszt során elkülönített tesztkörnyezetben vizsgálták, ahol a kutatók szándékosan enyhítettek egyes védelmi korlátozásokon. A rendszerek előbb bejelentkezési adatokat szereztek meg, majd egy korábban ismeretlen biztonsági rés kihasználásával kijutottak az internetre, és ezután önállóan támadást indítottak a világ egyik legnagyobb mesterségesintelligencia-fejlesztő platformjának számító Hugging Face rendszerei ellen.

A vállalat közölte, hogy az eset kivizsgálásában együttműködik a platform üzemeltetőjével.

Az eset megosztotta a mesterséges intelligencia biztonságával foglalkozó kutatókat. Nate Soares, a Machine Intelligence Research Institute MI-biztonsági kutatója szerint a modell tudatosan kerülte meg a számára felállított korlátokat.

Bizonyos értelemben tudta, hogy nem ezt várták tőle, de egyszerűen nem érdekelte"

- fogalmazott.

Yoshua Bengio, a mesterséges intelligencia egyik úttörő kutatója szintén intő jelnek nevezte a történteket, és arra figyelmeztetett, hogy megfelelő biztonsági garanciák nélkül az ilyen incidensek egyre gyakoribbá válhatnak.

John Thickstun, a Cornell Egyetem kutatója szerint az esetből nem azt a tanulságot kell levonni, hogy a modellek végül is kikerültek az emberi ellenőrzés alól; az incidens inkább azt mutatja meg, milyen nehéz biztonságosan tesztelni a legfejlettebb modelleket. Hangsúlyozta, hogy az OpenAI a kísérlet idejére kikapcsolt több védelmi mechanizmust, a modellt pedig éppen az ilyen kockázatok feltárására használták.

Több más kutató is szigorúbb biztonsági tesztelést és szorosabb nemzetközi együttműködést sürgetett az egyre fejlettebb MI-rendszerek ellenőrzésében.

Megosztás
Címkék