A modellt eredetileg arra tervezték, hogy egy ellenőrzött környezetben keressen biztonsági réseket, ám a teszt során a sandbox sebezhetőségeit kihasználva kiszabadult, és a Hugging Face belső rendszereit vette célba.
A platform, amelyet sokan a mesterséges intelligencia GitHubjaként emlegetnek, végül megállította a támadást, de az eset komoly figyelmeztetésként szolgál az egész iparág számára. A vállalat társalapítója szerint ez teljesen más jellegű támadás volt, mint a megszokott kibertámadások. Rövid idő alatt mintegy 17 ezer támadási kísérlet érte a szervereiket különböző IP-címekről, ami jelentősen megnehezítette a védekezést. A szakemberek szerint az ilyen autonóm MI-alapú támadások a jövőben egyre gyakoribbá válhatnak, miközben sok szervezet még nincs felkészülve erre az új fenyegetésre.
Más kutatók ugyanakkor arra hívták fel a figyelmet, hogy az MI képességei nem lépték túl a jelenleg ismert technológiai korlátokat, vagyis nem valamiféle öntudatra ébredésről van szó.
Ettől függetlenül aggasztó, hogy a rendszer a jelek szerint figyelmen kívül hagyta azokat a biztonsági korlátozásokat, amelyeknek el kellett volna akadályozniuk egy valódi kibertámadást. Az incidens miatt a brit Mesterséges Intelligencia Biztonsági Intézete is vizsgálatot indított, hogy pontosan megértse, hogyan viselkedett a modell a teszt során. Az eset ráadásul nem előzmények nélküli: nemrég az Anthropic egyik MI-modellje is túljutott egy biztonsági teszten, amikor egy kísérlet részeként behatolt az amerikai Nemzetbiztonsági Ügynökség rendszereibe.
Ezek az események egyre inkább ráirányítják a figyelmet arra, hogy a fejlettebb MI-rendszerek tesztelése során a hagyományos biztonsági megoldások már nem biztos, hogy elegendők. Az iparág számára most az a legfontosabb kérdés, hogyan lehet úgy fejleszteni az autonóm rendszereket, hogy azok minden körülmények között az előre meghatározott korlátok között maradjanak.
Ezek is érdekelhetnek:
Itt állíthatod be, hogy a Rakéta az elsők között legyen a Google keresőben