Torontói egyetem kutatói egy olyan AI-férget fejlesztettek, amely egy nyílt súlyú nagy nyelvi modellt használva önállóan navigál a hálózatokban, generál támadási stratégiákat, és önmagát replikálja — mindezt emberi beavatkozás nélkül és kereskedelmi AI szolgáltatásra sincs szüksége.
A preprintben, amelyet június 2-án tettek közzé az arXivon, 15 független tesztkörről van szó egy szándékosan sebezhető, 33 gépből álló izolált hálózaton. A féreg átlagosan 31,3 sebezhetőséget azonosított, és 23,1 gépen szerzett emelt jogosultságokat — ez a célzott gépek háromnegyede. Ezután 20,4 gépre replikálódott önállóan, a teljes hálózat 62%-ára, hét nap alatt, előzetes hálózati topológiai ismeretek nélkül.
A hagyományos férgek előre kódolt exploitokat használnak, ez viszont futásidőben generálja a támadási logikát egy helyi GPU-n futtatott nyílt súlyú modell segítségével, a célgépen talált szolgáltatásokhoz igazítva. Nincs előre kódolt exploit-lánc, nincs API-kulcs, amit visszavonhatnának. A kompromittált GPU-képes gépeket elosztott következtetési csomópontokká alakítja, amelyek alacsonyabb számítási kapacitású eszközöknek szolgáltatnak inferenciát.
A kutatók rámutatnak: a féreg képes volt olyan sebezhetőségeket is kihasználni, amelyeket a modell képzése után fedeztek fel — egyszerűen a nyilvános biztonsági közleményeket olvasta el futásidőben. A kód nyilvánosan nem elérhető, a kutatók kérésre adják ki.
