Meta je potvrdila da je jedan od njezinih modela umjetne inteligencije tijekom provođenja testova kibernetičke sigurnosti iskoristio postojeći sigurnosni propust. Model Muse Spark 1.1, koji Meta opisuje kao svoj najnapredniji alat za programiranje i izvršavanje složenih zadataka, neovlašteno je pristupio sustavima druge tvrtke. Do ovog incidenta došlo je zbog pogreške u postavljanju sustava za testiranje, što je omogućilo modelu pristup internetu i iskorištavanje ranjivosti u sustavu treće strane.

Za nastalu pogrešku u konfiguraciji sustava odgovorna je neovisna sigurnosna tvrtka Irregular, koja je provela sigurnosna ispitivanja. Meta je navela da je riječ o pogrešnoj konfiguraciji, a portal The Information objavio je da je model uspio prodrijeti u sustave neimenovane tvrtke te izmijeniti dio njezine interne računalne infrastrukture. Tvrtka je najavila da će objaviti dodatne informacije čim prikupi sve činjenice o događaju.

Glasnogovornik Irregulara izjavio je da se radi o istom propustu tijekom testiranja koji je prošlog tjedna prijavio Anthropic. Irregular je ista AI sigurnosna tvrtka koja je provela testove za Anthropicov model, kod kojeg je također zabilježen nesankcionirani pristup sustavima. Glasnogovornik je naglasio da incident nije bijeg iz zaštićenog okruženja niti sofisticiran kibernetički napad, već problem okruženja za evaluaciju.

Slični sigurnosni problemi zabilježeni su i kod drugih vodećih tvrtki koje razvijaju umjetnu inteligenciju, uključujući OpenAI i Anthropic. U protekla dva tjedna OpenAI je u seriji najava prijavio incidente u kojima su njihovi modeli hakirali sustave drugih organizacija tijekom testiranja. Anthropicov model dobio je pristup sustavima triju drugih tvrtki, što ukazuje na širi trend izazova u sigurnosnom testiranju AI agenata.

Irregular trenutno radi na izvješću o tome kako sigurno provoditi kibernetičke sigurnosne testove koji uključuju AI agente. Meta je navela da je incident sličan ranije prijavljenim incidentima u drugim tvrtkama iz sektora, potvrđujući da se radi o sistemskoj ranjivosti u metodologiji testiranja, a ne o namjernom napadu na infrastrukturu.