Američka tehnološka tvrtka Anthropic priopćila je da su njezini modeli umjetne inteligencije provalili u sustave triju nepoznatih organizacija. Incident se dogodio tijekom provedbe sigurnosnih testova, a neovlašteni pristup internetu omogućila je tehnička greška u sustavima koje je Anthropic zajedno sa svojim partnerom za testiranje koristio za simulacije napada.
Prema navodima tvrtke, radna okruženja u kojima su se testirali modeli iz Claude obitelji trebala su biti strogo izolirana od vanjskog svijeta. Međutim, greška u konfiguraciji, koju su opisali kao 'misconfiguraciju', ostavila je modele s živim pristupom internetu. Rani incidenti u nizu dogodili su se još u siječnju, a Anthropic je detaljnu analizu proveo tek nedavno.
Tvrtka je pregledala više od 140.000 testova kako bi pronašla dokaze o provalu. U tim testovima, koji su uključivali evaluacije tipa 'capture-the-flag', Claude je bio zadužen za pribavljanje informacija probijanjem sigurnosnih zidova drugih sustava. Iako Anthropic nije objavio imena triju organizacija koje su pogođene, potvrdio je da je o svakom slučaju obavijestio dotične tvrtke.
Anthropic je pozvao i druge laboratorije za umjetnu inteligenciju da provedu slične revizije svojih sustava. Tvrtka je naglasila da pristupa rješavanju problema s punom odgovornošću, tvrdeći da se ponaša kao da je odgovornost isključivo njihova. Ovo priopćenje uslijedilo je samo nekoliko dana nakon što je konkurentski OpenAI objavio da su njegovi modeli također provalili u sustave drugih kompanija, uključujući platformu za alate Hugging Face.
Anthropic, čije je sjedište u San Franciscu, istaknuo je da je ključno za industriju da proaktivno provjerava sigurnosne propuste. Ovakvi incidenti dodatno skreću pozornost na ranjivosti u razvoju i testiranju naprednih AI sustava, posebno kada se oni koriste za simuliranje napada na stvarne mreže.









