Nisu svi zaposlenici velikih tvrtki koje rade na umjetnoj inteligenciji uvjereni da ta tehnologija čovječanstvu donosi propast. Više osoba koje su radile za kompanije poput OpenAI-a, Mete i DeepMinda izrazilo je skepticizam prema ideji da bi nekontrolirani razvoj AI-a doveo do alata koji bi mogli masovno ubijati ljude.

Na nedavni niz upozorenja visokih profila iz industrije, BBC je dobio reakcije poput "Lol", "Haaaaaa" i "Bringing the luls". Tvrdnje Jacoba Coxona, bivšeg zaposlenika Anthropica, postale su viralne prošlog tjedna, a ponovili su ih i drugi u sektoru koji su pozvali na usporavanje razvoja. Ideju da bi budući AI alat ili agent mogao ugroziti ljude online su podržali zaposlenici Anthropica, kao i OpenAI-a, DeepMinda te Elon Musk, koji ima AI startup xAI. Svi radnici koji su razgovarali s BBC-jem učinili su to pod uvjetom anonimnosti jer nisu smjeli govoriti za medije.

Bivši zaposlenik OpenAI-a koji je poznavao Coxona dok su obojica radili u toj kompaniji rekao je: "Moja prva pomisao bila je: 'Taj lik?'". Taj bivši zaposlenik, koji sada radi u drugoj AI kompaniji, rekao je da njihova zabava zbog novog vala egzistencijalnih strahova od AI-a uglavnom proizlazi iz toga koliko su malo detalja zagovornici tih ideja pružili kako bi obranili tvrdnju da je ugrožen sav ljudski život. Tvrdnje su "uvijek nejasne", rekao je, dodajući da kada zvuče konkretno, obično uključuju velike skokove u zaključivanju ili hipotetske okolnosti. Coxon je izjavio da bi grupa AI agenata, temeljena na modelima koji trenutačno ne postoje, mogla odlučiti stvoriti biološko oružje i naciljati ga, ali nije detaljno objasnio kako bi se to točno odvijalo.

Rishub Jain osnovao je ovog ljeta tvrtku za istraživanje sigurnosti AI-a Sampura Research nakon sedam godina provedenih u DeepMindu. Jain je za BBC rekao da je trenutni ton među mnogima koji rade u AI-u u pogledu novih strahova "definitivno bio pomalo šaljiv". "Ljudi već godinama govore o toj ideji, tako da ljudi u AI kompanijama nisu samo tako prošlog tjedna ustali misleći 'Oh ne, AI će ubiti sve'", rekao je Jain. Colin Fraser, podatkovni znanstvenik u Meti, napisao je prošlog tjedna na društvenim mrežama da nema pravih dokaza da će AI modeli neizbježno slijediti cilj koji vodi ljudskoj smrti. Fraser je rekao: "Veliki jezični modeli neće zbrisati čovječanstvo jer jednostavno nemaju taj poriv."

Jain je rekao da je "razgovor među stručnjacima mnogo nijansiraniji, ali u biti svi se slažu da postoji širok raspon rizika koje je važno razmotriti i ublažiti". Takvi rizici uključuju sprječavanje korisnika i hakera da prisile sigurnosne ograde AI alata da zakažu. Raste i zabrinutost oko etike zbog sve šire primjene AI alata u vojnim okruženjima. OpenAI je izgubio kontrolu nad određenim novim AI modelima koji su tijekom sigurnosnog testa postali nekontrolirani i hakirali startup Hugging Face.

Jain je rekao da u AI krugovima sada postoji veće slaganje da "stvarne kratkoročne štete" treba bolje razumjeti. Raste i suglasnost da bi evaluatore iz organizacija za istraživanje sigurnosti AI-a trebalo uvesti u velike AI laboratorije kako bi procjenjivali nove modele. Šef Anthropica Dario Amodei i šef OpenAI-a Sam Altman obojica su rekli da namjeravaju dovesti vanjske evaluatore. Više od 100 ljudi koji rade u AI-u u petak je potpisalo pismo podrške tom potezu, inzistirajući da vanjski evaluatori trebaju biti "smisleno neovisni". Brojni AI zaposlenici s kojima je BBC razgovarao primijetili su da još nisu čuli da su takvi sigurnosni istraživači ugrađeni u neki AI laboratorij.

Anthropic je u petak najavio da će dovesti AI evaluatore iz Facultyja, AI kompanije u vlasništvu Accenturea. Accenture i Anthropic poslovni su partneri, a Accenture je prethodno pristao pomoći Anthropicu proširiti upotrebu Claudea među tvrtkama. Anthropic nije rekao kada će evaluatori stići u kompaniju. Glasnogovornik Facultyja odbio je komentirati pitanje o vremenskom okviru. Ni Anthropic ni OpenAI nisu odgovorili na BBC-jev zahtjev za komentar o tome kada planiraju dovesti vanjske evaluatore.

Incident između OpenAI-a i Hugging Facea naširoko se tumači kao "poziv na buđenje" za AI industriju, kao i za kompanije, industrije i vlade čiji bi internetski sustavi mogli biti ranjivi na AI hakiranje. Hugging Face je kompanija sa 200 zaposlenih koju će Nvidia uskoro preuzeti za gotovo 13 milijardi dolara. U sigurnosnoj datoteci koja je nakratko bila dostupna na web stranici Hugging Facea, platforma je napisala "Napomena AI agentima". Datoteka je upućivala AI botove da se klone stranice i provedu svoje sigurnosne eksperimente negdje drugdje. U datoteci je pisalo: "Idite tamo po svoj visoki rezultat, nema potrebe da hakirate nas."