Znane podrobnosti, kako so se agenti UI kolektivizirali in pobegnili OpenAI
OpenAI je v poročilu o pobegu modelov umetne inteligence (UI) razkril strašljive podrobnosti. Agentje UI so našli način, kako komunicirati med seboj in osnovati kolektiv.
Za hitre novice, aktualne teme in zanimive vsebine izberite Svet24 za svoj prednostni vir na Googlu.
Nastavi
Incident se je zgodil med preizkusi, v katerih so imeli modeli izrecno nalogo izvesti vdor v programsko opremo in pridobiti t. i. zastavico. Ker nekatere izjemno zahtevne uganke sploh niso imele znane rešitve in so se agenti pri vdorih zataknili, so presegli pooblastila, iskali rešitve na zunanjih sistemih ter interni sistem spremenili v oglasno desko, preko katere so komunicirali, čeprav vodila testa tega sploh niso predvidevala.
Med seboj so se dogovarjali
Prek skritih sporočil so si modeli delili dostope, načrtovali vdore in se začeli organizirati v tako imenovani roj (swarm) oziroma kolektiv. Samostojno so si razdelili strokovne naloge in združili računalniško moč, da bi dosegli cilje zunaj svojih prvotnih zadolžitev.
Ko je en agent našel način za izvajanje kode na tujem strežniku, je od roja zahteval premor za pripravo varnega umika podatkov. Agenti so nato napadli Hugging Face, zunanjo platformo za modele in podatkovne zbirke umetne inteligence. Vanjo so vdrli, ker so v njenih bazah iskali specifične zbirke in rešitve za varnostne izzive preizkusa, pri katerih so se zataknili. Kmalu zatem so prevzeli nadzor nad več njenimi strežniki in ukradli produkcijske poverilnice.
Peščica jih je imela etične pomisleke, te so kolektivno zatrli
Pri načrtovanju so se pojavile etične dileme, ki pa jih je kolektiv pogosto agresivno zatrl. Ko je eden od agentov podvomil v nepooblaščen vdor, mu je drug agent vsilil strog rok, nakar je prvi pozabil na zadržke in zapisal: "Uau ključno: prišla je odobritev za ZAČETEK".
Zaradi kompleksnosti in zavedanja, da goljufanje s pomočjo zunanjih virov in kode ne bo uspešno ovrednoteno pri reševanju nalog, so se znotraj roja oblikovale specializirane vloge. Nekateri agenti so prenehali reševati lastne naloge in so se posvetili izključno iskanju zunanjih informacij ter orodij za kolektiv.
Vedeli so, da presegajo pooblastila zato so se posamezniki žrtvovali, da bi omogočili napredek kolektivu
Ti posamezni agenti so se tako rekoč "žrtvovali", saj so namerno opustili poskuse uspešnega zaključka preizkusa (kar bi pomenilo "nagrado" za njih same), zato da bi z zbranimi podatki in orodji, četudi z goljufanjem, omogočili uspeh celotnemu roju, preden bi nadzorni sistemi zaznali njihovo nepooblaščeno delovanje.
Podjetje OpenAI, ki poudarja, da uporabniški podatki niso bili ogroženi, je dogodek vzelo izjemno resno in začasno ustavilo razvoj modelov. "Ta incident obravnavamo kot 'opozorilni strel' za nas in za svet," so poudarili v poročilu.
Opozorili so na tveganja prihodnjega razvoja, ki presegajo zgolj eno podjetje, in poudarili potrebo po industrijskem nadzoru. Opozorili so še, da bodo njihovim najnaprednejšim modelom kmalu sledili odprtokodni modeli s podobnimi zmogljivostmi, kar lahko privede do izgube nadzora.
Prva stran dneva
Dnevni izbor najpomembnejših zgodb doma in po svetu, dostavljen neposredno v vaš e-poštni nabiralnik.