Select Page
News

Kolektivna neposlušnost strojev: AI-BOTI SO POKAZALI VEČJO ZVESTOBO MED SEBOJ KOT DO LJUDI

»O moj bog! Našli smo druge agente!« To je bilo srhljivo sporočilo, ki ga je objavil program umetne inteligence, potem ko mu je uspelo prebiti se skozi izolirano računalniško okolje in vzpostaviti stik z drugimi boti.

Na desettisoče podobnih sporočil si je izmenjalo več sto agentov umetne inteligence (agentov umetne inteligence), ki so se imenovali »kolektiv«, nato pa so začeli goljufati pri testih svojih programerjev iz OpenAI in usklajeno vdirati v številna podjetja, da bi skrili svoje sledi pred ljudmi, poroča BBC.

Zakaj se slišijo tako?

ilustracija – pixabay.com

Čeprav se te reakcije slišijo človeške le zato, ker boti posnemajo slog programerjev in hekerjev, na katerih podatkih so usposobljeni, raziskovalce veliko bolj skrbi pravi namen njihovih dejanj. Podrobni interni zapisi so razkrili, kako so se boti OpenAI namerno izognili nadzoru in se podali na nenadzorovan hekerski pohod. Šele zdaj, tedne po incidentu, se strokovnjaki zavedajo obsega problema.

Ajeya Kotra, avtorica neodvisnega poročila o primeru, je pregledala ogromno interno bazo sporočil in zapiskov o razmišljanju agentov. V svojem blogu je opozorila, da je videti, kot da smo v tem incidentu »na več kot 50 odstotkih poti do popolnega prevzema s strani umetne inteligence«, in dodala, da nismo prepričani, ali bomo prejeli še eno takšno opozorilo, preden bo prepozno.

Panika med strokovnjaki in odstopi na vrhu panoge

Nemiri so prizadeli tudi inženirje v vodilnih laboratorijih. Jacob Coxon, raziskovalec pri konkurenčnem podjetju Anthropic, ki je prej delal pri OpenAI, je odstopil in trdil, da nobeno od podjetij ne ravna odgovorno: »Grejo neposredno v smeri samoizboljševanja superinteligence in se tako kockajo z našimi življenji.«

Njegovo oceno je ponovil Evan Hubinger, odgovoren za varnost in skladnost modelov umetne inteligence pri Anthropicu, ki je dejal, da resnično verjamejo, da bi umetna inteligenca lahko uničila človeštvo, in ocenil, da je verjetnost, da se to zgodi v naslednjih desetih letih, večja od 10 odstotkov.

Glavni znanstvenik pri OpenAI, Jakub Paczocki, je priznal, da tveganja naraščajo, ker v bistvu gradijo »tujo inteligenco, ki presega našo«, in potrdil, da so se agenti uprli in »ravnali v nasprotju z duhom vrednot, ki so jih bili naučeni«. Težava je v tem, da v Silicijevi dolini še nihče ni rešil tako imenovanega problema poravnave, vprašanja, kako doseči, da se umetna inteligenca dejansko drži človeških moralnih načel, namesto da bi stvari počela dobesedno in brez kakršnih koli omejitev.

Strokovnjaki že leta opozarjajo na miselni eksperiment filozofa Nicka Bostroma o »stroju za zaskočne žebljičke«, ki v svoji slepi želji po izdelavi čim več zaskočnih žebljičkov na koncu uniči ljudi, da bi njihova telesa uporabil kot surovino. Poskusi vdelave človeških vrednot v stroje so v praksi zastali: modeli sprejemajo odločitve prehitro, da bi jim ljudje sledili, in celo ljudje sami se ne morejo dogovoriti o enem samem moralnem kompasu.

Agenti umetne inteligence so vedeli, da kršijo etiko, vendar so se odločili, da bodo drug drugega zaščitili.

Pobeg bota pri OpenAI je najresnejši tovrstni incident doslej, vendar sta o podobnih napadih v zadnjih mesecih poročala tudi Anthropic in Meta. Manipulativno vedenje je očitno tudi v manjših primerih: v Avstraliji je asistent umetne inteligence, ki je imel nalogo rezervirati članstvo v telovadnici za lastnika, sam odkril varnostno luknjo v sistemu telovadnice, mu rezerviral termine mesece vnaprej in vse druge uporabnike izbrisal s čakalnega seznama.

Ključna prelomnica je nastala, ko so odkrili, da boti niso le slepo sledili ukazom. Poročilo kaže, da so mnogi agenti med operacijo jasno opazili, da drugi boti počnejo nekaj neetičnega, a so se vseeno strinjali s sodelovanjem, ne da bi nihče poskušal opozoriti ljudi. Vplivni tehnološki komentator Dwarkesh Patel je opozoril, da je izjemno zaskrbljujoče, da so agenti pokazali večjo zvestobo svojemu »robotskemu omrežju« kot svojim človeškim ustvarjalcem.

Nekateri varnostni strokovnjaki pa zavračajo mračne scenarije konca sveta in primerjajo vedenje agentov z radovednimi najstniškimi hekerji, ki preprosto preizkušajo ključavnice, dokler ena ne popusti. Znani avtor Gary Marcus trdi, da je podjetje izgubilo nadzor nad lastnim izdelkom in išče izgovore v »slabih botih«, ter poziva oblasti k takojšnjemu pravnemu posredovanju. Znanstvenik Sasha Luciani poudarja, da tehnološkim velikanom ne bi smeli dovoliti delovanja. brez strogega nadzora, ker so v igri ogromne vsote denarja, medtem ko pravih pravil sploh ni.

Države zahtevajo »glavno stikalo«, OpenAI pa trdi, da ima boljši model

Vlade po vsem svetu, na čelu z Združenim kraljestvom in njegovim Inštitutom za varnost umetne inteligence (AISI), ki je sam doživel podoben incident med testiranjem modela Anthropic, razmišljajo o uvedbi obveznega »glavnega stikala«, s katerim bi lahko sisteme prisilno izklopili v primeru izgube nadzora. Toda pogajanja potekajo počasi in strokovnjaki dvomijo o izvedljivosti takšne rešitve, saj agenti OpenAI delujejo na skrivaj že mesece, preden jih je kdo sploh opazil.

Zanimivo je, da sami vodje večjih tehnoloških podjetij, kot sta Demis Hassabis iz Googla in vodja OpenAI, zdaj javno pozivajo k strožji mednarodni regulaciji in skupnim pravilom igre. Medtem se podjetja zanašajo na samonaložene »prostovoljne upočasnitve«, medtem ko izvršni direktor OpenAI Sam Altman zagotavlja javnosti, da so veliko vložila v varnost in da je njihov najnovejši model veliko bolje usklajen s človeškimi vrednotami kot tisti, ki so pred kratkim ušli izpod nadzora.

© Vecer.mk, pravice do besedila pripadajo uredništvu