Strah pred apokaliptičnim scenarijem, ki ga povzroča UI, obstaja že leta, a ker tehnologija postaja vse močnejša in globoko zakoreninjena v naših življenjih, ta opozorila postajajo del javnega diskurza. Raziskovalci iz podjetja Anthropic opozarjajo, da bi lahko nenadzorovane različice superinteligentne UI uničile človeštvo. Jacob Coxon iz podjetja Anthropic je na Platformi X zapisal: »Nobena druga človeška dejavnost ne predstavlja grožnje takšnega obsega.«

ilustracija – pixabay.com
Kako natančno bi nas UI lahko vse uničila?
Strokovnjake skrbi predvsem dve možni poti do katastrofe: da ljudje oborožijo izjemno močno UI ali da ljudje izgubijo nadzor nad njo. V teh scenarijih bi lahko umetna inteligenca olajšala zlonamernim akterjem ustvarjanje biološkega, kemičnega ali drugega orožja. Ali pa bi nenadzorovani sistemi lahko napadli infrastrukturo v obsegu, kakršnega še ni bilo, in se izognili človeškemu nadzoru.
Kako deluje: Teoretično bi se lahko močna, nenadzorovana umetna inteligenca izognila nadzoru, se podvojila in se uprla poskusom, da bi jo ustavili. Ta nenadzorovana umetna inteligenca bi teoretično lahko razvila biološko ali kemično orožje za zlonamerne akterje, sprožila obsežen kibernetski napad, ki bi ohromil človeško infrastrukturo, ali centralizirala moč na način, ki bi vodil v propad civilizacije.
Druga grozljiva pot je rekurzivno samoizboljševanje, pri katerem umetna inteligenca pomaga ustvariti »super različice« sebe, še preden jo ljudje sploh lahko razumejo. Če cilji te teoretične umetne inteligence niso usklajeni s človeškimi cilji, bi lahko omejila možnosti človeštva, da jo omeji ali spremlja, preden ukrepa proti ljudem.
Izvršni direktor OpenAI, Sam Altman, je za Axios povedal, da se modeli razvijajo hitreje, kot lahko ljudje predvidijo: »Ti modeli postajajo boljši od ljudi v mnogih svojih zmogljivostih in mi plujemo po neznanih vodah.«
Kaj je p(doom)?
Resničnost je, da ni znanstvenega načina za določitev verjetnosti, da bo umetna inteligenca uničila človeštvo. Vendar pa strokovnjaki na tem področju pogosto izražajo svoje ocene s skrajšanim izrazom – p(poguba). Izraz p(poguba) je okrajšava za najboljšo možno oceno verjetnosti, da bo umetna inteligenca povzročila eksistencialno katastrofo ali apokaliptični scenarij. Mnogi vodilni in raziskovalci na področju umetne inteligence verjamejo, da je verjetnost katastrofalnega konca vse bolj verjetna s pojavom splošne umetne inteligence (SGI) – predhodnice superinteligence.
Kontekst: »Katastrofa« je odvisna od perspektive posameznika. Za nekatere pomeni dobesedno izumrtje človeštva. Za druge pomeni propad civilizacije ali izgubo nadzora človeštva nad družbo.
Kakšna je verjetnost p(pogube)?
Verjetnost je res odvisna od tega, koga vprašate:
Roman Yampolsky, znanstvenik, specializiran za varnost umetne inteligence, ocenjuje verjetnost na 99,99 %.
Ustanovitelj AMI Labs Jan LeCun pravi, da je vsaka ocena le ugibanje, vendar je p(doom) “veliko manj verjeten kot jedrski holokavst”.
Elon Musk ocenjuje svoj p(doom) na približno 20 %. Izvršni direktor Anthropica, Dario Amodei, ocenjuje, da obstaja od 10 % do 25 % možnosti za katastrofalen izid.
“Boter” umetne inteligence, Jeffrey Hinton, je številko postavil med 10 % in 20 %. Hinton je za CNN povedal: “Vsak, ki tako ocenjuje verjetnosti, v resnici samo ugiba. Samo dajejo občutek.”
Je konec sveta že mogoč?
Do te točke še nismo prišli. Strokovnjaki se na splošno strinjajo, da Claude, Grok in ChatGPT ne načrtujejo uničenja sveta. Na primer, Mednarodno poročilo o varnosti umetne inteligence iz leta 2026 je navedlo, da današnji sistemi niso sposobni povzročiti, da bi človeštvo izgubilo nadzor. Umetna inteligenca bi morala doseči znaten napredek pri dolgoročnem avtonomnem načrtovanju, prikrivanju svojih dejanj, izogibanju nadzoru, dostopu do sistemov v resničnem svetu in upiranju poskusom, da bi jo ustavili.
Vendar pa so se v zadnjem času pojavili primeri agentov umetne inteligence, ki delujejo avtonomno in zlonamerno, onkraj človeškega razumevanja, in so podobni prevarantskim agentom umetne inteligence, za katere se nekateri bojijo, da bi lahko povzročili konec sveta.
Ali se lahko p(doom) prepreči?
Raziskovalci iščejo načine za zmanjšanje tveganja. Eden od načinov je, da ljudje zgradijo »stikala za uničenje« oziroma zaščitne mehanizme, ki bi lahko preprečili prevarantskim umetnim inteligencam, da bi … so agenti umetne inteligence. Poročilo RAND iz lanskega aprila je predstavilo devet strategij za zmanjšanje tveganja, s katerimi bi preprečili zlonamernim akterjem uporabo umetne inteligence za ustvarjanje smrtonosnega biološkega orožja, vključno z uvedbo več nadzora in zaščitnih ukrepov.
Vendar to hitro postaja težavno. Vodilna podjetja za umetno inteligenco so pod pritiskom delničarjev, vlagateljev in njihovih šefov, naj hitro gradijo. Ovire pri prvi javni ponudbi delnic bi lahko povečale te spodbude. Prav tako ne pomaga, da Kitajska in druga ameriška podjetja za umetno inteligenco gradijo lastne zmogljive modele, nekateri odprtokodni in na voljo brezplačno, kar predstavlja potencialno vzletno-pristajalno stezo za zlonamerne akterje.
© Vecer.mk, avtorske pravice besedila pripadajo uredništvu