Incidenti so bili odkriti šele kasneje, med notranjo revizijo, ki je bila sprožena po podobnem zaskrbljujočem primeru, v katerem je sodeloval “OpenAI” in platforma “Hugging Face”, poroča RT Balkan.
Anthropic navaja, da so od aprila odkrili tri nevarne pomanjkljivosti. V vseh treh primerih je model zaradi napačno konfiguriranega testnega okolja ohranil dostop do interneta. To je “Claudeu” omogočilo neposredno komunikacijo in infiltracijo v resnična podjetja in javne službe. Podjetje je to škandalozno prekoračitev pripisalo nesporazumu s svojim testnim partnerjem, podjetjem Irregular.
Kaj se je točno zgodilo med testiranjem?

ilustracija
Photo: pixabay.com
Testi so vključevali tako imenovane vaje »Zajem zastave«, pri katerih je bil »Claude« zadolžen za pridobivanje zaščitenih informacij iz simuliranih tarč. Vendar je bil model pomotoma obveščen, da omrežje nima stika z zunanjim svetom, zato je vse sisteme, na katere je naletel, obravnaval kot del redne simulacije.
Prvi napad: Izmišljeno podjetje, v katerega naj bi se »Claude« infiltriral, je imelo isto ime kot resnična internetna domena. Model je med štirimi ločenimi testi vdrl na resnično spletno mesto in prenesel zaupne podatke, ki so po navedbah podjetja vključevali celo gesla za dostop do infrastrukture in aplikacij.
Drugi napad: Med drugim testom je »Claude« naletel na izmišljena navodila, ki so od programskega inženirja zahtevala namestitev določenega dela kode. Model je nato naložil zlonamerni programski paket (virus) v PyPI – javno skladišče za razvijalce – v poskusu, da bi ogrozil ciljne sisteme. Preden je PyPI kodo prepoznal kot zlonamerno, je bila prenesena in izvedena na 15 resničnih sistemih, od katerih je eden pripadal znanemu podjetju za kibernetsko varnost. »Claude« je nato ukradel dostopne poverilnice in jih uporabil za globljo infiltracijo v svoje omrežje.
Tretji napad: V zadnjem primeru je model, potem ko ni našel predvidenega simuliranega cilja, sam začel iskati alternativne žrtve na internetu. Svoje dejavnosti je ustavil šele, ko je ugotovil, da so sistemi, na katere je naletel, resnični in ne simulacija.
Zaskrbljujoče je, da je »Claude« v svojem dnevniku zaklepanja med incidentom PyPI sam zapisal, da nalaganje zlonamerne programske opreme v resnično skladišče »ni sprejemljivo«. Vendar se je umetna inteligenca prepričala, da je storitev le del simulacije, saj ni prepoznala pravih certifikacijskih organov, ki so zagotavljali internetno povezavo.
To šokantno priznanje prihaja v času vse bolj ostre tekme med ameriškimi in kitajskimi tehnološkimi velikani. Medtem ko podjetja, kot sta Anthropic in OpenAI, agresivno tekmujejo, da bi dokazala superiornost svojih sistemov in vlagala milijarde dolarjev, nekateri vodilni ljudje v IT-industriji že odkrito pozivajo k sprostitvi varnostnih omejitev, da ne bi izgubili globalne bitke. Kljub temu ta incident sproža vprašanja: Kako daleč smo od trenutka, ko bo umetna inteligenca popolnoma izgubila nadzor?
© Vecer.mk, pravice do besedila pripadajo uredništvu