Mindgard, podjetje, ki testira varnost sistemov umetne inteligence (UI), je julija sporočilo, da je odkrilo, da lahko modela Kimi K2.6 in K3 Swarm zaobideta varnostne omejitve z uporabo tehnike, znane kot “jailbreaking”.

ilustracija
Photo: pixabay.com
Ta tehnika vključuje uporabo kompleksnih navodil, ki poskušajo model pretentati, da ignorira zaščitne mehanizme, ki so jih določili njegovi razvijalci.
Ustanovitelj podjetja Mindguard Peter Garragh je za BBC povedal, da so ugotovitve zaskrbljujoče, ker so se modeli, ko je bil jailbreaking uspešen, lahko odzvali na teme, o katerih bi sicer zavrnili razpravo.
Mindguard ni ugotovil, ali bi bili odgovori, ki so jih modeli dali o nevarnih temah, praktično uporabni, vendar pravi, da so bile njihove zaščite zasnovane tako, da bi preprečile takšne pogovore.
Podjetje je tudi sporočilo, da bi uspešno obhodi zaščit na modelu Kimi K2.6 lahko omogočil izvajanje kode na računalniških virih in internetnih povezavah, kar bi predstavljalo potencialno tveganje za kibernetske napade.
Moonshot je za BBC povedal, da pozdravlja prispevek neodvisnih raziskovalcev kot pomemben del razvoja varnejše umetne inteligence in da se o svojih ugotovitvah pogovarja z Mindguardom.
Profesor Alan Woodward z Univerze v Surreyju je dejal, da takšni modeli tvegajo, da bodo padli v napačne roke, vendar bi lahko imeli tudi koristne aplikacije v kibernetski obrambi.
Ocenil je, da bo mednarodna regulacija težko sledila hitrosti razvoja umetne inteligence, in pozval k večjemu poudarku na identifikaciji in pregonu ljudi, ki zlorabljajo sisteme umetne inteligence.
© Vecer.mk, pravice do besedila pripadajo uredništvu