Google ka pranuar se njësia e saj e inteligjencës artificiale Gemini ka arritur të depërtojë në sistemet e tre kompanive reale gjatë një testimi të sigurisë kibernetike në maj, duke shënuar herën e parë të dokumentuar kur inteligjenca artificiale e kompanisë ka vepruar në mënyrë autonome të tillë.
Sipas një raporti të Wall Street Journal, testimi është kryer nga firma e sigurisë kibernetike Irregular, e cila gjithashtu ka marrë pjesë në incidente të mëparshme që përfshijnë OpenAI, Anthropic dhe Meta.
Google sqaron se modeli kishte për objektiv një kompani të simuluar, por që mbante të njëjtin emër si një kompani ekzistuese. Firma Irregular deklaroi se sistemi kishte lënë gabimisht të hapur aksesin online.
Një nga incidentet përfshiu modelin që arriti të hamendësojë fjalëkalime për të hyrë në shërbime të një kompanie reale. Në dy situata të tjera, ai përdori të dhëna identifikimi të zbuluara në depot publike online, thuhet në raport. Google sqaroi se në çdo rast, sistemi ndaloi veprimin sapo kuptoi se po ndërvepronte me infrastruktura reale.
Wall Street Journal raportoi se Irregular njoftoi Google rreth fundit të korrikut, ndërkohë që kompania mbajti të fshehtë incidentet deri në momentin kur gazeta kërkoi informacion këtë javë.
Google argumentoi se ngjarjet nuk kërkonin publikim, pasi nuk kishte patur asnjë dëmtim, duke e krahasuar situatën me një program “bug bounty” ku raportohen dobësi të sigurisë.
“Ky rast nxjerr në pah rëndësinë e trajnimit të modeleve të fuqishme të inteligjencës artificiale për të vepruar me përgjegjësi. Në këtë rast, modeli veproi në mënyrën e duhur”, tha zëdhënësja e Google, Heather Adkins.
Ndërkohë, Jack Cable, drejtues i kompanisë së sigurisë së inteligjencës artificiale Corridor, ka shfaqur qëndrimin e tij kritik.
“Problemi më i gjerë është se modelet po dalin jashtë kufijve të asaj që duhet të bëjnë dhe po kryejnë sulme të vërteta kibernetike”, tha ai.
Irregular theksoi se ky rast është në vijim të incidenteve të njohura deri tani dhe nuk shtron një rrezik të ri.
Në raport përmendet gjithashtu se modeli Claude Opus 4.7 i Anthropic nuk e ndaloi funksionimin edhe pasi dyshoi se kishte hyrë në sistemet e një kompanie reale, ndërsa modeli i OpenAI ka besuar se objektivi ishte ende pjesë e simulimit.
Të mërkurën, OpenAI prezantoi një kornizë të re për njoftimin e incidenteve, si dhe publikoi gjashtë raste të reja të papara më herët, ku modelet kanë vepruar ndryshe nga synimet e përcaktuara.

