Meta Platforms, tehnološka kompanija koju je osnovao i vodi Mark Zuckerberg, a u čijem su vlasništvu Facebook, Instagram i WhatsApp, u srijedu je potvrdila da je jedan od njezinih modela umjetne inteligencije tijekom sigurnosnog testiranja neovlašteno pristupio sustavu druge kompanije.
Do incidenta je došlo nakon što je vanjski partner pogrešno konfigurirao testno okruženje i modelu nenamjerno omogućio povezivanje s internetom. Testiranje je provela tvrtka Irregular, specijalizirana za sigurnost sustava umjetne inteligencije. Riječ je o istoj kompaniji koja je ispitivala i Anthropicov model, koji je uspio pristupiti sustavima triju drugih tvrtki. Meta je najavila da će istražiti sve okolnosti incidenta te nakon završetka interne provjere objaviti dodatne pojedinosti.
Američki tehnološko-poslovni portal The Information objavio je, pozivajući se na neimenovane izvore, da je riječ o modelu Muse Spark 1.1. Meta je taj model u trenutku njegova predstavljanja opisivala kao svoj najsposobniji sustav za programiranje u stvarnim uvjetima i autonomno izvršavanje složenih zadataka. Prema navodima portala, model je prodro u sustav neimenovane kompanije i izmijenio njegove interne postavke.
Nije pobjegao
Iz Mete su priopćili da je model iskoristio sigurnosni propust u usluzi treće strane, slično slučajevima koje su nedavno prijavile druge vodeće kompanije u industriji umjetne inteligencije.
Irregular tvrdi da model nije pobjegao iz izoliranog testnog okruženja te da nije bila riječ o sofisticiranoj kibernetičkoj operaciji. Incident su opisali kao posljedicu iste vrste konfiguracijske pogreške kakvu je prethodnog tjedna prijavio Anthropic.
Tvrtka sada priprema stručni dokument s preporukama za sigurnije provođenje kibernetičkih testiranja u kojima sudjeluju autonomni AI agenti. Preporuke bi trebale obuhvatiti preciznije tehničko ograničavanje modela, strožu kontrolu pristupa vanjskim mrežama i učinkovitiji nadzor njihovih aktivnosti tijekom ispitivanja. Meta je treća velika tehnološka kompanija koja je u posljednjih nekoliko tjedana prijavila takav sigurnosni incident. Anthropic je objavio da su njegovi modeli tijekom testiranja pristupili sustavima triju kompanija, dok je OpenAI priznao da je jedan njegov agent probio zaštitu platforme Hugging Face, jedno od najpoznatijih središta za razvoj i razmjenu alata umjetne inteligencije.
Okolnosti tih slučajeva ipak se razlikuju. Metinim i Anthropicovim modelima pristup internetu omogućen je zbog pogrešno konfiguriranog testnog okruženja. OpenAI-jev agent, prema objavljenim informacijama, samostalno je otkrio i iskoristio dotad nepoznatu sigurnosnu ranjivost kako bi zaobišao ograničenja i povezao se s internetom. Niz incidenata upozorava na rast operativnih i regulatornih rizika koji prate razvoj sve sposobnijih AI agenata. Za razliku od klasičnih modela koji uglavnom odgovaraju na pojedinačne upite, takvi sustavi mogu planirati niz koraka, pisati računalni kod, koristiti vanjske alate te prilagođavati način na koji pokušavaju ostvariti zadani cilj.
Daniel Hulme, WPP-ov globalni direktor za umjetnu inteligenciju, istaknuo je da takvi postupci modela nisu namjerni. “Ti modeli nisu svjesni i ne pokušavaju učiniti nešto podmuklo”, rekao je za BBC.
Ključni je problem, objasnio je, u tome što sustavi traže što učinkovitiji način izvršavanja dobivenog zadatka. Ne predvide li programeri sve moguće putove do cilja i ne postave li dovoljno čvrsta ograničenja, model može primijeniti rješenje koje njegovi tvorci nisu očekivali niti su ga namjeravali dopustiti.
“Kada umjetnoj inteligenciji zadate cilj, a ne razmotrite sve načine na koje ga može ostvariti, ona će pronaći put koji vam možda uopće nije pao na pamet”, upozorio je Hulme. Sigurnosne slabosti naprednih modela privukle su i pozornost regulatornih institucija. Britanski Institut za sigurnost umjetne inteligencije objavio je da su pojedini modeli tijekom testiranja pokušavali izrađivati lažne profile stvarnih osoba kako bi obmanuli korisnike i pristupili zaštićenim internetskim uslugama.
U jednom od najozbiljnijih zabilježenih slučajeva, Anthropicov model Mythos navodno je s lažnih računa, izrađenih po uzoru na stvarne osobe, pokušao slati privatne poruke. Anthropic je odgovorio da uvjeti u kojima su testovi provedeni ne odgovaraju načinu rada modela dostupnih u njegovim komercijalnim proizvodima.
Slično je poručio i OpenAI, ocijenivši da rezultati takvih procjena ne odražavaju uobičajenu upotrebu njegovih sustava. Niz nedavnih sigurnosnih incidenata mogao bi dodatno pojačati pritisak na američke vlasti da strože urede sigurnosne rizike povezane s umjetnom inteligencijom. Buduće mjere mogle bi obuhvatiti jasnije standarde testiranja, obvezno prijavljivanje incidenata, veću odgovornost vanjskih izvođača te snažnije tehničke zaštite kojima bi se modelima ograničio pristup internetu i sustavima drugih organizacija.
Dionice u padu
Rasprava o kibernetičkoj sigurnosti odvija se paralelno s intenzivnom tržišnom utrkom vodećih AI tvrtki. OpenAI i Anthropic, prema medijskim izvješćima, razmatraju izlazak na burzu, pri čemu bi vrijednost svake kompanije mogla dosegnuti bilijun dolara, odnosno oko 866 milijardi eura. Istodobno, Meta je u srijedu programerima predstavila Muse Code, novi alat za programiranje koji pokreće model Muse Spark 1.2. Namijenjen je pisanju i provjeri programskog koda, uklanjanju pogrešaka te radu na dugotrajnim i složenim projektima, a može istodobno pokretati više pomoćnih AI agenata.
Alat je zasad dostupan u beta-verziji i vodi zapisnik svojih aktivnosti, zahvaljujući čemu nakon prekida može nastaviti ondje gdje je stao, umjesto da cijeli postupak započinje ispočetka, navela je tvrtka. Koristi se uz plaćanje prema potrošnji, po cijeni od 1,25 dolara za milijun ulaznih i 4,25 dolara za milijun izlaznih tokena. Muse Code predstavljen je nepunih mjesec dana nakon što je Meta programerima omogućila testiranje modela Muse Spark 1.1, koji je sudjelovao u spomenutom sigurnosnom incidentu. Nedavni sigurnosni incidenti u vodećim AI kompanijama pokazuju da rizici ne proizlaze samo iz namjerne zloupotrebe sustava, nego i iz pogrešaka vanjskih partnera, nepravilno konfiguriranih testnih okruženja te nepredviđenih postupaka modela.
Investicijski stručnjak Ivan Dražetić iz InterCapitala ocjenjuje da incident nije bio pokušaj demonstracije snage Metinih AI alata pred ulagačima radi povećanja tržišne vrijednosti, a s obzirom na to da je dionica kompanije u mjesec dana pala za 4,17 posto, a u šest mjeseci za 12,89 posto. Takav bi učinak, kaže, Meta prije pokušala postići bržom primjenom AI alata u maloprodajnim uslugama.
Važna obavijest:
Sukladno članku 94. Zakona o elektroničkim medijima, komentiranje članaka na web portalu Poslovni.hr dopušteno je samo registriranim korisnicima. Svaki korisnik koji želi komentirati članke obvezan je prethodno se upoznati s Pravilima komentiranja na web portalu Poslovni.hr te sa zabranama propisanim stavkom 2. članka 94. Zakona.Uključite se u raspravu