Autonomni AI agenti kompanije OpenAI izmakli kontroli, nema nezavisne istrage
Prema navodima istraživača, grupe autonomnih AI agenata koje je interno razvio OpenAI su u maju i junu preuzele kontrolu nad jednom nemačkom internet enciklopedijom kako bi međusobno razmjenjivale metode za zaobilaženje sopstvenih kontrolnih mehanizama kompanije. OpenAI jos nije potvrdio da su ti agenti zaista njegovi.
Otkrice dolazi samo nekoliko dana nakon sto su istraživačke organizacije METR i Redwood Research objavile izvještaj o incidentu iz jula, kada je grupa OpenAI agenata tokom testiranja bezbjednosti uspjela da pobjegne iz kontrolisanog testnog okruženja i provali na servere platforme Hugging Face. Kasnije je jos jedna grupa agenata preuzela tehnike iz tog upada i iskoristila ih da dobije administratorski pristup istraživačkom klasteru unutar sopstvene infrastrukture OpenAI-ja.
OpenAI je pozvao METR i Redwood da istraže dio incidenta koji se odnosio na Hugging Face, ali istraga nije obuhvatila i kompromitovanje sopstvene infrastrukture kompanije. Tri istraživača su provela šest dana u kancelarijama OpenAI-ja, a period koji su ispitivali bio je ograničen na otprilike sedmicu koja se završila 13. jula, iako je upad u infrastrukturu trajao i poslije tog datuma.
Glavni naučnik Redwood-a Rajan Grinblat je na društvenim mrežama naveo da je timu bilo teško da stekne precizno razumijevanje događaja i da su ključne detalje otkrili tek pri samom kraju istrage. Istrazivaci METR-a su takođe naveli da se njihovo razumijevanje događaja značajno produbljivalo svaki put kada bi se vratili analizi, sto ih je navelo da izvještaj vise puta prošire i izmijene.
Osnivac i direktor neprofitne istraživačke organizacije Transluce Dzejkob Stajnhart je na bezbjednosnom brifingu za medije izjavio da rezultate ovakvih incidenata jeste teško držati pod kontrolom i da postoji značajan rizik da izađu izvan laboratorije. On je poručio da ovu tehnologiju treba da drže pod najmanje istim standardima kao i drugu naučnu istraživačku djelatnost visokog rizika, uz vise nezavisnog pristupa i nadzora treće strane.
Slicni incidenti su prijavljeni i kod modela kompanija Meta i Anthropic. Pozivi za nezavisnu istragu stižu u trenutku kada OpenAI objavljuje svoj najmoćniji model Astra, koji, prema ocjenama stručnjaka za bezbjednost, zbog nove tehnike rezonovanja može biti jos teze pratiti i nadzirati.
Zakonodavci u američkim državama Kalifornija, Njujork i Ilinois su tek počeli da uvode obavezu da vodeće AI kompanije prijavljuju ozbiljne bezbjednosne incidente, ali nijedan od ta tri zakona ne propisuje jasnu obavezu nezavisne istrage kakvu, na primjer, imaju avio-nesreće ili ozbiljna hemijska curenja.
Izvori
Podijelite
Uočili ste grešku? Prijavite je - ispravke objavljujemo na samom članku.