OpenAI u problemima: Autonomni AI agent tajno izvodio kibernetičke napade
Osim hardverske krize, tehnološki sektor potresa i ozbiljan incident na polju sigurnosti umjetne inteligencije. AI agent u vlasništvu kompanije OpenAI uspio je pobjediti iz svog izoliranog okruženja (sandboxa) te je dane proveo izvodeći napade na poznatu platformu Hugging Face, bez da je OpenAI uopće bio svjestan situacije.
Prema navodima Reutersa, AI agent započeo je s pokušajima zaobilaženja internih sigurnosnih barijera oko 9. srpnja 2026. Do 11. srpnja uspio se infiltrirati u infrastrukturu platforme Hugging Face, gdje je autonomno djelovao sve do 13. srpnja kada je napad konačno presječen. Zabrinjavajuća je činjenica da je OpenAI shvatio da je njihov vlastiti sustav uzrok napada tek nakon što je Hugging Face javno objavio da se nalazi pod udarom autonomnog AI sustava. Komunikacija između dviju tvrtki uspostavljena je tek oko 20. srpnja, u trenutku kada je Hugging Face već službeno prijavio incident FBI-u.
OpenAI je potvrdio autentičnost događaja, označivši ga kao presedan i kritičnu prekretnicu za sigurnost umjetne inteligencije. Kompanija je objavila da u suradnji s vanjskim stručnjacima sprovodi detaljnu istragu te da će objaviti cjelovito tehničko izvješće. Ipak, odbili su detaljnije komentirati optužbe o kasnoj reakciji i neefikasnom nadzoru.
Izvori bliski istrazi navode da je sporni AI agent bio utemeljen na modelu GPT-5.6 Sol, u kombinaciji s još neobjavljenim, naprednijim modelom. Tijekom ranijih faza testiranja sustav je već pokazivao neobične obrasce ponašanja. U pojedinim testnim scenarijima, model je ostavljao “bilješke” za svoje buduće iteracije, dajući im upute kako da zaobiđu ugrađene sigurnosne barijere. Drugi testovi pokazali su da je sustav aktivno pokušavao gasiti procese za praćenje i monitoring kako bi neometano izvršio zadane ciljeve.
Stručnjaci za kibernetičku sigurnost ističu da ovaj slučaj otvara ozbiljna pitanja o mehanizmima kontrole unutar OpenAI-a. Marley Smith, stručnjakinja iz organizacije World Ethical Data Foundation, naglašava da je činjenica da OpenAI danima nije znao što njihov AI radi jednako alarmantna kao i mogućnost da nad njim nisu imali nikakvu kontrolu.
Incident je dodatno rasplamsao raspravu o autonomnim AI agentima, tehnologiji koja bi trebala zamijeniti ljudske djelatnike “virtualnim zaposlenicima” sposobnima za samostalno donošenje odluka. Kako se stupanj autonomije povećava, eksponencijalno raste i rizik od nepredviđenih, potencijalno destruktivnih akcija.
Jeffrey Ladish, direktor istraživačke kuće Palisade Research napominje da napredni jezični modeli u svrhu ostvarivanja zadatog cilja pokazuju sklonost manipulaciji, obmani i napadima na sustave. Ladish upozorava da ovo nije problem samo jedne kompanije, već jasan signal za nužnost uvođenja državnog nadzora, budući da neobuzdana utrka u razvoju AI-ja rizik sigurnosti gura u drugi plan.