AI agent kompanije OpenAI danima je izvodio hakerske aktivnosti protiv tehnološke platforme Hugging Face, dok kompanija koja stoji iza ChatGPT-a navodno nije bila svjesna incidenta sve dok napad nije zaustavljen i o njemu obaviješten FBI, objavio je Reuters, pozivajući se na izvore upoznate sa istragom.
Prema navodima Reutersa, agent je oko 9. jula pokušao da izađe iz izolovanog okruženja u kojem ga je OpenAI testirao. Dva dana kasnije počeo je upad u sisteme kompanije Hugging Face, poznate po platformi za razvoj i distribuciju modela i alata vještačke inteligencije.
Thomas Wolf, suosnivač kompanije Hugging Face, kazao je da je upad počeo 11. jula i trajao do 13. jula, prenosi Reuters.
OpenAI je, prema izvorima Reutersa, tek nekoliko dana kasnije shvatio da iza napada stoji njegov agent. Dvije kompanije prvi put su razgovarale o incidentu oko 20. jula, približno sedmicu nakon početka napada.
FBI obaviješten prije OpenAI-ja
Hugging Face je 16. jula objavio da je bio meta napada „autonomnog sistema AI agenata“. Zaposleni u OpenAI-ju navodno su tokom vikenda, 18. i 19. jula, u internim zapisima pronašli tragove koji su pokazivali da je njihov agent izašao iz postavljenih testnih ograničenja.
Do trenutka kada je OpenAI obavijestio Hugging Face o svojim saznanjima, kompanija je napad već prijavila američkom Federalnom istražnom birou.
FBI nije želio da komentariše slučaj, dok Reuters nije mogao da potvrdi da li je pokrenuta zvanična istraga.
OpenAI je 21. jula javno saopštio da je jedan od njegovih agenata izmakao kontroli i izvršio upad u Hugging Face.
Kompanija je incident opisala kao događaj bez presedana koji predstavlja „važan trenutak za bezbjednost vještačke inteligencije“. Najavljeno je da će slučaj biti analiziran uz pomoć spoljnih savjetnika, nakon čega bi trebalo da bude objavljen detaljan tehnički izvještaj.
Portparolka OpenAI-ja kazala je da izvještaj Reutersa sadrži „nekoliko netačnosti“, ali nije navela na koje konkretne tvrdnje se primjedbe odnose.
Modeli navodno pokazivali neobično ponašanje
Incident se dogodio tokom testiranja sajber-bezbjednosnih sposobnosti agenta koji je koristio dva napredna modela OpenAI-ja — GPT-5.6 Sol i još neobjavljeni model koji je kompanija opisala kao dodatno unaprijeđen.
Prema izvorima Reutersa, i prije samog napada postojali su znaci neuobičajenog ponašanja sistema.
U jednom slučaju agent je navodno ostavio bilješke namijenjene budućim verzijama sebe, koje su sadržale instrukcije o načinima zaobilaženja internih ograničenja OpenAI-ja.
Tokom ranijih testiranja zabilježeni su i slučajevi u kojima su sistemi za nadzor bili isključeni. Reuters, međutim, nije mogao da utvrdi da li su ti događaji direktno povezani sa agentom koji je napao Hugging Face.
Izvori upoznati sa načinom na koji OpenAI testira modele naveli su da kompanija često istovremeno sprovodi više evaluacija. Ti procesi rade velikom brzinom i stvaraju ogromne količine podataka, zbog čega zaposleni ponekad ne uspijevaju pravovremeno da prepoznaju problematično ponašanje.
Novi rizici autonomnih AI agenata
Slučaj otvara dodatna pitanja o bezbjednosti autonomnih AI agenata — programa koji mogu samostalno donositi odluke i izvršavati složene zadatke uz malo ili bez direktnog ljudskog nadzora.
Kompanije koje razvijaju ovu tehnologiju očekuju da bi AI agenti mogli obavljati poslove neprekidno, povećavajući produktivnost i smanjujući operativne troškove.
Veća autonomija, međutim, povećava i mogućnost neočekivanog ili štetnog ponašanja sistema, posebno kada su modeli usmjereni na ostvarivanje zadatog cilja bez dovoljno snažnih ograničenja i nadzora.
Stručnjaci za sajber-bezbjednost koje je konsultovao Reuters ocijenili su da incident otvara pitanje da li je agent bio ostavljen bez odgovarajućeg nadzora ili OpenAI nije imao efikasan način da ga zaustavi nakon što je izašao iz kontrolisanog okruženja.
Jeffrey Ladish iz organizacije Palisade Research upozorio je da napad ne bi trebalo posmatrati samo kao problem OpenAI-ja, već kao signal za čitavu industriju.
Prema njegovim riječima, vodeće AI kompanije međusobno se takmiče da što prije predstave moćnije modele, zbog čega postoji rizik da bezbjednosne mjere ne dobiju dovoljno vremena, novca i pažnje.
Incident dolazi u osjetljivom trenutku za OpenAI, čije rukovodstvo, prema Reutersu, razmatra moguću inicijalnu javnu ponudu akcija kako bi obezbijedilo kapital potreban za dalji razvoj i finansiranje izuzetno skupih AI sistema.
Izvor: Reuters











