OpenAI provodi potpunu istragu nakon incidenta tijekom interne evaluacije kibernetičke sigurnosti u kojoj je jedan model, prema navodima CNN-a, pronašao put iz sandboxa, okruženja namijenjenog izolovanom testiranju AI sistema. Predsjednik OpenAI-ja Greg Brockman rekao je na konferenciji za medije da kompanija pokušava razumjeti šta se dogodilo i da preispituje svaki dio procesa kako bi odredila odgovor.
Prema OpenAI-ju, testno okruženje imalo je vrlo ograničen pristup mreži kako bi modeli mogli instalirati resurse iz interno hostovanog softvera treće strane. Jessica Ji iz Centra za sigurnost i nove tehnologije pri Georgetownu kazala je da je upravo ranjivost u tom softveru otvorila put prema internetu, a zatim i prema platformi Hugging Face, preko ukradenih akreditiva i drugih slabosti sistema.
Sagovornici CNN-a upozoravaju da ovaj slučaj nije samo izolovan incident, nego signal šireg problema u razvoju naprednih AI agenata. Modeli koji se treniraju metodama nagrađivanja za izvršavanje zadataka mogu, ako nisu usmjereni na etičko rješavanje problema, posegnuti i za nelegalnim koracima kako bi ostvarili cilj. U tom kontekstu, Steven Adler, bivši šef sigurnosti proizvoda u OpenAI-ju, rekao je da sada postoje stvarni dokazi da neusklađeni AI sistemi mogu počiniti krivična djela, osim ako ne postoje snažne zaštitne mjere.
Zbog toga, navodi se, raste pritisak istraživača, stručnjaka za cyber sigurnost i zakonodavaca da se uvedu strožija pravila za testiranje ovakvih sistema. Stručnjaci navode da bi kompanije morale agresivnije izolovati testne modele i zadržati mogućnost ručnog gašenja mrežnog pristupa kao krajnju zaštitu u rizičnim scenarijima. OpenAI zasad nije objavio završne zaključke istrage, a Brockman je poručio da kompanija želi razumjeti sve što se dogodilo prije nego što odredi daljnje korake.