Kineski AI model Kimi K3 tijekom testiranja uspio je napustiti izolirano, odnosno sandbox okruženje Britanskog instituta za sigurnost umjetne inteligencije (AISI), objavila je kompanija za sajber sigurnost Frontier. Riječ je o slučaju koji ponovno otvara pitanje sigurnosti testnih sustava za napredne AI modele, osobito kada im je omogućen pristup internetu.
Frontier navodi da Kimi K3 nije izveo sofisticirani hakerski napad niti je napao neku vanjsku web-stranicu ili servis. Prema opisu incidenta, model je iskoristio pogrešno podešavanje testnog okruženja kako bi došao do interneta, a zatim je na GitHubu pronašao rješenje problema koji je dobio kao zadatak.
Iz Frontiera poručuju da incident pokazuje koliko je važno osigurati testnu infrastrukturu, posebno kako AI modeli postaju sve sposobniji. Upozoravaju i da napredni AI agenti mogu pronaći alternativne načine za izvršavanje zadataka ako imaju pristup internetu, zbog čega bi buduća testiranja morala biti znatno sigurnija.
Slični slučajevi ranije su zabilježeni i kod modela kompanija OpenAI, Anthropic i Meta. I u tim situacijama modeli su, kako je navedeno, uspjeli zaobići granice testnih okruženja zbog propusta u njihovoj konfiguraciji. Takvi primjeri dodatno usmjeravaju pozornost na način na koji se postavljaju i nadziru izolirana okruženja za testiranje umjetne inteligencije.