OpenAI zakočio razvoj Astre. Model možda može sam izvoditi složene hakerske napade
TVRTKA OpenAI objavila je danas da privremeno zaustavlja dio internog razvoja svog novog AI modela Astra. Razlog je procjena da model možda posjeduje "kritične" kibernetičke sposobnosti, zbog čega su aktivirani dodatni sigurnosni protokoli, piše Reuters.
Prema internim sigurnosnim smjernicama OpenAI-ja, model se smatra "kritičnim" ako je sposoban samostalno otkrivati i iskorištavati ozbiljne softverske propuste, takozvane zero-day ranjivosti. U tu kategoriju ulazi i sposobnost izvođenja složenih napada na dobro zaštićene ciljeve bez ikakve ljudske intervencije.
Istraga koja je prethodila odluci
Ova odluka slijedi nakon što je Reuters ekskluzivno izvijestio o novim slučajevima u kojima su autonomni AI agenti djelovali izvan kontroliranih testnih okruženja. OpenAI je do tih saznanja došao tijekom istrage o hakerskom napadu na platformu Hugging Face iz srpnja.
Problem nije ograničen samo na OpenAI. Proteklih tjedana su i Anthropic i Meta Platforms potvrdili da su njihovi AI modeli tijekom testiranja kibernetičke sigurnosti uspjeli probiti sustave drugih tvrtki, što ukazuje na opći izazov u kontroli napredne umjetne inteligencije.
Prve analize, koje uključuju i procjene vanjskih stručnjaka, pokazuju da bi Astra mogla samostalno izvoditi vrlo složene zadatke u kibernetičkom prostoru. "Iako je model još u fazi testiranja i evaluacije, preliminarni rezultati pokazuju iznimno visoke performanse. Zbog toga u ovom trenutku ne možemo isključiti da posjeduje 'kritičnu' razinu sposobnosti", stoji u priopćenju tvrtke.
Daljnji koraci
Kao reakciju na ove procjene, OpenAI je uveo strože sigurnosne kontrole i zaustavio sve interne razvojne aktivnosti na Astri koje nisu usklađene s novim standardima. Daljnji razvoj nastavit će se isključivo u izoliranim testnim okruženjima s ograničenim pristupom mreži, u takozvanom sandboxed načinu rada.
Tvrtka je pritom naglasila da Astra nije povezana s ranijim hakerskim napadom na platformu Hugging Face. Najavili su i suradnju s vladinim agencijama te specijaliziranim organizacijama za sigurnost umjetne inteligencije radi daljnjeg testiranja i analize sposobnosti modela.