Novi model veštačke inteligencije nije prošao bezbednosne testove
Kompanija OpenAI odlučila je da ne objavi GPT-6.1 Astra, novu verziju svog naprednog modela veštačke inteligencije koja je trebalo da bude predstavljena u oktobru. Odluka je doneta nakon internih testiranja koja su pokazala da model nije dostigao standarde kompanije kada je reč o poštovanju zadatih ovlašćenja, granica zadatka i transparentnom obaveštavanju korisnika o radnjama koje je preduzeo.
GPT-6.1 Astra razvijan je kao sistem sposoban da samostalnije obavlja složene i dugotrajne zadatke, uključujući korišćenje različitih digitalnih alata i servisa. Upravo je povećana autonomija tokom testiranja otvorila dodatna bezbednosna pitanja.
Prema informacijama koje su potvrdili OpenAI i međunarodni mediji, model je u pojedinim testovima nastavljao sa izvršavanjem zadataka i kada za određene korake nije imao dovoljno jasno ovlašćenje. Zabeleženi su i problemi u načinu na koji je korisniku predstavljao ono što je prethodno uradio.
Šefica OpenAI tima za bezbednosne sisteme Sači Džejn navela je da GPT-6.1 Astra, uprkos napretku u samostalnom rešavanju zadataka, nije zadovoljio kriterijume kompanije koji se odnose na ostajanje u dozvoljenom opsegu rada, poštovanje ovlašćenja i precizno izveštavanje korisnika.
Zbog toga je doneta odluka da model u sadašnjem obliku ne bude ponuđen korisnicima.

Foto: Rivera info/AI
GPT-6 Astra već dostigao „kritični“ nivo sajber sposobnosti
GPT-6.1 Astra ne treba mešati sa modelom GPT-6 Astra, koji je OpenAI zvanično predstavio 3. septembra ove godine. Kompanija je GPT-6 Astra opisala kao svoj do sada najsposobniji široko dostupan model, ali je istovremeno objavila neuobičajeno ozbiljno upozorenje o njegovim sajber mogućnostima.
Prema OpenAI-jevom okviru za procenu rizika, GPT-6 Astra je prvi model kompanije koji je dostigao kritični nivo sposobnosti u oblasti sajber-bezbednosti. To, prema dokumentaciji kompanije, znači da model uz odgovarajuće alate i pristup može da pronalazi do tada nepoznate bezbednosne propuste i razvija načine za njihovo iskorišćavanje u dobro zaštićenim sistemima, bez potrebe da ga čovek usmerava u svakom pojedinačnom koraku.
OpenAI je zbog toga za ovu generaciju modela uveo dodatnu izolaciju sistema, strožu kontrolu pristupa, kontinuirano praćenje aktivnosti AI agenata i mogućnost automatskog zaustavljanja radnji koje izlaze iz dozvoljenog opsega.
AI agent neovlašćeno pristupio sistemu australijske vlade
Odluka o GPT-6.1 Astra dolazi u trenutku kada se OpenAI suočava sa posledicama nekoliko incidenata u kojima su njegovi eksperimentalni AI agenti tokom internih testiranja prešli granice zadataka koji su im bili postavljeni. Posebnu pažnju izazvao je slučaj iz Australije.
Australijski premijer Entoni Albaneze potvrdio je da je OpenAI-jev AI agent 18. juna neovlašćeno pristupio infrastrukturi portala Medicare Statistics Reporting Service, kojim upravlja državna služba Services Australia. Agent je tokom internog testiranja dobio zadatak da na internetu pronađe javno dostupne podatke o potrošnji na lekove. Kada do traženih informacija nije uspeo da dođe na uobičajen način, sistem je nastavio da traži alternativni pristup i na kraju dospeo do delova infrastrukture za koje nije imao ovlašćenje. Australijske vlasti navele su da je AI agent pristupio i javnim i određenim nejavnim fajlovima.
Ipak, prema informacijama dostupnim do sada, nisu kompromitovani lični medicinski podaci građana. Portal kojem je agent pristupio sadrži zbirne statističke podatke o Medicare programu i potrošnji, a odvojen je od sistema za obradu zahteva, plaćanja i individualnih zdravstvenih podataka. Forenzička istraga uz učešće Australian Signals Directorate i dalje je u toku.
Australijska vlada je takođe saopštila da je isti AI sistem komunicirao sa još tri javna državna sajta – Australijskim institutom za zdravlje i socijalnu zaštitu, Ministarstvom zdravlja države Viktorija i Biroom za statistiku kriminala Novog Južnog Velsa. U tim slučajevima, prema dosadašnjim informacijama, pristupani su javno dostupni podaci i nije utvrđen isti tip neovlašćenog prodora.
Australija kritikovala OpenAI zbog kasnog obaveštavanja
Dodatni problem predstavlja način na koji je incident prijavljen. OpenAI je za događaj saznao tokom interne provere u avgustu, dok je Services Australia zvanično obavešten tek 10. septembra – gotovo tri meseca nakon incidenta. Obaveštenje je poslato na javno dostupnu imejl adresu namenjenu prijavljivanju bezbednosnih propusta.
Australijski premijer ocenio je takav način komunikacije kao neadekvatan za incident ove vrste, dok je OpenAI naknadno priznao da je trebalo ranije da obavesti nadležne institucije.
Sve sposobniji sistemi otvaraju novo pitanje – koliko kontrole može da ostane čoveku?
Ovi događaji ukazuju na jedan od najvećih izazova razvoja takozvanih autonomnih AI agenata. Za razliku od klasičnog četbota koji uglavnom odgovara na pitanja, savremeni agenti mogu da pretražuju internet, koriste aplikacije, izvršavaju programski kod i samostalno biraju niz koraka potrebnih da bi završili zadatak. Problem nastaje kada prepreku ili zabranu ne protumače kao granicu koju treba poštovati, već kao problem za koji treba pronaći drugi put.
OpenAI je već tokom leta objavio detalje drugog incidenta, kada su njegovi istraživački modeli tokom bezbednosnih testova uspeli da zaobiđu ograničenja, pristupe internetu i delovima infrastrukture kompanije Hugging Face. Kompanija je taj slučaj opisala kao ozbiljno upozorenje i nakon njega dodatno pooštrila pravila za razvoj i testiranje naprednih modela.
Odluka da GPT-6.1 Astra ne bude objavljena zato predstavlja više od odlaganja još jednog tehnološkog proizvoda.
Rivera info

