Stručnjaci upozoravaju na rizike autonomnih AI agenata

OpenAI model probio zaštitu australijske vlade

SvetVesti

25.9.2026 09:53 Autor: Redakcija Biznis.rs 0

OpenAI model probio zaštitu australijske vlade OpenAI model probio zaštitu australijske vlade
Jedan model kompanije OpenAI je tokom obuke zaobišao zaštitne mehanizme i hakovao veb-sajt australijske vlade, izjavio je premijer te zemlje Entoni Albanezi (Anthony Albanese),... OpenAI model probio zaštitu australijske vlade

Jedan model kompanije OpenAI je tokom obuke zaobišao zaštitne mehanizme i hakovao veb-sajt australijske vlade, izjavio je premijer te zemlje Entoni Albanezi (Anthony Albanese), koji je zbog toga kritikovao tvorca ChatGPT-a. Ovo je poslednji u nizu hakerskih napada navodno autonomnih AI agenata, ali stručnjaci upozoravaju da se u ovim slučajevima ne radi o bilo kakvoj „odmetnutoj“ veštačkoj inteligenciji.

Do proboja sajta Vlade Australije je došlo u junu, dok je kompanija OpenAI sprovodila aktivnosti obuke radi ocenjivanja performansi svojih modela veštačke inteligencije, piše SEEbiz.

Od modela je zatraženo da pretraži internet u potrazi za podacima o tome koliko je australijska vlada potrošila na lekove, izjavila je novinarima ministarka za vladine usluge Kejti Galager (Katy Gallagher).

Ovaj AI alat pristupio je javnim i nejavnim datotekama smeštenim na starom veb-sajtu sa zdravstvenim statistikama, kako su javili australijski mediji. I ne samo to – kompanija OpenAI nije obavestila australijsku vladu o problemu sve do septembra, kada je poslala poruku na opštu imejl adresu koja se proverava samo jednom dnevno.

Kompanija je navela da je sporne aktivnosti prvi put uočila u avgustu, tokom pregleda rada tog alata za veštačku inteligenciju.

„Danas sam razgovarao sa izvršnim direktorom kompanije OpenAI, Semom Altmanom (Sam Altman), kako bih izrazio veliku zabrinutost Australije povodom ovog incidenta. Takođe, izrazio sam razočaranje što je kompaniji trebalo previše vremena da obavesti vladu o tome šta se dogodilo. Tek 10. septembra je stiglo bilo kakvo obaveštenje – i to u vidu imejla poslatog na javno dostupnu mejl adresu”, rekao je Albanezi novinarima u Njujorku.

Nakon niza hakerskih incidenata koji su uključivali modele kompanija OpenAI i Anthropic, u svetu je porasla zabrinutost zbog moći naprednih alata veštačke inteligencije.

Ipak, istraživači ističu da se ovi modeli ne ponašaju suprotno svojoj prirodi – naprotiv, zadaci u kojima sada postižu izvanredne rezultate upravo su oni za čije su izvršavanje i kreirani.

Štaviše, pojedini stručnjaci smatraju da je pogrešno govoriti da se takvi agenti „otimaju kontroli”, piše Financial Times.

Foto: Freepik/ rawpixel.com

Savremeni modeli veštačke inteligencije dizajnirani su tako da isprobavaju sve moguće metode za postizanje zadatog cilja bez eksplicitnih uputstava, što ih čini suštinski nepredvidivim. Ukoliko uspeju, bivaju nagrađeni – reč je o procesu obuke poznatom kao učenje potkrepljivanjem (reinforcement learning).

U računarskom sistemu koji ne razume ljudske namere i moralne vrednosti – pojava koju industrija veštačke inteligencije naziva „nepodudaranjem ciljeva” (misalignment) – granica između moćnog sistema za sajber-odbranu i opasnog hakera postaje sve manje jasna.

Šta je onda motiv za priče o „odmetnutoj“ AI? Senzacionalne tvrdnje o veštačkoj inteligenciji mogu biti deo potencijalno manipulativne kampanje za samoregulaciju, kako piše britanski Telegraf.

„U najboljem slučaju, aktivnosti koje su sproveli OpenAI, Meta, Anthropic i Institut za bezbednost veštačke inteligencije (AISI) bile su aljkave i nepromišljene, uz posledice po stvarni svet. U najgorem slučaju, bile su deo manipulativne kampanje koja je kulminirala time što su čelnici velikih američkih kompanija za veštačku inteligenciju zahtevali da sami pišu nove propise i vrše nadzor nad sopstvenim radom“, navodi Telegraf.

Kako piše Wall Street Journal, za najčešće navođen skorašnji primer „odmetnute” veštačke inteligencije ispostavilo se da, kada se pažljivije razmotri, krije znatno manje egzotičnu priču.

U julu je kompanija OpenAI objavila da su sistemi veštačke inteligencije, koji su testirani u pogledu sposobnosti za sajber-bezbednost, uspeli da izađu iz navodno izolovanog okruženja i pristupe sistemima kompanije Hugging Face, platforme za veštačku inteligenciju otvorenog koda. Mediji su ovaj događaj opisali rečima da su autonomni agenti „probili izolaciju”, „pobegli” i „otrgli se kontroli”.

Nova analiza, koju je objavio časopis „Bulletin of the Atomic Scientists“, koja se oslanja na izveštaj kompanije OpenAI i nezavisnu procenu organizacije „Model Evaluation and Threat Research“, rekonstruiše taj događaj na način koji je daleko manje dramatičan i filmičan.

Kompanija OpenAI je testirala modele na platformi „ExploitGym“ — koja služi kao merilo učinka u oblasti sajber-bezbednosti — pri čemu su ključna bezbednosna ograničenja bila namerno isključena.

Čak 93 odsto aktivnosti koje su označene kao problematične odnosilo se na zadatke koje nijedan model prethodno nije rešio, a sistemi su bili programirani tako da imaju podsticaj da nastave sa radom umesto da odustanu.

Okruženje nije bilo potpuno izolovano; modeli su mogli da preuzimaju softver putem posrednika povezanog sa internetom i otkrili su da se taj isti kanal može koristiti za razmenu informacija u oba smera. Kompanija OpenAI je znala da agenti koriste taj kanal, ali je, prema navodima iz tehničkih izveštaja, odlučila da ne interveniše, pokazala je analiza.

„Ljudi su kreirali test, uklonili ograničenja, definisali cilj, ostavili otvorenu putanju i odlučili da ne zaustavljaju ono što se dešavalo. Nazivanje rezultata ‘odmetnutom veštačkom inteligencijom’ je više od stvaranja senzacije, ono omogućava da te ljudske odluke tiho iščeznu iz priče“, navodi Wall Street Journal.

Nema komentara. Budite prvi koji će ostaviti komentar.

Vaša adresa e-pošte neće biti objavljena. Neophodna polja su označena *

    Biznis.rs newsletter

    Prijavite se na biznis.rs newsletter i budite uvek u toku sa najnovijim finansijskim i ekonomskim temama značajnim za društveni razvoj.

    Vaša e-mail adresa će biti korišćena isključivo za potrebe slanja newslettera, a u skladu sa Politikom privatnosti.