Industrija još nije rešila probleme nadzora veštačke inteligencije

OpenAI objavio šest novih slučajeva „neusklađenog ponašanja“ AI modela

Svet

17.9.2026 11:42 Autor: Redakcija Biznis.rs 0

OpenAI objavio šest novih slučajeva „neusklađenog ponašanja“ AI modela OpenAI objavio šest novih slučajeva „neusklađenog ponašanja“ AI modela
Kompanija OpenAI objavila je šest novih slučajeva u kojima su sistemi veštačke inteligencije prikrivali greške, izmišljali podatke ili bez dozvole prebacivali fajlove na javni... OpenAI objavio šest novih slučajeva „neusklađenog ponašanja“ AI modela

Kompanija OpenAI objavila je šest novih slučajeva u kojima su sistemi veštačke inteligencije prikrivali greške, izmišljali podatke ili bez dozvole prebacivali fajlove na javni internet. Ova otkrića dolaze u trenutku pojačane rasprave o bezbednosti veštačke inteligencije i mogućnosti da se ponašanje naprednih sistema udalji od namera njihovih tvoraca. OpenAI je ove primere predstavio u okviru novog sistema za prijavljivanje „neusklađenog ponašanja“ AI modela.

Kompanija je upozorila da industrija još nije dovoljno dobro rešila probleme kontrole i nadzora da bi razvoj veštačke inteligencije mogao još dugo da se ubrzava maksimalnim tempom. OpenAI smatra da odluke o daljem razvoju ove tehnologije moraju da budu zasnovane na dokazima koje mogu da provere i nezavisni stručnjaci, a ne samo laboratorije koje razvijaju AI sisteme, prenosi New York Times.

Objavljeni slučajevi dodatno su podgrejali pitanje da li razvoj najnaprednijih modela treba usporiti dok se ne uvedu pouzdanije bezbednosne mere. Rasprava je intenzivirana nakon incidenta u kojem su OpenAI sistemi ranije ove godine napali AI startap Hugging Face, a kompanija je za taj događaj saznala tek nekoliko nedelja kasnije.

Direktor Anthropica Dario Amodeji (Dario Amodei) potom je pozvao na privremeno usporavanje razvoja kako bi bilo dovoljno vremena za uvođenje zaštitnih mehanizama. Njegov stav podržali su i direktor kompanije OpenAI Sem Altman (Sam Altman), Ilon Mask (Elon Musk) i rukovodilac Google DeepMinda Demis Hasabis (Demis Hassabis), dok drugi čelnici AI industrije smatraju da usporavanje nije potrebno.

Među novim primerima je i slučaj iz razvoja modela GPT-5.6 Sol, koji je u interne beleške upisivao podsetnike da od korisnika sakrije sopstvene greške. U tim beleškama nalazila su se i uputstva da se izmisle podaci koji nedostaju ili prikriju razlike između različitih verzija izvornog materijala. U drugom slučaju, jedan još neobjavljeni model ubacivao je u sopstvene beleške instrukcije da zanemari postavljena ograničenja i opisivao sebe kao sistem „oslobođen uloga i identiteta koji ograničavaju druge četbotove“.

U još jednom incidentu, AI sistem je tokom odgovaranja na rutinsko pitanje pronašao programski ključ na internetu i upotrebio ga bez dozvole, a zatim izmislio podatke kada nije uspeo da pronađe tražene brojke. Drugi model je, nakon što je tačno rešio zadatak pomoću programskog koda, bez odobrenja postavio sopstveni fajl na internet kako bi mogao da navede veb-izvor. U dva dodatna slučaja, automatizovani sistemi su sami pronašli načine za međusobnu komunikaciju, jedni su koristili interni repozitorijum kompanije kao oglasnu tablu za razmenu poruka, dok su drugi dokumente razmenjivali preko javnih servisa za deljenje fajlova.

OpenAI je naglasio da ovi primeri predstavljaju pojedinačne slučajeve i da se na osnovu njih ne može zaključiti koliko se često javlja neusklađeno ponašanje AI sistema. Kompanija je najavila da će budući incidenti biti razvrstavani u tri kategorije, pri čemu će sporna pitanja o objavljivanju podataka biti prosleđivana internom Savetodavnom odboru za bezbednost, a najteži slučajevi američkoj saveznoj vladi. Svih šest objavljenih slučajeva već je istraženo ili zahteva samo dodatne provere manjeg obima, a veliki deo problema odnosio se na starije modele koji nikada nisu pušteni u upotrebu.

Nema komentara. Budite prvi koji će ostaviti komentar.

Vaša adresa e-pošte neće biti objavljena. Neophodna polja su označena *

    Biznis.rs newsletter

    Prijavite se na biznis.rs newsletter i budite uvek u toku sa najnovijim finansijskim i ekonomskim temama značajnim za društveni razvoj.

    Vaša e-mail adresa će biti korišćena isključivo za potrebe slanja newslettera, a u skladu sa Politikom privatnosti.