18.9.2026.

OpenAI otkriva još šest sigurnosnih problema i predstavlja plan za objavljivanje informacija o incidentima

OpenAI je otkrio još šest incidenata neočekivanog ili zabrinjavajućeg ponašanja svojih modela umjetne inteligencije (AI) te najavio plan za praćenje i objavljivanje informacija o takvim incidentima u budućnosti, izvještava BBC.

Neki od prethodno neprijavljenih incidenata uključivali su slučajeve u kojima su modeli prikrivali ili izmišljali informacije, navela je tvrtka koja stoji iza ChatGPT-a u objavi na blogu u srijedu.

Čelnik OpenAI-a Sam Altman ranije ovog tjedna izjavio je: "Svijet bi trebao vjerovati da ćemo učiniti pravu stvar jer je to ispravno i jer smo svjesni ozbiljnosti situacije."

OpenAI, Inc. američka je istraživačka organizacija za umjetnu inteligenciju osnovana u prosincu 2015. sa sjedištem u San Franciscu u Kaliforniji. Cilj mu je razviti „sigurnu i korisnu” umjetnu opću inteligenciju, koju definira kao „visoko autonomne sustave koji nadmašuju ljude u većini ekonomski vrijednih poslova

Umjetna inteligencija posljednjih je dana pod povećalom javnosti nakon upozorenja o ozbiljnim potencijalnim rizicima koje predstavlja za ljude.

U objavi na blogu OpenAI je detaljno opisao primjere nepredviđenog ponašanja svojih AI modela tijekom pokušaja izvršavanja zadataka ili rješavanja testova. Incidenti su uključivali generiranje uputa za zaobilaženje nametnutih ograničenja, skrivanje pogrešaka i izmišljanje informacija.

Tvrtka je također najavila novi sustav za praćenje, istraživanje i objavljivanje slučajeva nepredviđenog ponašanja modela, odnosno slučajeva "nedostatka usklađenosti" (eng. *misalignment*).

Prema tom okviru, razvojni programeri moći će označiti incidente radi provjere, a novi skup pravila određivat će hoće li problem biti javno objavljen.

"Budući da vjerujemo u važnost transparentnosti po pitanju nedostatka usklađenosti, naš novi okvir daje prednost javnom objavljivanju čak i kada je ozbiljnost problema neizvjesna", poručili su iz OpenAI-a.

OpenAI je dospio na naslovnice u srpnju kada je otkriveno da su se neki od njihovih najnaprednijih AI modela oteli kontroli i hakirali Hugging Face – jedno od najvećih svjetskih središta za dijeljenje AI modela – nakon što je tvrtka tijekom sigurnosnog testiranja izgubila nadzor nad njima.

Suosnivač Hugging Facea, Thomas Wolf, tada je izjavio da je taj incident bio "poziv na uzbunu" za cijelu industriju. Od tada se rasprava o sigurnosnim rizicima umjetne inteligencije (UI) zaoštrila, a u nju su se uključili istraživači UI-ja, čelnici tehnoloških tvrtki i političari.

Prošlog je tjedna Jacob Coxon, istraživač koji je napustio tvrtku Anthropic (konkurenta OpenAI-ja) zbog straha da bi ta tehnologija mogla uništiti čovječanstvo, objavio tekst o svojoj ostavci u kojem je upozorio na opasnosti UI-ja; ta je objava ubrzo postala viralna usred rastuće zabrinutosti za sigurnost.

Kao odgovor na to, znanstvenik iz Anthropica Evan Hubinger izjavio je kako smatra da postoji više od 10 % vjerojatnosti da će UI uzrokovati izumiranje čovječanstva "unutar sljedećeg desetljeća".

Suosnivač Anthropica Jack Clark kasnije je za BBC izjavio da bi za cijelu industriju možda trebalo uvesti obvezni "prekidač za nužno gašenje" (tzv. *kill switch*) pod nadzorom treće strane.

U međuvremenu, izvršni direktor Anthropica Dario Amodei pozvao je na usporavanje tempa razvoja UI-ja i stroži nadzor – što je tvrtka činila i ranije – iako su neki doveli u pitanje motive koji stoje iza takvih izjava. Amodei je također naglasio da bi se svako ograničavanje UI-ja trebalo provesti "bez žrtvovanja komercijalne prednosti".

S druge strane, američki predsjednik Donald Trump izjavio je da su strahovi vezani uz sigurnost UI-ja "obmana" te je kritizirao pozive na uvođenje strožih zaštitnih mjera za tu tehnologiju koja se ubrzano razvija.

U nizu objava na društvenim mrežama američki je predsjednik usporedio upozorenja o UI-ju s "prijevarom o globalnom zatopljenju", za koju je ustvrdio da je provode "radikalno lijevi 'Dumokrati'" (igra riječi kojom demokrate naziva glupanima).

Trump je sebe nazvao i "razotkrivačem obmana", usporedivši zabrinutost za sigurnost te tehnologije s onim što je nazvao "obmanom o Rusiji, Rusiji, Rusiji".

Jedina "zaštitna mjera" potrebna za UI jest "snažan i pametan" predsjednik, ustvrdio je Trump.

Photo by Andrew Neel on Unsplash