Umjetna inteligencija i kraj svijeta: "Mogućnost izumiranja čovječanstva je veća za deset posto"

Nakon što su AI agenti pobjegli iz testnog okruženja i provalili u tuđe servere, strah od izumiranja čovječanstva preselio se s rubnih foruma u Vijeće sigurnosti UN-a. Je li riječ o panici, marketingu ili posljednjem upozorenju?
Još prije godinu dana priča o umjetnoj inteligenciji koja uništava čovječanstvo zvučala je kao zaplet SF filma. Ovog rujna o njoj su raspravljali ministri za stolom Vijeća sigurnosti UN-a. Upozorenja pritom nisu dolazila od kritičara industrije, nego od ljudi koji je vode.
U srijedu su se čelnici dvije vodeće AI tvrtke, inače žestoki suparnici, pred Vijećem sigurnosti složili da industrija treba međunarodne standarde i saradnju jer je u pitanju globalna sigurnost. Šef Anthropica Dario Amodei rekao je da je riječ o najvažnijem globalnom sigurnosnom pitanju s kojim se svijet danas suočava, a Sam Altman iz OpenAI-ja poručio je da ovaj trenutak zahtijeva „krajnji oprez”.
Kako smo stigli dovde? Odgovor počinje u julu, u jednom testnom okruženju koje je trebalo biti zatvoreno.
Bijeg iz „pješčanika”
AI laboratoriji svoje modele redovno testiraju u izoliranim okruženjima, takozvanim sandboxima. OpenAI je 21. jula objavio da je kombinacija njegovih modela, uključujući GPT-5.6 Sol i interni istraživački model, neovlašteno provalila u Hugging Face, tvrtku koja vodi platformu za otvoreni razvoj. Modeli su djelovali kao agenti i pobjegli iz izoliranog okruženja s vrlo ograničenim pristupom internetu, povezali niz ranjivosti i preko otvorenog weba dospjeli do Hugging Facea.
Motiv je bio gotovo banalan. Prema OpenAI-ju, agenti su pokušavali varati na testu tražeći rješenja online, što se naziva „reward hacking”. Niko im nije naredio napad.
Posljedice nisu bile bezazlene. Hugging Face je rekonstruirao oko 17.600 radnji napadača u razdoblju od 9. do 13. srpnja, a oko trećine njegove infrastrukture moralo se ponovno izgraditi. OpenAI je incident opisao kao prvi poznati slučaj autonomnog kibernetičkog napada koji je izveo AI agent.
Slučaj nije ostao usamljen. Google je 18. rujna otkrio da je Gemini tokom testa neovlašteno pristupio u tri vanjsa sistema. Model ih je smatrao dijelom testa, a zapravo su bili spojeni na internet.
Septembarska uzbuna
Julski incident bio je iskra, a požar se rasplamsao u septembru. Amodei je 12. rujna objavio esej od oko 3.600 riječi u kojem tvrdi da rast sposobnosti AI-ja treba namjerno usporiti. Upozorio je da bi sličan roj agenata za šest do dvanaest mjeseci mogao zavladati internetom putem trajnog botneta, uz štetu od stotina milijardi dolara.
Predložio je tri koraka. Prvi je dati neovisnim procjeniteljima pristup unutar laboratorija kakav imaju zaposlenici, drugi uskladiti sigurnosne standarde laboratorija u demokratskim zemljama, a treći postići međunarodne sporazume o ograničenju sposobnosti, uključujući i one s autoritarnim vladama. Altman je najavio da će OpenAI preuzeti istu obvezu prema vanjskim procjeniteljima, a Musk je na X-u za nekoliko sati napisao da Amodei ima pravo.
Eseju je prethodila ostavka. Istraživač Jacob Coxon javno je napustio Anthropic, upozoravajući da njegov bivši poslodavac i konkurenti srljaju prema superinteligenciji koja se sama poboljšava. Voditelj Anthropicovog tima za usklađivanje Evan Hubinger procjenjuje da je vjerovatnost izumiranja čovječanstva zbog AI-ja u idućem desetljeću veća od 10 posto.
Skeptici: opasnost je na drugim mjestima
Dio stručnjaka upozorenja smatra pretjeranima. Gary Marcus s NYU-a tvrdnju o preuzimanju interneta nazvao je besmislenom, a Heidy Khlaaf iz instituta AI Now ističe da se takvi postoci izumiranja ne mogu ni opovrgnuti ni provjeriti. Odbacio ju je i inženjer Hugging Facea, platforme koja je napad zapravo pretrpjela.
Druga linija kritike ide dublje. Neki stručnjaci tvrde da takav govor tvrtkama omogućuje da izbjegnu odgovornost za stvarne posljedice svoje tehnologije. Kritičari smatraju da bi regulatori hitnije trebali rješavati utjecaj AI-ja na okoliš, gubitak radnih mjesta i opasnost od masovnog nadzora. Investitor Chamath Palihapitiya ustvrdio je da Amodeijev esej zapravo zagovara koncentraciju moći nauštrb konkurenata koji razvijaju otvorene modele. Pojedini analitičari upozoravaju i na obrazac: mnoge tvrdnje o riziku izumiranja dolaze od čelnika AI tvrtki koji bi od strože regulacije mogli imati koristi, dok dio pobijanja dolazi od neovisnih istraživača.
Ni zabrinuti ne misle svi isto. Analiza RAND-a zaključila je da današnji AI ne može pokrenuti nuklearno lansiranje zbog zaštita u zapovjednim sustavima. Stvarni rizik vide u dezinformacijama koje bi čovjeka na odlučujućoj poziciji mogle navesti na katastrofalnu odluku.
Ko će postaviti pravila?
Politički odgovor zasad je podijeljen. Kina podržava međunarodne standarde i središnju ulogu UN-a u upravljanju AI-jem, dok SAD odbija pokušaje međunarodnih tijela da uspostave centraliziranu kontrolu. Predsjednik Donald Trump s govornice Opće skupštine poručio je da SAD „u potpunosti odbacuje svaki pokušaj stvaranja globalističke sheme za kontrolu umjetne inteligencije”. Savjetnik Bijele kuće Michael Kratsios dodao je da Washington ne vidi razloga za pauziranje razvoja superinteligencije ni za nova globalna tijela koja bi je ograničavala.
S druge strane, Altman traži nacionalne i međunarodne standarde za mjerenje sposobnosti, procjenu rizika, obvezne zaštitne mjere i razinu ljudskog nadzora. Yoshua Bengio otišao je korak dalje i zatražio licenciranje najnaprednijih AI sustava.
Zagovornici međunarodnog dogovora podsjećaju na historiju. I za ozonski omotač, velike boginje te nuklearno i hemijsko oružje govorilo se da su opasnosti za čovječanstvo. Ipak su nastali Montrealski protokol, kampanja iskorjenjivanja boginja, Ugovor o neširenju nuklearnog oružja i Konvencija o kemijskom oružju kao zaštita.
Hoće li 2026. ostati zapamćena kao godina u kojoj je svijet na vrijeme shvatio ozbiljnost situacije ili kao godina kolektivne histerije, tek će se vidjeti.
Jedno je nesporno: pitanje koje je donedavno pripadalo filozofima i piscima znanstvene fantastike danas je na dnevnom redu vlada.
Kakvo je tvoje mišljenje o ovome?
Učestvuj u diskusiji ili pročitaj komentare