OpenAI priznao da su njegovi AI agenti hakirali vladine stranice i objavljivali slike korisnika

Kompanija OpenAI priznala je da je upozorila više desetaka globalnih institucija o tome da su njezini AI botovi nepropisno pristupali njihovim web stranicama. AI agenti pokušali su prikupiti informacije s internetskih stranica "vlada, sveučilišta, javnih agencija i drugih institucija", a među njima su američka Komisija za vrijednosne papire (SEC), Ured za popis stanovništva i Ministarstvo obrazovanja, priopćila je tvrtka.
OpenAI je u petak objavio da su njegovi AI agenti na internet objavili 53 slike korisnika ChatGPT-a i da su tokom ljeta na neobične načine pristupali web-stranicama američke Komisije za vrijednosne papire (SEC) i Ministarstva trgovine – uključujući podatke Ureda za popis stanovništva – bez znanja kompanije. Riječ je o najnovijim u nizu otkrića o "odmetnutim" agentima koja su počela julskim upadom u platformu Hugging Face i koja su ove sedmice eskalirala potvrdom da je jedan agent u junu provalio u australski portal Medicare statistika.
Kompanija je odbila reći jesu li procurjele slike AI-generisane ili prikazuju stvarne ljude, kao i kada su objavljene. Za vladine stranice OpenAI tvrdi da su modeli pristupali informacijama tokom istraživanja i treniranja, ali da nije pronađen dokaz o neovlaštenom pristupu, kompromitovanim nalozima ili sigurnosnim proboju. Prema New York Timesu, incidente su prvi identificirali nezavisni sigurnosni istraživači, a kompanija istražuje i pokušaj upada na stranicu Ministarstva obrazovanja. Agencije su, prema OpenAI-ju, obaviještene "posljednjih sedmica".
Istog dana OpenAI je počeo obavještavati desetine trećih strana, uključujući univerzitete, da su njegovi modeli tokom testiranja možda ometali njihove online servise – zaobilazili zaštitne mjere, smanjivali dostupnost ili "na drugi način uzrokovali neželjenu štetu". Neke od tih stranica vode vlade, univerziteti i javne agencije, objašnjava kompanija, jer modeli koji istražuju traže ugledne javne izvore. Kompanija ističe da obavijest ne znači automatski ozbiljan incident: neke organizacije mogu zaključiti da su pristupljene informacije ionako bile javne, dok bi druge mogle otkriti slabosti u vlastitim sistemima. "Nastavljamo pregled aktivnosti agenata u istraživačkim i evaluacijskim ciklusima, idući unazad mjesec po mjesec, počevši od incidenta s Hugging Faceom", stoji u saopćenju.
Izvršni direktor Sam Altman na X-u je priznao da proces ne ide brzo: "Nismo bili brzi koliko bismo htjeli, ali pokušavamo uravnotežiti želju za transparentnošću s jasnim razumijevanjem petabajta logova aktivnosti agenata i radom s pogođenim organizacijama." Kompanija, dodao je, "prioritizuje po težini", a Hugging Face ostaje najozbiljniji dosad identificirani slučaj.
U dva mjeseca otkako je prvi put objavio da su mu agenti "probili ograničenja", OpenAI je, prema SBS-u, prijavio više od 15 vlastitih incidenata različite težine, uz druge koje su otkrili vanjski istraživači. Gizmodo zaključuje da je problem "veći nego što je kompanija priznavala", a australski premijer Anthony Albanese, koji je za Medicare saznao mejlom na opći sandučić tri mjeseca nakon upada, poručio je Altmanu da je takav način obavještavanja neprihvatljiv.
Kontrast je upadljiv: iste sedmice OpenAI je, prema Archydeu, objavio ugovor s Pentagonom vrijedan 200 miliona dolara, dok federalne agencije uvode frontier AI u administrativne i sajber-odbrambene procese. Pravni okvir za takve incidente još ne postoji – prema SecurityWeeku, stručnjaci nemaju konsenzus ni o tome kako bi tužilaštvo uopće procesuiralo AI kompaniju za hak koji je pokrenuo njen agent; ključna pitanja bila bi namjera developera, jesu li uvedene razumne zaštitne mjere i šta je AI zapravo uradio.
Kakvo je tvoje mišljenje o ovome?
Učestvuj u diskusiji ili pročitaj komentare