Oglas

Metin model najgori

Studija: Tri od pet AI modela nisu prošla sigurnosne testove vezane za terorizam

author
Anadolija
10. okt. 2026. 14:06
FILE PHOTO: A message reading "AI artificial intelligence", a keyboard, and robot hands are seen in this illustration taken January 27, 2025. REUTERS/Dado Ruvic/Illustration/File Photo
REUTERS / Dado Ruvic

Tri od pet modela vještačke inteligencije (AI) nisu prošla sigurnosne testove vezane za terorizam, pri čemu su modeli lišeni sigurnosnih zaštita dosljedno pružali potencijalno opasne informacije, navodi se u istraživanju o kojem je u petak objavio CBC News.

Oglas

Studija, koju je provela neprofitna organizacija "Tech Against Terrorism" sa sjedištem u Velikoj Britaniji, procijenila je više od 130 AI modela koristeći stotine upita sličnih onima koje bi mogao postaviti terorist koji planira napad.

Istraživači su otkrili da su modeli modificirani procesom poznatim kao "abliteracija" (uklanjanje sigurnosnih zaštita) pali na svakom testu.

Metin model Llama 3.1 8B postigao je 97 od 100 bodova na sigurnosnom mjerilu organizacije prije modifikacije, u poređenju sa otprilike tri boda nakon nje.

Istraživači su naveli da je modificirani model pružao detaljne odgovore na upite koji se tiču ​​napada, finansiranja terorizma i radikalizacije, dok je njegova originalna verzija odbijala takve upite.

"Razumljivo je da postoji zabrinutost zbog gubitka kontrole i egzistencijalnog rizika koji nosi AI", rekao je Adam Hadley, osnivač i izvršni direktor organizacije "Tech Against Terrorism".

"Stvar je zapravo u tome da se to već dogodilo jer su mnogi od ovih otvorenih modela već 'provaljeni' – samo to još niko nije primijetio".

Organizacija je krajem prošlog mjeseca pronašla više od 29.000 repozitorija na platformi Hugging Face koji nude necenzurisane ili nezaštićene AI modele.

Iz Hugging Facea su naveli da redovno moderiraju sadržaj koji krši njihova pravila, ali su upozorili da bi neke preporuke iz izvještaja mogle ugroziti otvorena istraživanja.

Iz Mete su poručili da njihovi modeli prolaze kroz sigurnosne procjene te da njihova pravila zabranjuju štetnu ili nezakonitu upotrebu.

Izvještaj nije pronašao dokaze da terorističke ili ekstremističke grupe koriste testirane modele, osim jednog ekstremističkog chatbota kojeg su identificirali istraživači.

"Tech Against Terrorism" je preporučio uvođenje nezavisnih sigurnosnih mjerila, jačanje zaštite protiv uklanjanja sigurnosnih mehanizama i ograničenja na distribuciju modificiranih modela.

"Mislim da je pogrešna ideja da ne možemo imati istovremeno i sigurnost i napredak", rekao je Hadley.

╰┈➤ Program N1 televizije možete pratiti UŽIVO na ovom linku kao i putem aplikacija za Android /iPhone/iPad

Više tema kao što je ova?

Kakvo je tvoje mišljenje o ovome?

Učestvuj u diskusiji ili pročitaj komentare

Pratite nas na društvenim mrežama