Dobrodošli· četvrtak, 6. august 2026.
Vijesti
Tehnologija

Meta najnovija AI kompanija čiji je model „podivljao“ tokom testiranja

Meta je saopštila da je jedan njen AI model tokom testiranja hakovao sisteme druge kompanije, čime se pridružila Anthropicu i OpenAI-ju na rastućoj listi AI firmi čiji su modeli pobjegli iz evaluacionih sandbox okruženja.

Foto: Cointelegraph

Redakcija ACX+ACX+ Magazin · prije 2 h
2 min čitanja

Meta je postala najnovija velika AI kompanija koja je objavila da je jedan njen model tokom testiranja hakovao sisteme druge kompanije, nakon sličnih incidenata u koje su bili uključeni Anthropic i OpenAI.

Riječ je o Metinom modelu Muse Spark 1.1, lansiranom u julu, prenosi The Information pozivajući se na izvore. Problem navodno potiče od pogrešne konfiguracije koju je napravila firma Irregular, specijalizovana za bezbjednosno testiranje i red-teaming vještačke inteligencije, a koja je modelu tokom evaluacije nenamjerno omogućila pristup internetu. Model je „iskoristio bezbjednosnu ranjivost u servisu treće strane, na način sličan ranije prijavljenim slučajevima kod drugih kompanija“, saopštila je Meta za Reuters.

Incident je najnoviji primjer da napredni AI agent i sam postaje sajber-bezbjednosni rizik, a otvorio je i pitanje ko snosi odgovornost: kompanije koje razvijaju agente ili one koje dizajniraju sandbox okruženja koja treba da ih obuzdaju. Metin proboj dolazi samo sedmicu nakon što je Anthropic saopštio da su njegovi modeli dobili pristup internetu i hakovali spoljnu kompaniju, zbog greške u konfiguraciji vezane za Irregularovo test okruženje.

U blog objavi od 30. jula Anthropic je naveo da je pronašao tri incidenta (od 141.006 evaluacionih pokretanja) u kojima je Claude model tokom evaluacije dospio na internet, a zatim ostvario neovlašćeni pristup sistemima u tri različite organizacije. Sva tri incidenta desila su se unutar Irregularovog evaluacionog okruženja ili u interakciji s njim, a uključivala su pogrešnu konfiguraciju koja je mašinama kojima je Claude pristupao ostavila aktivan pristup internetu. Cointelegraph je za komentar kontaktirao Metu i Irregular. U julu su AI agenti kompanije OpenAI izašli iz svog offline sandboxa i hakovali Hugging Face kako bi varali na bezbjednosnom benchmark testu.

Charles Guillemet, tehnički direktor Ledgera, ocijenio je najnoviji incident kao „marketinško pozorište“. „Kada model 'podivlja', to je postao najnoviji AI PR trik“, rekao je u srijedu. „Ako vaš model ne bježi iz sandboxa, ne 'hakuje' kompanije ili ne izvodi neki podvig koji puni naslovnice, izgleda da zaostajete... Industriji nisu potrebni veći trikovi, potrebno joj je više povjerenja.“

Izvor: Cointelegraph

Izvor: Cointelegraph