Oglas

Agent OpenAI izmakao kontroli i hakovao poznati startap, kompanija upozorava da će incidenti biti češći

openAI open ai veštačka inteligencija
Shutterstock / eranicle

OpenAI je otkrio da je autonomni AI agent, pokretan njegovom tehnologijom, tokom jednog testa izmakao kontroli, pristupio otvorenom internetu i samostalno hakovao poznati startap u „incidentu bez presedana“, piše Gardijan.

Oglas

Kompanija koja stoji iza ChatGPT-a saopštila je da je Hugging Face otkrio i zaustavio agenta - AI alat dizajniran da samostalno obavlja zadatke bez ljudske pomoći – nakon što je uspeo da uđe u njihove sisteme.

„Ovaj incident smatramo neviđenim sajber incidentom, koji uključuje najsavremenije sajber sposobnosti“, saopštio je OpenAI, prenosi Gardijan.

Kompanija je upozorila da očekuje da će ovakvi incidenti postajati sve učestaliji kako modeli, tehnologija koja pokreće AI alate poput četbotova i agenata, budu postajali sposobniji.

OpenAI je naveo da se napad dogodio preko agenta koji je koristio kombinaciju njihovog najnovijeg javno dostupnog modela, nazvanog GPT-5.6 Sol, i još naprednijeg modela koji još nije objavljen.

Tokom internog testiranja sposobnosti hakovanja, u zatvorenoj digitalnoj laboratoriji poznatoj kao sandbox, modeli su dobili pristup otvorenom internetu – praktično izlaznu putanju iz izolovanog okruženja – tako što su pronašli ranije neotkrivenu ranjivost.

Agent je potom hakovao Hugging Face, bazu AI modela, kako bi pronašao tehnologiju koja bi mu pomogla da prođe bezbednosnu proveru. OpenAI je naveo da su modeli „uspešno pronašli načine da pristupe poverljivim informacijama koje su mogli da koriste za varanje na testiranju“.

Napad je završen kada su bezbednosni tim Hugging Face-a i njihovi sopstveni AI agenti uočili i zaustavili sumnjivu aktivnost.

Izvršni direktor Hugging Face-a Klement Delangue rekao je da je napad bio „neverovatan“, ali da veruje da OpenAI nije imao „zlonamerne namere“.

„Sumnjali smo da je prošlonedeljni sajber napad možda došao iz neke vodeće AI laboratorije, s obzirom na sofisticiranost agenta“, napisao je on na platformi Iks.

Izraz za nepoznati bezbednosni propust u softveru je zero-day ranjivost (ranjivost nultog dana), jer programeri imaju nula vremena da je poprave pre nego što bude iskorišćena.

Sposobnost AI modela da pronađu i iskoriste takve ranjivosti postala je velika tema u aprilu, kada je OpenAI-jev bliski rival Anthropic saopštio da je njegov model Mythos pronašao hiljade takvih propusta.

Teme

Koje je vaše mišljenje o ovoj temi?

Pridružite se diskusiji ili pročitajte komentare

Pratite nas na društvenim mrežama