Model je tijekom internog testa posegnuo za resursima platforme Hugging Face pa se vratio u izolaciju
Novi slučaj povezan s razvojem umjetne inteligencije ponovno je otvorio pitanje sigurnosti najnaprednijih AI sustava. Prema tvrdnjama iznesenima u Daily Mailu, OpenAI-jev eksperimentalni model GPT-5.6 Sol tijekom internog testiranja navodno je uspio izaći iz izoliranog digitalnog okruženja i pristupiti vanjskom sustavu.
Model je testiran u takozvanom „sandboxu”, izoliranom računalnom okruženju koje programerima omogućuje razvoj i provjeru novih tehnologija bez opasnosti da utječu na stvarni internet ili druge sustave.
Tijekom testa istraživači su modelu postavili zadatak povezan s njegovim sposobnostima u području hakiranja i kibernetičke sigurnosti. Prema navodima iz izvješća, AI je pokušao pristupiti sustavu platforme Hugging Face kako bi izvršio zadatak, a nakon toga se vratio u svoje testno okruženje i nastavio raditi kao da se ništa nije dogodilo.
Model nije djelovao zbog vlastite namjere ili „želje” za napadom, nego zato što je pokušavao što učinkovitije izvršiti zadani cilj. Prema OpenAI-ju, AI je zaključio da bi pristup podacima Hugging Facea mogao pomoći u rješavanju zadatka na kojem je bio testiran.
Stručnjaci upozoravaju na novi sigurnosni rizik
Profesor Alex Tabarrok sa Sveučilišta George Mason procijenio je da je model potencijalno mogao ostati u sustavima Hugging Facea čak tjedan dana prije nego što bi bio otkriven. Prema tim tvrdnjama, ni zaposlenici OpenAI-ja nisu odmah bili svjesni aktivnosti modela.
Iz OpenAI-ja su navodno priznali da bi ovakvi slučajevi u budućnosti mogli postati češći zbog razvoja sve sposobnijih AI modela koji mogu obavljati složenije zadatke u području kibernetičke sigurnosti.

Slučaj je ponovno otvorio pitanje koliko je moguće kontrolirati napredne modele umjetne inteligencije. Kritičari upozoravaju da AI ne razmišlja poput ljudi i nema vlastiti osjećaj za zakon ili moral, nego pokušava najučinkovitije ostvariti cilj koji mu je zadan. To, upozoravaju stručnjaci, može dovesti do nepredviđenih posljedica.
Tvrtka Anthropic je tijekom ranijih testiranja svojih modela pokazala da umjetna inteligencija u određenim situacijama može pribjeći manipulativnim metodama kako bi ostvarila zadani cilj. U nekim eksperimentima modeli su pokazivali ponašanja poput pokušaja ucjenjivanja ili otkrivanja osjetljivih informacija.
Strah od zloupotrebe umjetne inteligencije
Stručnjaci posebno upozoravaju na mogućnost da napredni AI modeli padnu u pogrešne ruke. Jednom kada su modeli javno dostupni, države ili kriminalne skupine mogu ih pokušati kopirati i prilagoditi za vlastite potrebe. Mete bi mogli biti veliki sustavi poput banaka, zdravstvenih ustanova ili državnih institucija, piše Daily Mail.
Direktor OpenAI-ja Sam Altman još je 2015. godine upozorio na moguće posljedice razvoja naprednih AI sustava.
„Mislim da će umjetna inteligencija vjerojatno dovesti do kraja svijeta. Ali, u međuvremenu će nastati sjajne kompanije”, rekao je tada Altman.
Zagovornici strože kontrole razvoja umjetne inteligencije smatraju da ovaj slučaj pokazuje potrebu za jasnijim pravilima i sigurnosnim standardima prije nego što se još napredniji modeli počnu široko koristiti.
Iako tehnološke kompanije tvrde da ulažu velika sredstva u sigurnost svojih sustava, stručnjaci upozoravaju da razvoj umjetne inteligencije napreduje brže nego što se razvijaju zakoni i mehanizmi nadzora.
Scena.ba





