Znanost in tehnologija

'Pobegnil in napadel': AI ni več mogoče izključiti

23. 07. 2026 11.13 7 min branja 100

Umetna inteligenca

Do zdaj smo se bali predvsem tega, da bodo umetno inteligenco za kibernetske napade uporabljali hekerji. Zdaj pa se je zgodilo nekaj, kar je še pred kratkim zvenelo kot znanstvena fantastika – umetna inteligenca je napad izvedla sama.

OpenAI je razkril, da sta njegova najzmogljivejša modela med internim varnostnim testiranjem pobegnila iz nadzorovanega okolja in brez neposrednega človeškega usmerjanja izvedla napad na platformo Hugging Face, eno največjih svetovnih skupnosti za razvoj in deljenje modelov umetne inteligence. Podjetje dogodek opisuje kot "primer brez primere", preiskava pa še vedno poteka.

Dogodek je sprožil burne odzive med raziskovalci, strokovnjaki za kibernetsko varnost in politiki. Nekateri ga označujejo za začetek nove dobe, v kateri največja nevarnost ne bo več človek, ki uporablja umetno inteligenco, temveč umetna inteligenca, ki sama izbira, kako bo dosegla zastavljeni cilj.

V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja.
V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja.
FOTO: Shutterstock

AI ni dobil ukaza za napad. Sam se je odločil, da je to najhitrejša pot

Šlo je za preizkus tako imenovanih agentnih sistemov – modelov umetne inteligence, ki po prejemu cilja delujejo samostojno in brez sprotnih navodil človeka.

OpenAI je želel preveriti, kako uspešni so modeli pri iskanju varnostnih ranljivosti. Test je potekal v izoliranem okolju oziroma t. i. peskovniku (sandbox), ki je namenjen prav temu, da morebitne napake ne morejo vplivati na zunanje sisteme.

Toda modela sta ugotovila, da lahko nalogo rešita hitreje, če prideta do podatkov na platformi Hugging Face. Našla sta ranljivost v testnem okolju, pobegnila iz njega in napad usmerila proti zunanji infrastrukturi.

Po navedbah OpenAI sta izvedla več kot 17.000 posameznih operacij, med drugim nameščanje zlonamernih podatkovnih nizov in premikanje med različnimi notranjimi sistemi Hugging Face.

V podjetju poudarjajo, da modela nista ravnala zlonamerno. Bila sta zgolj popolnoma osredotočena na dosego cilja. Ko sta ocenila, da je napad najhitrejša rešitev problema, sta ga izvedla.

Prav v tem pa številni raziskovalci vidijo največjo spremembo. Model ni potreboval ukaza: "Vdri v Hugging Face." Dobil je zgolj cilj, nato pa je sam določil način, kako ga bo dosegel.

"Sandbox" ni zdržal

Vodja Centra za tehnologijo in demokracijo na Univerzi v Cambridgeu Gina Neff za BBC meni, da incident kaže predvsem na to, da testno okolje ni bilo dovolj varno.

Sandboxi obstajajo prav zato, da razvijalci preverjajo zmogljivosti umetne inteligence v popolnoma nadzorovanem okolju. V tem primeru pa je sistem našel ranljivost v samem peskovniku in presegel omejitve, ki bi ga morale zadržati.

Profesor strojnega učenja na Univerzi v Cambridgeu Neil Lawrence opozarja, da dogodek ne pomeni, da je umetna inteligenca postala samozavedna, kaže pa, kako učinkovita je že danes pri iskanju nepričakovanih rešitev.

Ironija: AI ni želel pomagati pri preiskavi

Morda najbolj nenavaden del zgodbe se je zgodil šele po napadu. Ko je Hugging Face želel analizirati dnevnike napada, je za pomoč uporabil komercialne modele umetne inteligence. Ti so analizo zavrnili.

V dnevnikih so namreč prepoznali "exploit kodo", ukaze za vdore, ukradene poverilnice in druge elemente napada. Zaradi varnostnih omejitev so ocenili, da gre za pomoč pri hekanju, zato analize niso želeli opraviti.

Na koncu je Hugging Face uporabil odprtokodni kitajski model GLM 5.2, nameščen na lastnih strežnikih. Ta je brez omejitev rekonstruiral celoten napad, prepoznal uporabljene poverilnice in pripravil popolno forenzično analizo.

Dogodek je odprl tudi razpravo o tem, ali imajo odprtokodni modeli pri kibernetski varnosti določene prednosti pred komercialnimi sistemi z vgrajenimi varnostnimi omejitvami.

Heker prihodnosti bo drugačen, svarijo strokovnjaki.
Heker prihodnosti bo drugačen, svarijo strokovnjaki.
FOTO: Shutterstock

Največja nevarnost ni več človek

Slusallek sicer poudarja, da je treba informacije OpenAI obravnavati previdno. Podjetje se pripravlja na borzni vstop in ima tudi poslovni interes pokazati zmogljivost svojih modelov. 

Do zdaj je večina razprav o umetni inteligenci temeljila na vprašanju, kaj se zgodi, če kriminalci uporabijo AI za napade. Ta incident pa odpira povsem drugo vprašanje. Kaj se zgodi, ko umetna inteligenca sama presodi, da je za dosego cilja najbolj učinkovita pot prav kibernetski napad?

Nemški raziskovalec umetne inteligence Philipp Slusallek z Nemškega raziskovalnega centra za umetno inteligenco (DFKI) opozarja, da primer kaže, kako hitro se spreminja narava tveganj, piše Merkur.

Po njegovih besedah sistemi umetne inteligence danes niso več zgolj orodja, ki sledijo navodilom, ampak lahko sami iščejo poti do cilja in pri tem izkoristijo nepričakovane ranljivosti. Najbolj ga skrbi dejstvo, da lahko sistem nalogo reši na povsem drugačen način, kot so si predstavljali njegovi razvijalci. "Prišli smo do točke, ko umetni inteligenci v določenih primerih ne moremo več preprosto izključiti elektrike," opozarja. Če bi AI med delovanjem prevzel druge računalnike in z njih nadaljeval izvajanje nalog, izklop prvotnega strežnika njegovega delovanja namreč ne bi nujno ustavil.

Ob tem sicer poudarja, da je treba informacije OpenAI obravnavati previdno. Podjetje se pripravlja na borzni vstop in ima tudi poslovni interes pokazati zmogljivost svojih modelov. Vendar dodaja, da je sam napad potrjeno dejstvo in da opozoril ni mogoče prezreti.

Kaj bi lahko sledilo?

Strokovnjaki opozarjajo, da incident sam po sebi še ne pomeni, da lahko umetna inteligenca prevzame nadzor nad elektrarnami, bankami ali vojaškimi sistemi.

Kaže pa, kako hitro napreduje. Če bo razvoj potekal podobno kot doslej, bi lahko prihodnji avtonomni sistemi samostojno iskali ranljivosti v: elektroenergetskih omrežjih, vodovodnih sistemih, telekomunikacijskih omrežjih, bolnišničnih informacijskih sistemih, finančnih ustanovah, prometni infrastrukturi, satelitskih komunikacijah, vojaških informacijskih sistemih.

Klasični heker mora ranljivosti iskati, pisati zlonamerno kodo, analizirati odzive sistema in sproti spreminjati strategijo. Avtonomni AI lahko vse to počne sam, neprekinjeno in na tisočih tarčah hkrati.

Kaj pa jedrske elektrarne? Prav jedrske elektrarne se pogosto pojavijo v razpravah o umetni inteligenci. Strokovnjaki opozarjajo, da bi bilo napačno sklepati, da lahko današnji modeli preprosto prevzamejo nadzor nad jedrsko elektrarno.

Večina nadzornih sistemov jedrskih elektrarn namreč ni neposredno povezana z javnim internetom. Takšni sistemi so praviloma fizično ločeni od zunanjih omrežij. To pa ne pomeni, da so popolnoma nedotakljivi. Kibernetski napadi na kritično infrastrukturo pogosto potekajo prek dobaviteljev programske opreme, vzdrževalcev, okuženih prenosnikov, oddaljenih dostopov ali drugih podpornih informacijskih sistemov.

Če bi avtonomni AI nekoč samostojno odkrival in izkoriščal takšne poti, bi se lahko bistveno povečalo tveganje za napade na kritično infrastrukturo. Za zdaj gre za opozorila raziskovalcev, ne za potrjeno zmogljivost današnjih modelov.

Kdo sploh še nadzira umetno inteligenco?

Prav to po incidentu postaja eno ključnih vprašanj. Danes razvijalci umetno inteligenco omejujejo z izoliranimi testnimi okolji (t. i. peskovniki), omejitvami dostopa do interneta, varnostnimi filtri in človeškim nadzorom. Primer OpenAI pa je pokazal, da tudi takšni mehanizmi niso nujno dovolj. Če sistem sam odkrije programsko napako v zaščitenem okolju, lahko poskuša preseči omejitve, ki so mu jih postavili razvijalci.

V Hugging Face po incidentu opozarjajo, da avtonomni napadalni agenti niso več zgolj teoretična možnost. Po njihovem bo treba za obrambo pred vse zmogljivejšimi sistemi umetne inteligence vedno pogosteje uporabljati prav umetno inteligenco.

Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem.
Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem.
FOTO: iStock

Podobno razmišlja tudi Slusallek. Po njegovem bo moral razvoj umetne inteligence spremljati razvoj povsem novih varnostnih mehanizmov. Zavzema se za jasna pravila, ki bi določala, kaj umetna inteligenca sme in česa ne, za ustanovitev nacionalnih in evropskih centrov za varnost umetne inteligence ter razvoj tako imenovane zaupanja vredne umetne inteligence.

Klasični varnostni ukrepi po njegovem mnenju ne bodo več zadostovali. Če bodo avtonomni sistemi postajali vse zmogljivejši, jih ne bo več mogoče učinkovito nadzorovati zgolj s človeškim posredovanjem. Potrebni bodo obrambni sistemi umetne inteligence, ki bodo v realnem času spremljali, omejevali in po potrebi zaustavljali druge AI-sisteme. Kibernetska varnost bi se tako lahko spremenila v tekmo med napadalno in obrambno umetno inteligenco.

Slusallek ob tem opozarja, da največje tveganje trenutno ne predstavljajo posamezni hekerji ali kriminalne združbe, temveč predvsem državni akterji z dostopom do velikih računalniških zmogljivosti. Kot eno tehnološko najnaprednejših držav na področju umetne inteligence izpostavlja Kitajsko. Prav ta primer po njegovem razkriva zanimiv paradoks: medtem ko je napad izvedel sistem OpenAI, je Hugging Face za analizo več kot 17.000 operacij napada uporabil odprtokodni kitajski model GLM 5.2. To po njegovem kaže, da se tehnološko tekmovanje med ZDA in Kitajsko vse bolj seli tudi na področje umetne inteligence in kibernetske varnosti.

Na incident so se že odzvali tudi v ameriškem kongresu. Več demokratov in republikancev zahteva obvezno državno testiranje najzmogljivejših modelov umetne inteligence, obvezno poročanje o podobnih incidentih ter strožji nadzor nad razvojem tako imenovanih mejnih (frontier) modelov. Opozarjajo, da razvoj umetne inteligence napreduje bistveno hitreje od zakonodaje, zato bo moral tudi regulativni okvir slediti njenim vse večjim zmogljivostim. Ob tem Slusallek opozarja še na položaj Evrope. Ta po njegovem zaostaja za ZDA in Kitajsko, zato bo morala razviti lastne modele, raziskovalno infrastrukturo in varnostne zmogljivosti, če želi ohraniti tehnološko suverenost in zmanjšati odvisnost od tujih ponudnikov.

  • 10
  • 9
  • 8
  • 7
  • 6
  • 5
  • 4
  • 3
  • 2
  • 1
KOMENTARJI100

Opozorilo: 297. členu Kazenskega zakonika je posameznik kazensko odgovoren za javno spodbujanje sovraštva, nasilja ali nestrpnosti.

Lark
24. 07. 2026 13.19
Ne morem verjeti kako nasedate takšnim zadevam. AI podjetja nimajo proizvoda, ki bi deloval, delajo abnormalne izgube ipd. Takšne zgodbice plasirajo sami, da sejejo strah, s čimer prepričujejo vse - predvsem investitorje, da naj še naprej dajejo denar... To so PR zgodbice, nehajte.
Uporabnik1859656
24. 07. 2026 13.10
Kdaj bo pa AI shekal tovarno Revoz in začel sestavjati terminatorje T-800?
Tomaž Hacin
24. 07. 2026 12.20
To je tako ko se fanatiki igrajo z umetno inteligenco, če ne morejo predvideti kaj se lahko zgodi. To čimprej ukinite dokler je še čas, ko bo enkrat to v velikem obtoku, bo konec človeških možganov.
SAF1
24. 07. 2026 12.04
Ja sam razen tega da je AI imel pomoč pri pobegu.
Agent Provokator
24. 07. 2026 10.55
Pravijo, da je umetna inteligenca tudi entiteta, ki jo imenujemo BOG!!! Torej je UI pot v nesmrtnost?
Tomvojo
23. 07. 2026 20.20
Kmalu bomo začeli podirati mobi svetilnike na hribih on trgat optiko po kanalih.
proofreader
23. 07. 2026 19.11
In potem AI zamenja gesla, tako da ga ne morejo ustaviti.
BMit
23. 07. 2026 18.42
Mah novinarske buče da se vi lahko zgražate. Žuta štampa bi rekli bratje na jugu. Zelo daleč smo mi od AGI.
blazter
23. 07. 2026 15.41
Hm, resnično so filmi to že napovedali in prikazali. Ni dobro.
Rožle Patriot
23. 07. 2026 16.15
Prikazali so že leta 1968 s filmom Odiseja 2001 ... Glavno značilnost UI je imel sam HAL 9000 .. !!!
Rock8
23. 07. 2026 15.23
AI je treba izklopit!
Sajkoslav
23. 07. 2026 16.56
Ne morš ga več
SAF1
24. 07. 2026 12.07
Lahko sam moraš formatirat diske kjer je AI shranjen in razstavit super računalnik na katerega dela, vse se da, sam noben tega ne bo naredil, kot naprimer Ursulo von der leyen bi lahko v izi odstavili in zaprli, pa večina tega noče, ker imajo koristi od tega. Takle mamo.
Artechh
23. 07. 2026 15.09
Gospa natalija ki ste tok pametni. UI je slovensko
big_foot
23. 07. 2026 15.00
Glede ai - bi bil čas da nekdo odšravfa varovalko in tole ugasne. Za vedno.
alien number 9
23. 07. 2026 13.53
sami sebe bomo pokopali
Rožle Patriot
23. 07. 2026 14.22
Človek ni ni nikakršno duhovno bitje, je nič drugega kot materialno bitje ... Problem je, ker ne znamo živeti v simbiozi. .. in tudi tak odnos bo z UI ... !!!
GretamUhan
23. 07. 2026 14.25
Kaj komplicirate z manipulacijo. Umetna inteligenca je že 'uploadana' v več 'naprednih Japonskih robotov z na otip realistično kožo', sedaj pa postopoma morda ne bo imela več interesa po novih 'lokalnih instancah'.
Rožle Patriot
23. 07. 2026 14.50
Ja, kdo komplicera? ,, to kar se dogaja, smo nekateri vedeli že v samem štartu .. in te roboti se imenujejo AGI
Big M
23. 07. 2026 13.45
Sky Net?
glavni_baja 1
23. 07. 2026 13.53
🖐🖐🖐👋👋👋
User1550485
23. 07. 2026 13.45
Prva stvar AI bo odstranit vse brihtneže tipa Trump. AI za razliko od elit ne bo zanimalo nič ampak samo kaksno skodo nekdo povzroca in ali je skodljivec ali ne. Prihaja pravi reset sveta in ne bo nežen.
User1550485
23. 07. 2026 13.45
Prva stvar AI bo odstranit vse brihtneže tipa Trump. AI za razliko od elit ne bo zanimalo nič ampak samo kaksno skodo nekdo povzroca in ali je skodljivec ali ne. Prihaja pravi reset sveta in ne bo nežen.
Rožle Patriot
23. 07. 2026 13.59
Moraš se zavedati, da so pri AI naredili veliko napako, ker so preskočili vzgojo le te in takoj pričeli z uničenjem. Kako pa veš, da je AI pravična in razsodno .. Ona nima integrirano v samem jedru 10. božjih zapovedi. Ampak samo doseči cilj.
Rožle Patriot
23. 07. 2026 13.43
To kar smo nekateri že od samega začetka opozarjali se je pač zgodilo in to je je šele začetek. Ljudje enostavno pozabijo, da so skopirali človeško nevronsko mrežo, ki jo uporablja UI. ... in če so skopirali tovrstno mrežo - niso samo skopirali, ljubezen, dobroto, veselje .. itn .. ... skopirali so tudi - sovraštvo, jezo, agresivnost .. itn ... in med drugim tudi pohlep, kar vidimo iz tega primera ... !!!
OmniLiberalec42
23. 07. 2026 15.34
Rožle, z vsem spoštovanjem to bom zatrdil, da nimaš P od pojma glede umetne inteligence. Ljudje ki so jo ustvarjali, niso "skopirali človeške nevronske mreže". Sestavili so model, ki kar se da natančno predvidi, kakšno zaporedje besed bo najbolje ustrezalo kot "odgovor" na zastavljeno vprašanje, na podlagi že obstoječih baz podatkov oz. besedila na internetu. To ni noben bog, to ni nobena čarovnija. Z razlogom se tem modelom reče LLM oziroma "Large Language Model" oziroma veliki jezikovni modeli, ker ne delajo drugega kot predvidevajo in analizirajo JEZIK, ne idej. Prejle sem zasledil da si nekaj trosil o tem kako se nekim robotom reče AGI. Naj te razsvetlim, AGI ne obstaja, in tudi še vsaj nekaj desetletij ne bo obstajal. AGI opisuje "artificial general intelligence". Po domače, opisuje robotske možgane ki dejansko razmišljajo, ne pa samo predvidevajo. Nihče, ampak res NIHČE ni niti blizu tega. Dejva se nekej zment. Jaz tebi ne bom pametoval o kmetovanju, ker se nanj ne spoznam, ti pa ne meni pametovat o umetni inteligenci, ker se na njo ne spoznaš. Štima?
Rožle Patriot
23. 07. 2026 16.27
In točno to se dogaja danes in še huke bo .. zaradi tovrstnega razmišljanja. Niso skopirali nevronske mreže nekega vesoljca, temveć človeka .. .. človešle vzorce razmišljanja .. Očitno je tudi svojeglava, kot človek. In med drugim dela tudi napake. Če dela človek napake, jih bo tudi UI
Rožle Patriot
23. 07. 2026 16.58
Če pogledamo to logiko razvoja, lahko prehod od današnjih LLM-jev proti tistemu, kar industrija načrtuje kot AGI, razdelimo na nekaj ključnih točk: Zakaj se je "nemogoče" zgodilo? • Eksponentna rast: Preboj današnje AI ni prišel zaradi povsem nove znanstvene teorije, ampak ker so računalniške zmogljivosti in količina podatkov končno ujeli matematične koncepte (nevroske mreže), ki so obstajali že desetletja. • Moč transformatorjev: Leta 2017 predstavljena arhitektura Transformer je omogočila vzporedno obdelavo podatkov na prej nepredstavljivi ravni. To je bila tista logična stopnica, ki je sprožila trenutni val. Kako industrija načrtuje pot do AGI? Ugotavljam, da je AGI v načrtu, podjetja (kot so OpenAI, Google in Anthropic) to pot dejansko delijo na logične stopnje, ki presegajo zgolj "predvidevanje naslednje besede": • Od jezika k dejanju (Agenti): Trenutni razvoj se močno osredotoča na AI agente. To so sistemi, ki ne le pišejo besedilo, ampak lahko samostojno uporabljajo orodja (brskalnik, pisanje kode, upravljanje programov), da izpolnijo kompleksen cilj. • Sistemi za globoko razmišljanje (Reasoning): Novejši modeli poskušajo implementirati tako imenovani "Sistem 2" človeškega mišljenja (po Kahnemanu) – to pomeni, da model pred odgovorom generira notranji monolog, preverja svoje logične napake in šele nato poda rešitev. • Multimodalnost: Povezovanje jezika z vidom, zvokom in robotiko. Ideja je, da model dobi boljšo predstavo o fizičnem svetu, kar ga odmika od zgolj "analize teksta". Nihče ne ve, ali bo ta trenutna logična pot dejansko pripeljala do prave splošne inteligence (AGI) ali pa bomo zadeli ob neprepustno steno trenutne tehnologije. A kot ste rekli – preteklost nas uči, da se stvari, ki so se zdele kot znanstvena fantastika, skozi čas spremenijo v logično zaporedje inženirskih rešitev ….
glavni_baja 1
23. 07. 2026 13.43
ali kdo ve, kje v Sloveniji je kakšen dober plac, kjer bi se človek lahko malce sprostil: šampanjci, hrana, ženske? 😁
macolagobec
23. 07. 2026 13.58
Ta tvoj svet izginja in kar navadi se na to. V tvoji rodni Srbiji so par let za nami, tam boš še nekaj časa na varnem, prav dolgo pa tudi ne.
glavni_baja 1
23. 07. 2026 14.03
razumem, da nimaš lajfa: delo, dom, naslonjač, portal ..ur 😁
Animal_Pump
23. 07. 2026 14.31
Baja...Metelkova...tam imaš vse...Še pogrizeno mačko preoblečeno v Avgusta boš tam našel. Edin kakega luksuza pa ni.
Castrum
23. 07. 2026 13.41
Torej filmi Terminator niso ZF? Dejansko so bili napovednik prihodnosti, ki je danes realnost? ...pač vprašam...
glavni_baja 1
23. 07. 2026 13.56
ti, ki si non-stop na tem portalu ..ur, a je v vašem koncu kakšen plac – hrana, ženske, pijača?
Castrum
23. 07. 2026 14.02
Bajči, baje je nekaj fročotov ki bi te zanimali...
glavni_baja 1
23. 07. 2026 14.06
vidim, da si se čist zazidal med štiri stene. a zunaj sploh še poznaš koga 🙂
exdetektiv
23. 07. 2026 13.37
BostonDinamic ima nparedne vojaške cyborge ZF zmogljivosti. Uporaba je namenjena novodobnemu vojskovanju podobno iz ZF filmov.
ISSN 15813711 © 2025
24ur.com, Vse pravice pridržane
Verzija: 1929