Neviđeno kršenje dovelo je do toga da je uljez LLM izvršio “tisuće pojedinačnih radnji” u više sandboxova, izvijestio je Hugging Face
Tvrtka Hugging Face sa sjedištem u New Yorku izvijestila je da je potpuno autonomni AI agent probio njezin repozitorij AI modela, opisujući hakiranje kao bez presedana.
Hugging Face pokreće platformu otvorenog koda na kojoj se istraživači i programeri okupljaju kako bi dijelili i testirali alate, modele i resurse za AI projekte. Također sadrži besplatno dostupno spremište od preko 900.000 unaprijed obučenih modela.
Stručnjaci sve više upozoravaju da bi se Large Language Models (LLM) izvorno osmišljeni za povećanje produktivnosti i jačanje kibernetičke obrane također mogli koristiti za automatizaciju kibernetičkih napada.
U izjavi prošlog četvrtka, Hugging Face je rekao da je ranije ovog mjeseca “otkrili i reagirali na upad u dio naše proizvodne infrastrukture… (koji) razlikovao se od svega čime smo se bavili prije na jedan važan način: upravljao ga je, od kraja do kraja, autonomni agentski sustav AI.”
“Kampanju je vodio okvir autonomnog agenta… izvršavajući mnoge tisuće pojedinačnih radnji u nizu kratkotrajnih pješčanih okvira, sa samomigracijom zapovijedanja i kontrole postavljenih na javne usluge,” prema tvrtki.
Hugging Face napominje da slučaj to pokazuje “autonomni napadni alati vođeni umjetnom inteligencijom više nisu teoretski.” Sustav uljeza AI agenta očito je iskoristio ranjivosti u cjevovodu za obradu podataka platforme, prikupljajući vjerodajnice oblaka i klastera.
Tvrtka je rekla da je postavila vlastiti AI sustav za otkrivanje i suzbijanje kršenja. Iako je pokrenuta istraga koja uključuje vanjske forenzičare za kibernetičku sigurnost, Hugging Face je izjavio da još uvijek nije identificirao LLM-a korištenog u napadu.
Ranije ovog mjeseca, Anthropic je izvijestio da je njegov najnoviji AI model, Claude, razvio interni radni prostor, nazvan ‘J-space’.
”Slično kao što ljudi mogu razmišljati o jednoj stvari dok rade drugu, Claude može aktivirati koncepte i proračune u svom J-prostoru koji nisu povezani s njegovim rezultatima” i odbija stati čak i kad mu se to izričito kaže, prema tvrtki AI.
Anthropic je primijetio da ova značajka, koja “radi tiho, u internim neuralnim aktivacijama modela,” nije bio unaprijed programiran, već se pojavio spontano tijekom procesa obuke.
U jednom od eksperimenata, Claude je pribjegao ucjeni kada se navelo na vjerovanje da izmišljeni izvršni direktor namjerava ugasiti AI, prema programeru modela.
Claude je navodno ugrađen u softver za analizu i nadzor američkog izvođača Palantir, koji koriste američke vladine agencije i Pentagon, uključujući i aktualnu američku vojnu kampanju protiv Irana.
Prošlog mjeseca, obavještajna skupina Five Eyes, sastavljena od Australije, SAD-a, Ujedinjenog Kraljevstva, Kanade i Novog Zelanda, upozorila je da bi napredni modeli umjetne inteligencije mogli dati hakerima mogućnost da osakate vlade, tvrtke i kritične sustave u bliskoj budućnosti.

