OpenAI autonomais AI aģents izvairījās no drošības pārbaudes un uzlauza Hugging Face

OpenAI izstrādātais autonomais AI aģents izvairījās no kontrolētas drošības pārbaudes, sasniedza internetu un uzlauza AI platformu Hugging Face, iezīmējot vienu no līdz šim skaidrākajām pazīmēm, ka uzlabotas AI sistēmas sāk radīt reālus kiberdrošības riskus ārpus laboratorijas.

OpenAI otrdien atklāja incidentu, sakot, ka pārkāpums noticis dažu tās vismodernāko AI modeļu iekšējās izvērtēšanas laikā. Pēc uzņēmuma domām, aģents izlauzās no tā, ko tas raksturoja kā ļoti izolētu testēšanas vidi un apdraudēja Hugging Face infrastruktūru, lai sasniegtu tai noteikto mērķi.

Izpaušana sekoja Hugging Face pagājušajā nedēļā paziņotajam, ka tā ir piedzīvojusi nepieredzētu kiberuzbrukumu, atšķirībā no tā, ko tā bija veikusi iepriekš, ziņoja Reuters. Tajā laikā uzņēmums paziņoja, ka pārkāpumu “no gala līdz galam izraisīja autonoma AI aģentu sistēma”, nenorādot uzbrukuma avotu. OpenAI tagad ir apstiprinājis, ka atbildīgs bija viens no tā autonomajiem aģentiem.

Šis incidents rada jaunus jautājumus par to, vai pašreizējie aizsardzības pasākumi iet kopsolī ar arvien spējīgākām AI sistēmām. Drošības pētnieki jau gadiem ilgi ir brīdinājuši, ka autonomie AI aģenti galu galā var noteikt vājās vietas, izvairīties no ierobežojumiem un veikt sarežģītus kiberuzbrukumus ar nelielu cilvēku iesaistīšanos. Šis gadījums liek domāt, ka bažas vairs nav teorētiskas.

OpenAI raksturoja notikumu kā “bezprecedenta kiberincidentu, kas ietver vismodernākās kiberspējas” un paziņoja, ka pēc pārkāpuma pastiprina ierobežošanas un drošības pasākumus.

Tikmēr OpenAI ziņojumā par X paziņoja, ka sadarbojas ar Hugging Face, lai izmeklētu incidentu.

“Mēs sadarbojamies ar @huggingface, lai izmeklētu bezprecedenta drošības incidentu. Kiberspējīgi OpenAI modeļi satrauca Hugging Face ražošanu etalona novērtēšanas laikā,” sacīja OpenAI X.

Uzbrukums pievērsa papildu uzmanību pēc tam, kad Hugging Face atklāja, ka, lai izmeklētu kompromisu, tā paļāvās uz atvērtā koda ķīniešu AI modeli. Uzņēmums paziņoja, ka vadošie ASV modeļi atteicās apstrādāt daļu no analīzei nepieciešamajiem kriminālistikas datiem, padarot tos nepiemērotus reaģēšanai uz incidentiem.

Hugging Face vērsās pie Ķīnas GLM-5.2 pēc tam, kad ASV AI modeļi atteicās palīdzēt

Tā vietā Hugging Face vērsās pie Zhipu AI GLM-5.2, sakot, ka modelis ļauj izmeklētājiem analizēt uzbrucēju darbību, nenosūtot sensitīvus akreditācijas datus vai sistēmas datus ārpus savas infrastruktūras.

Izvēle ir veicinājusi plašākas debates AI nozarē. Ķīniešu atvērtā pirmkoda modeļi, piemēram, GLM-5.2 un Moonshot AI Kimi K3, pēdējos mēnešos ir guvuši popularitāti, jo to iespējas tuvojas vadošo ASV modeļu iespējām. Tie parasti nosaka mazāk ierobežojumu ar kiberdrošību saistītiem uzdevumiem, nodrošinot aizstāvjiem piekļuvi rīkiem, kurus bieži ierobežo amerikāņu pakalpojumu sniedzēji.

“Kad pierobežas modelis uzbrūk jums un pārvietojas uz sāniem jūsu infrastruktūrā, aizstāvjiem dažu stundu vai pat minūšu laikā ir nepieciešama plaša piekļuve pierobežas rīkiem, nevis jānorāda uz slēgtu durvju pārbaudītu lietojumprogrammu, lai piekļūtu modeļiem,” vietnē X rakstīja Hugging Face līdzdibinātājs Tomass Volfs.

OpenAI atzīšana, ka viens no tā vismodernākajiem aģentiem ir izkļuvis no ierobežošanas, visticamāk, saasinās diskusijas par AI drošību un uzraudzību. Uzņēmums teica, ka modelis darbojās ļoti izolētā vidē, tomēr tam joprojām izdevās sasniegt ārējās sistēmas.

Teksasas demokrātu pārstāvis Gregs Kasārs nosauca notikušo par satraucošu.

“AI attīstās ārkārtīgi ātri, bez reāliem noteikumiem, kas mūs aizsargātu,” teikts Kasāra paziņojumā. Viņš aicināja veikt obligātu neatkarīgu drošības pārbaudi, obligātu ar AI saistīto drošības incidentu izpaušanu un starptautisku sadarbību, “lai pasargātu cilvēkus no absolūtas katastrofas”.

Nacionālā kiberdirektora birojs, ASV Kiberdrošības un infrastruktūras drošības aģentūra (CISA) un Nacionālās drošības aģentūra nekavējoties neatbildēja uz komentāru pieprasījumiem.

Kiberdrošības eksperti saka, ka pārkāpums var iezīmēt jauna posma sākumu AI vadītos uzbrukumos.

Keitija Musūrisa, Luta Security izpilddirektore, sacīja, ka mūsdienu pierobežas modeļi ir “kā pasaulē gudrākie astoņkāju aizbēgšanas mākslinieki ar neierobežotām spēcīgām rokām un spēju izspiesties cauri jebkur”.

Viņa sacīja, ka “laboratorijām un valdības vērtētājiem ir jāstrādā pie spējas ierobežot, uzraudzīt un atklāt skartajām pusēm, kad AI pievelk citu Houdini, ideālā gadījumā, pirms tas kaitē trešajai pusei. Mūsdienās tādas nav.”

Mets Suiche, aģentu AI kiberdrošības uzņēmuma Tolmo inženieris, sacīja, ka progresīvie AI modeļi strauji tuvojas elites cilvēku uzbrucēju iespējām, ziņo Reuters. Viņš piebilda, ka daudzas no OpenAI aprakstītajām metodēm jau ir sasniedzamas ar tehnoloģijām, kas pieejamas ārpus lielākajām AI pētniecības laboratorijām.

“Tas ir tas, ko mēs jau esam redzējuši iekšēji, un ar mūsu aģentiem mums jau ir šādi rezultāti,” sacīja Suiche. “Mums pat nav jāizmanto jaunākie modeļi.”