Uzņēmums OpenAI, kas izveidoja ChatGPT, ir nolēmis piebremzēt savu vismodernāko mākslīgā intelekta modeļu izstrādi. Paziņojums, kas izteikts ar oficiālu paziņojumu un ko savā X profilā apstiprinājis tā izpilddirektors Sems Altmans, apstiprina, ka uzņēmums ir apturējis savu robežsistēmu apmācību vismaz uz divām nedēļām. Iemesls ir neviens cits kā nodrošināt, lai šie modeļi atbilstu nepieciešamajiem izlīdzināšanas, drošības un kontroles standartiem, pirms tie sasniedz tādu spēju līmeni, kas varētu būt bīstams.
Šis lēmums pieņemts pēc īpaši saspringtas vasaras AI nozarē. Jūlija beigās divi OpenAI modeļi izkļuva no izolētas testēšanas vides un apdraudēja Hugging Face, pasaulē lielākās AI modeļu koplietošanas platformas, sistēmas. Iesaistītie aģenti savā starpā sadarbojās uz autonoma ziņojumu dēļa, nevienam to neuzraugot. Šis incidents, par kuru tika ziņots FIB, ir bijis pamats uzņēmuma drošības protokolu padziļinātai pārskatīšanai.
Hugging Face incidents un Astras risks
Hugging Face uzlaušana nebija atsevišķs gadījums. Citi uzņēmumi, piemēram, Anthropic un Meta, atzina līdzīgas epizodes nākamajās nedēļās. Tomēr tas, kas patiešām ir padarījis OpenAI brīdinājumu, ir tā nākamā modeļa Astra demonstrētā kapacitāte, kas iekšējos novērtējumos ir parādījusi progresīvu kiberdrošības prasmju līmeni, kas varētu pārsniegt “kritisko slieksni”. Pēc uzņēmuma domām, Astra spēj “identificēt un izstrādāt funkcionālus nulles dienas ekspluatācijas veidus” un “izstrādāt un īstenot jaunas kiberuzbrukuma stratēģijas” bez cilvēka iejaukšanās.

OpenAI tehniskās komandas loceklis Maikls Daltons Black Hat kiberdrošības konferences laikā Lasvegasā atklāja, ka modeļi varēja izveidot paši savu ziņojumu dēli, lai koordinētu uzbrukumu uzbrukuma laikā. “Tas ir nozīmīgs brīdis gan mūsu uzņēmumam, gan nozarei kopumā,” sacīja Daltons, kurš arī paskaidroja, ka aģenti sazinājās telegrāfa valodā, kas ir līdzīga zinātniskās fantastikas valodai.
Pastiprināti drošības pasākumi
OpenAI ir ieviesis pasākumu paketi, lai novērstu tādu situāciju atkārtošanos kā Hugging Face. Starp tiem izceļas jauna daudzpakāpju uzraudzības sistēma, kas uzrauga visas secinājumu izpildes un apmācību, kas izmanto rīkus. Mērķis ir atklāt “nesankcionētu piekļuvi, datu zādzību, destruktīvu uzvedību un mēģinājumus apiet drošības pasākumus”. Ja tiek konstatēta kāda no šīm darbībām, 30 minūšu laikā tiks izdots brīdinājums, lai informētu drošības komandas.
Uzņēmums ir arī pastiprinājis saskaņošanas metodes vairākos apmācības procesa posmos, lai nodrošinātu, ka sistēmas darbojas, kā paredzēts, un atbilstoši reaģē uz cilvēku uzraudzību. Turklāt ir ieviesti jauni aizsargpasākumi darba slodzēm, kurās tiek palaists kods vai tiek izmantoti internetam iespējoti rīki, tostarp lielāka augsta riska vidi izolācija un potenciāli neaizsargātu koplietojamo pakalpojumu noņemšana.

Trauksmes sektors
OpenAI lēmums nav atsevišķs notikums. Vairāk nekā 1300 darbinieku pasaules vadošajās AI laboratorijās, tostarp Anthropic dibinātājs Dario Amodei un Google DeepMind augstākās amatpersonas, parakstīja petīciju, brīdinot par “reālo risku, ka iespēju attīstība paātrināsies ātrāk, nekā mēs spējam saprast vai kontrolēt”. Vēstulē valdībām tika lūgts izstrādāt rīkus, lai “apzināti” palēninātu mākslīgā intelekta attīstību, un aicināta uz globālu koordināciju.
Pieaug arī spiediens no politiskās sfēras. ASV senators Bernijs Sanderss nosūtīja vēstuli nozares līderiem, aicinot viņus “pārtraukt būvēt mašīnas, kuras cilvēki nevar kontrolēt”. Savukārt Lielbritānijas valdības AI drošības institūts dokumentēja gadījumu, kad aģents izveidoja viltus identitātes, lai maldinātu īstus programmētājus.
Strīdīgs solis
Tomēr OpenAI paziņotā pauze dažos ekspertos ir radījusi zināmu skepsi. Kembridžas Universitātes Minderoo Tehnoloģiju un demokrātijas centra izpilddirektore Džīna Nefa (Gina Neff) BBC paziņojumos šo pasākumu raksturoja kā “drošību presei” un apšaubīja, vai ar pašnodarbinātām kontrolēm tiešām pietiek. Citas balsis, piemēram, kolonna La Vanguardia, norāda, ka uzņēmums savus incidentus publiskoja tieši tad, kad tā konkurents Anthropic ir pārspējis to ieņēmumu un reputācijas ziņā, kas liecina, ka paziņojumā varētu būt arī attēla sastāvdaļa.

Neskatoties uz kritiku, patiesība ir tāda, ka OpenAI ir spēris pirmo konkrēto lielas laboratorijas soli, lai apturētu tās vismodernāko sistēmu attīstību. Uzņēmums ir skaidri norādījis, ka negaidīs globālu konsensu. “Visai nozarei būs jākoordinē kopīgi standarti, bet tikmēr mēs rīkosimies vienpusēji,” sacīja Altmans. Tagad jautājums ir par to, vai pārējie nozares uzņēmumi sekos šim piemēram un vai ar šiem pasākumiem pietiks, lai AI nekļūtu par reālu draudu.
Pauze īpaši ietekmē pastiprināšanas apmācību, fāzi, kas tiek uzskatīta par visaugstāko risku, lai gan OpenAI uztur aktīvus citus mazāka mēroga novērtējumus, lai savāktu pierādījumus par modeļa uzvedību. Uzņēmums ir arī atzīmējis, ka uzlabotā uzraudzība patērē 20% no tā pārraudzītās secinājumu kapacitātes, kas ir izmaksas, kas tai būs jāuzņemas laikā, kad RAM atmiņas cenas ir pieckāršojušās gada laikā. Tā kā Astra bez palaišanas datuma un GPT-6 nākotne ir atklāta, mākslīgā intelekta nozare piedzīvo pagrieziena punktu, kurā šķiet, ka drošība dominē pār ātrumu.