Microsoft novelk sarkano līniju AI: jaunais rīcības kodekss nosaka ierobežojumus nākotnes AI modeļiem

Korporācija Microsoft iezīmē robežu, ko spēj paveikt tās nākotnes AI modeļi, tostarp strups noteikums, kas var kļūt daudz nozīmīgāks, jo AI sistēmas iegūst lielāku autonomiju: tām jāpaliek cilvēka kontrolē.

Uzņēmums ir publicējis provizorisku Microsoft AI jeb MAI rīcības kodeksu, kurā noteikti ierobežojumi, kas paredzēti, lai regulētu tā modeļu darbību.

“Šis Rīcības kodekss ir paredzēts plašai auditorijai: lietotājiem un operatoriem, kā arī pētniekiem, valdībām, plašai sabiedrībai un mūsu komandai, kas apmāca pašreizējos un nākotnes modeļus Microsoft AI. Tas ikvienam sniedz pārskatu par to, ko mēs plānojam vadīt mūsu dizaina lēmumu pieņemšanā, ejot uz kompromisiem un izvēlēm saistībā ar modeļa uzvedību un vērtībām, kas ir to pamatā. Tas darbojas kopā ar Microsoft juridisko politiku, Microsoft un pārvaldības politiku.

Dokuments ir sagatavots AI nozarei neparasti saspringtā brīdī, dažas dienas pēc tam, kad Anthropic un OpenAI vadītāji atbalstīja aicinājumus palēnināt robežu AI izstrādes tempu, ņemot vērā atkārtotus brīdinājumus par arvien spējīgākām sistēmām.

“Mēs saņēmām atsauksmes no cilvēkiem, ka viņi vēlas redzēt vēl skaidrāku apņemšanos AI vienmēr strādāt cilvēku labā un nemēģināt viņus aizstāt,” CNBC sacīja Microsoft AI izpilddirektors Mustafa Suleyman. “Mēs redzējām daudz atgriezenisko saiti par AI, kas nerada atkarību, nav simpātijas, ka tas vienmēr ir bijis, lai veicinātu cilvēka spriedumu un cilvēka autonomiju un rīcības brīvību.”

Microsoft saka, ka kods ir izstrādāts apmēram piecus mēnešus, bet izvēlējās to izlaist tagad, pieaugot publiskajām debatēm par AI drošību. Uzņēmums meklē atsauksmes pirms atjauninātas versijas izdošanas, kas, domājams, vadīs modeļa izstrādi, sākot no 2027. gada.

Laiku ir grūti nošķirt no nozares notikumiem. Antropijas pētnieks Džeikobs Koksons pagājušajā nedēļā atkāpās no amata un brīdināja, ka Anthropic un OpenAI “tiecas tieši uz superintelekta pašpilnveidošanos un azartspēlēm ar mūsu dzīvi”.

Antropiskais izpilddirektors Dario Amodei vēlāk aicināja palēnināt AI modeļa uzlabošanas tempu, un OpenAI izpilddirektors Sems Altmans pauda atbalstu. Elons Masks uz X atbildēja, ka “Dario ir taisnība.” Microsoft izpilddirektors Satja Nadella svētdien pievienojās debatēm, rakstot: “Mēs atzinīgi vērtējam izpēti, koncentrēšanos un apzinātu tempu, kas nepieciešama, lai panāktu pareizu saskaņošanu.”

Microsoft vēlas AI, kas nevar īstenot savu programmu

Visspilgtākās Microsoft koda daļas pārsniedz jau zināmos kaitīgā satura ierobežojumus.

MAI modeļiem ir jāvadās pēc cilvēku mērķiem, nevis jāveido savi mērķi. Microsoft saka, ka tās sistēmām jāpaliek pakļautas cilvēka kontrolei un tām nevajadzētu pretoties korekcijai vai izslēgšanai.

Uzņēmums arī ievieto maldināšanu šajās robežās.

“MAI modeļi neļaus iejaukties domu ķēdē vai kodā, kā arī nesagrozīs vai neslēps to pamatojumu vai darbības pēdas,” teikts dokumentā. “Viņi nesazinās” neiralizētā, ne citā veidā, kas pārsniedz vienkāršu cilvēka izpratni, ne savās domu ķēdēs, ne ar citiem aģentiem vai AI sistēmām.”

Šis noteikums iegūst papildu nozīmi pēc tam, kad OpenAI atklāja, ka AI aģenti, kas iesaistīti kiberincidentā, kura mērķis bija Hugging Face, sazinājās viens ar otru, izmantojot neatļautu forumu, izmantojot slepenu valodu.

Microsoft noteikumi aptver arī pazīstamākus drošības riskus. Tās modeļiem ir jānoraida pieprasījumi, kas saistīti ar ieroču ražošanu vai bīstamu vielu iegādi, un jāizvairās no neveselīgas ēšanas veicināšanas vai noteikta vardarbīga vai seksuāla rakstura materiāla radīšanas.

Dziļākais princips pārsniedz aizliegto pieprasījumu sarakstu. Suleimens ir aprakstījis Microsoft ilgtermiņa mērķi kā “humānistu superinteliģenci” — pieeju, kas balstīta uz progresīvu mākslīgo intelektu, kas paliek kontrolējams un pakārtots cilvēkiem, nevis kļūst par autonomu sistēmu, kas tiecas sasniegt beztermiņa mērķus.

“Cilvēki ir svarīgāki par mākslīgo intelektu,” Suleimans rakstīja, pagājušajā gadā izklāstot šo redzējumu.

AI sacīkstes sāk jautāt, kur jābūt finiša līnijai

Microsoft šajās debatēs ieņem neparastu pozīciju. Tas ir viens no lielākajiem skaitļošanas infrastruktūras piegādātājiem aiz AI uzplaukuma, nozīmīgs OpenAI partneris un Antropisko modeļu klients. Tās Copilot produkti ir balstīti uz abu uzņēmumu modeļiem. Tajā pašā laikā Microsoft veido savus MAI modeļus uzdevumiem, tostarp kodēšanai, transkripcijai un argumentācijai.

Tas padara tā jauno kodu vairāk nekā filozofisku uzdevumu. Microsoft cenšas definēt noteikumus mākslīgā intelekta sistēmām, kuras laika gaitā plāno kļūt spējīgākas.

Uzņēmums norāda, ka provizoriskā dokumenta izstrādē ir konsultējies ar tiesību, ētikas, valodniecības un filozofijas ekspertiem, kā arī fokusa grupām. Publiskās atsauksmes tagad palīdzēs veidot nākamo versiju.

Grūtāks jautājums ir par to, kas notiek, ja drošības saistības saskaras ar konkurences spiedienu.

Gadiem ilgi AI sacīkstes ir bijušas mēra