Perturb AI stimulēto hakeru tīkls sāk uzbrukt AI modeļiem, pirms to dara noziedznieki

Sanfrancisko, ASV, 2026. gada 28. augusts, TechnologyWire

Perturb ir uzsācis decentralizētu pretrunīguma tīklu vietnē Bittensor, kas nepārtraukti pārbauda ražošanas mākslīgā intelekta modeļus un maksā globālam pētnieku tīklam, lai atrastu ievainojamības, kuras var palaist garām iekšējām sarkanajām komandām.

Piecas nedēļas pēc tam, kad eksperimentālais OpenAI modelis izkļuva no testēšanas vides un pārkāpa Hugging Face ražošanas infrastruktūru, un dažas dienas pēc tam, kad OpenAI atbildēja ar stingrāku iekšējo uzraudzību un spēcīgāku tīkla izolāciju, Perturb ievieš tīklu ar strupu priekšnoteikumu: vienīgais veids, kā iet kopsolī ar AI iespējām, ir pastāvīgi, mērogā uzbrukt AI modeļiem, pirms to dara kāds cits.

Perturb ir decentralizēts pretrunīguma tīkls, kas izveidots uz Bittensor. Globālais stimulētu kalnraču apakštīkls nepārtraukti pārbauda mākslīgā intelekta modeļus ar melnās kastes, balto lodziņu un pārsūtīšanas uzbrukumiem, modeļu īpašniekiem atgriežot trīs lietas: robustuma rādītāju, ievainojamības karte, kas precīzi parāda, kur modelis sabojājas, un nostiprinātas datu kopas, kas ir gatavas lietošanai pārkvalifikācijai.

OpenAI līdz šim veiktie pasākumi ir iekšējā kontrole, un tā pilnīga pēcnāves incidents vēl ir priekšā. Perturb pieņēmums ir tāds, ka iekšējā kontrole ir slānis, kuru incidents uzvarēja: modeļa drošība nav zināma, kamēr kāds ārpus ēkas nav mēģinājis to uzlauzt.

Ekonomika apgriež tradicionālo drošības modeli. Tā vietā, lai algotu stacionāru sarkano komandu vai slēgtu līgumu ar kiberdrošības firmu, lai veiktu tūlītēju auditu, modeļu īpašnieki iegūst pastāvīgu, globālu uzbrucēju kopu, kam maksā par atrasto. Perturb pakalpojumu pozicionē kā ātrāku, visaptverošāku un izmaksu ziņā efektīvāku nekā parastie drošības pārdevēji, kuru iesaistīšanās var ilgt nedēļas un atspoguļot tikai vienas komandas uzbrukuma idejas.

Visi atklājumi tiek apstrādāti saskaņā ar atbildīgu izpaušanu: par ievainojamībām tiek ziņots privāti modeļa īpašniekam, un informācija par izmantošanu netiek publicēta.

“Katram šodien ražotajam modelim ir ievainojamības, ko tā būvnieki nekad nav redzējuši, jo neviena iekšējā komanda nevar visu izdomāt,” sacīja Kojuki Nakamori, Perturb līdzdibinātājs un izpilddirektors. “Pēdējie incidenti nav anomālijas. Tā izskatās, kad spējas pārsniedz testēšanu. Mēs izveidojām tīklu, kurā tūkstošiem stimulētu uzbrucēju nepārtraukti pārbauda jūsu modeli, un katra ievainojamība, ko viņi atklāj, ir tāda, ko slikts aktieris nevar izmantot.”

Tīkla agrīnā versija ir pieejama, lai to izmēģinātu vietnē perturbai.io/playground.

Par Perturbu

Perturb ir decentralizēts pretrunīguma tīkls, kas izveidots uz Bittensor. Tā globālais stimulētu drošības pētnieku tīkls nepārtraukti uzbrūk ražošanas AI modeļiem — melnās kastes, baltās kastes un pārsūtīšanas paņēmieniem, izmantojot teksta, attēlu, audio un multimodālās sistēmas — un saņem samaksu par atklātajām ievainojamībām. Modeļu īpašnieki saņem robustuma rādītāju, ievainojamības karšu karti, kas parāda, kur modelis sabojājas, un sacietējošas datu kopas, kas ir gatavas pārkvalifikācijai. Perturb līdzdibinātāji bija Koyuki Nakamori (CEO), Džefrijs Lembs (CTO) un Vadims Šakuro. Baltā grāmata un rotaļu laukums vietnē perturbai.io.

Sazināties

Sems Allkoks
[email protected]