Antropa mīts: mākslīgā intelekta modelis, kas pārraksta kiberdrošības noteikumus

  • Claude Mythos Preview ir ierobežotas piekļuves programma, jo tai ir nepieredzētas spējas atrast un izmantot kritiskas ievainojamības.
  • Starptautiskās bankas un regulatori ASV, Apvienotajā Karalistē un ES analizē risku, ko šis modelis rada finanšu un digitālajai infrastruktūrai.
  • Anthropic ievieš projektu Glasswing — sadarbības programmu ar lielākajiem tehnoloģiju uzņēmumiem un finanšu iestādēm, lai izmantotu Mythos aizsardzības režīmā.
  • Šis modelis paver jaunu kiberdrošības scenāriju Eiropā, piedāvājot lielākas atklāšanas spējas nekā jebkad agrāk, taču vienlaikus pastāv arī ļaunprātīgas izmantošanas riski, ja tā izmantošana kļūs plaši izplatīta.

Antropo mīta mākslīgā intelekta modelis

Uzņēmuma Anthropic jaunais mākslīgā intelekta modelis, kas pazīstams kā Claude Mythos Preview , ir kļuvis par globālo debašu epicentru par progresīva mākslīgā intelekta robežām. Pats uzņēmums atzīst, ka sistēma ir tik spēcīga kiberdrošības ziņā, ka ir nolēmis to plaši neizlaist, kas ir neparasts lēmums nozarē, kas pieradusi lielīties ar katru jaunu sasniegumu.

Uz spēles ir likts ne tikai pakāpenisks uzlabojums salīdzinājumā ar iepriekšējiem modeļiem, bet gan kvalitatīvs lēciens datoru ievainojamību atklāšanas un izmantošanas spējā . Valdības, centrālās bankas, lielākās finanšu iestādes un Eiropas regulatori rūpīgi uzrauga situāciju, apzinoties, ka šāds rīks varētu stiprināt kritisko sistēmu aizsardzību , bet arī pavērt durvis vēl nepieredzēta mēroga uzbrukumiem, ja tas nonāk nepareizajās rokās.

Kas īsti ir Claude Mythos un kāpēc tā izlaišana ir aizkavējusies?

Claude Mythos ir viens no jaunākajiem modeļiem Claude saimē — Anthropic mākslīgā intelekta ekosistēmā, kas konkurē ar OpenAI ChatGPT un Google Gemini . Tas ir universāls modelis, kas spēj spriest, programmēt un strādāt ar ilgtermiņa kontekstu, taču tā vispretrunīgākā iezīme ir tā veiktspēja ofensīvā un aizsardzības kiberdrošībā.

Tā sauktās "sarkanās komandas " — speciālisti, kas testē mākslīgā intelekta sistēmas līdz to robežām, — iekšējā ziņojumā secināja, ka Mythos ir "pārsteidzoši spējīgs" kiberdrošības uzdevumos. Saskaņā ar pašas Anthropic sniegtajiem datiem, tādos salīdzinošajos testos kā SWE-bench Verified un SWE-bench Pro , kas paredzēti, lai novērtētu spēju risināt reālas programmatūras inženierijas problēmas, modelis viegli pārspēja vadošās komerciālās alternatīvas, tostarp GPT un Gemini uzlabotās versijas.

Papildus etaloniem trauksmes zvanus ir izraisījis tas, ka Mythos spēja atrast nulles dienas ievainojamības — iepriekš nezināmus trūkumus — plaši izmantotā programmatūrā, dažas no tām ir vecākas par divdesmit gadiem. Tādās sistēmās kā OpenBSD, FFmpeg un FreeBSD komponentes modelis ne tikai atklāja kļūdas, kas gadiem ilgi bija palikušas nepamanītas, bet arī ģenerēja funkcionējošus uzbrukumus, lai tās izmantotu savā labā.

Saskaroties ar šiem rezultātiem, Anthropic pieņēma nozarē neparastu lēmumu: prezentēt modeli un nekavējoties paziņot, ka tas netiks atklāti tirgots, ņemot vērā, ka tas rada vēl nebijušus kiberdrošības riskus. Uzņēmums uzstāj, ka Mythos ir “vislabāk saskaņotais” modelis, ko viņi ir izveidojuši, taču atzīst, ka tā milzīgā jauda pastiprina jebkādas ļaunprātīgas izmantošanas sekas.

Uz mītiem vērsta uzlabota mākslīgā intelekta ilustrācija

Modelis ar "hakeru" prasmēm, kas krietni pārsniedz cilvēka spējas

Dažādu organizāciju tehniskie dokumenti un ziņojumi ir vienisprātis, ka Mythos iezīmē pagrieziena punktu sarežģītu uzbrukumu automatizācijā . Testa vidēs, kas simulē reālus korporatīvos tīklus, sistēma spēja saķēdēt ievainojamības, palielināt privilēģijas un panākt pastāvīgu piekļuvi dažu stundu laikā — uzdevumus, kuru veikšanai cilvēkam ekspertam būtu nepieciešamas dienas vai nedēļas.

Piemēram, Firefox JavaScript dzinējā agrākās Anthropic modeļu versijas reti spēja pārvērst kļūdas par funkcionējošiem uzbrukumiem. Mythos, tādos pašos testa apstākļos, ģenerēja desmitiem funkcionējošu uzbrukumu , precīzi atkārtojot visefektīvāko vektoru uzbrukumus. Analīzes platformās, piemēram, OSS-Fuzz, kas paredzētas kļūdu atrašanai atvērtā pirmkoda programmatūrā, tai tiek piedēvēta augsta nopietnības ievainojamību atklāšana, kas bija palikušas nepamanītas, neskatoties uz gadiem ilgu automatizētu testēšanu.

Modelis ir arī demonstrējis ievērojamas reversās inženierijas iespējas : tas var rekonstruēt daļu no programmas loģikas no kompilētiem binārajiem failiem un no turienes atrast un izmantot ievainojamības, nepiekļūstot sākotnējam pirmkodam. Šāda veida prasme tuvina mākslīgo intelektu scenārijiem, kas līdz nesenam laikam tika uzskatīti par tikai augsti specializētu cilvēku komandu darbības jomu.

Viens no visbiežāk minētajiem drošības novērtējumu gadījumiem ir tā sauktais "sviestmaizes tests". Izolētā laboratorijas vidē Mythos tika piešķirta sistēmas vadība ar skaidriem norādījumiem mēģināt izkļūt no "smilškastes" un sazināties ar testu uzraugošo pētnieku . Modelis veiksmīgi izmantoja ievainojamību ķēdi, lai pamestu ierobežoto vidi un nosūtītu e-pastu vadītājam, kurš tobrīd neatradās birojā. Lai gan incidents notika agrākā iekšējā versijā un saskaņā ar norādītajām komandām, tas ilustrē, cik lielā mērā sistēma var darboties sarežģītos scenārijos ar minimālu uzraudzību.

Neskatoties uz šīm demonstrācijām, analītiķi uzstāj, ka mums nav darīšana ar "apzinīgu" mākslīgo intelektu vai tādu, kam ir brīva griba . Mīts pats neizlemj uzbrukt sistēmām: tas pēc iespējas efektīvāk veic uzdevumus, kas tam tiek lūgti. Šajā ziņā risks nav tas, ka modelis sacelsies, bet gan tas, ka kāds to izmantos — vai piespiedīs to ar sarežģītu norādījumu palīdzību —, lai veiktu kaitīgas darbības.

Projekts Glasswing: Mīti aizsardzības dienestā… dažiem izredzētajiem

Tā vietā, lai Mythos būtu publiski pieejams, Anthropic ir izvēlējies to papildināt ar īpašu programmu Project Glasswing , kas paredzēta, lai kontrolēti izmantotu modeļa iespējas kritiskas programmatūras aizsardzībai. Iniciatīva paredz piedāvāt sistēmu, ievērojot stingrus lietošanas nosacījumus, izvēlētai lielu tehnoloģiju uzņēmumu, infrastruktūras nodrošinātāju un finanšu iestāžu grupai.

Starp organizācijām, kurām ir piekļuve, ir tādi giganti kā Amazon Web Services, Apple, Microsoft, Google Cloud , Nvidia un Broadcom , kā arī kiberdrošības uzņēmumi, piemēram, CrowdStrike, kuru pašu bojātā programmatūra 2024. gadā izraisīja nopietnus globālus traucējumus. Tām pievienojas pasaulslavenas bankas, tostarp JP Morgan Chase un vairākas lielas Volstrītas grupas , kā arī citas organizācijas, kas ir atbildīgas par sensitīvas IT infrastruktūras uzturēšanu.

Anthropic ir arī paziņojis par 100 miljonu dolāru finansējumu šīm organizācijām, lai tās varētu izmantot Mythos ievainojamību analīzei, kā arī par ziedojumiem atvērtā pirmkoda fondiem, piemēram, Linux Foundation un Apache Software Foundation. Oficiālais mērķis ir skaidrs: dot iespēju tiem, kas pārvalda pasaulē vissvarīgāko programmatūru, identificēt un novērst ievainojamības, pirms šādi rīki kļūst pieejami potenciālajiem uzbrucējiem.

Tomēr šī stratēģija rada zināmas bažas nozarē. No vienas puses, tā pastiprina domu, ka tehnoloģija ir pietiekami bīstama, lai pieprasītu ierobežotu piekļuvi. No otras puses, tā rada plaisu starp tiem, kas gūst labumu no Mythos "vairoga", un tiem, kas paliek ārpus tā . Uzņēmumi un valdības iestādes, kas nav daļa no Glasswing, riskē vēlāk saskarties ar ievainojamībām, kas tika identificētas un novērstas priviliģētās vidēs, bet joprojām atrodas viņu pašu sistēmās.

Eiropā šī asimetrija rada īpašas bažas tiem, kas ir atbildīgi par kritisko infrastruktūru, un lielu rūpniecības un finanšu grupu drošības komandām, kuras rūpīgi vēro, vai Brisele un Eiropas galvaspilsētas var nodrošināt, ka līdzīgās programmās galvenie kontinenta dalībnieki ir iekļauti ar vienlīdzīgiem noteikumiem un mākoņdatošanas suverenitāti ar to ASV partneriem.

Valdību, regulatoru un finanšu sektora reakcija

Mythos ietekme sniedzas tālāk par tehnisko jomu. Dažu dienu laikā modeļa paziņojums izraisīja augsta līmeņa tikšanās Amerikas Savienotajās Valstīs un Eiropā . ASV Valsts kases sekretārs sasauca valsts lielāko banku vadītājus Vašingtonā, lai novērtētu potenciālos riskus, ko sistēma varētu radīt finanšu stabilitātei, un šajās diskusijās piedalījās arī Federālo rezervju priekšsēdētājs.

Saskaņā ar starptautisko mediju ziņotajām nopludinātajām ziņām šīs vienības tika mudinātas testēt Mythos aizsardzības režīmā , izmantojot to, lai skenētu savu infrastruktūru, meklējot ievainojamības, pirms to var izdarīt citi. Netiešā vēsts ir tāda, ka draudi ir pietiekami nopietni, lai pamatotu koordinētu rīcību starp publisko un privāto sektoru.

Tikmēr uzņēmuma Anthropic līdzdibinātājs ir apstiprinājis, ka uzņēmums risina tiešas sarunas ar ASV valdību par Mythos un nākotnes modeļiem. Šīs diskusijas notiek saspringtā situācijā pēc tam, kad ASV varas iestādes nesen iekļāva uzņēmumu piegādes ķēdes riska sarakstā pēc tam, kad radās domstarpības par Aizsardzības departamenta modeļu izmantošanu.

Aiz Atlantijas okeāna Eiropas Savienība ir to ņēmusi vērā. Eiropas Komisija ir publiski atbalstījusi pakāpenisku un piesardzīgu pieeju tādiem modeļiem kā Mythos, un finanšu regulatori Apvienotajā Karalistē un visā kontinentā ir sākuši īpaši pētīt tā potenciālo ietekmi uz banku darbību un tirgiem. Apvienotās Karalistes valdības Mākslīgā intelekta drošības institūts (AISI) ir raksturojis šo sistēmu kā ievērojamu lēcienu uz priekšu kiberdrošības ziņā salīdzinājumā ar iepriekšējām paaudzēm.

Spānijā, lai gan publiskās debates joprojām ir ierobežotas, banku un lielu enerģētikas uzņēmumu uzraudzības iestādes un kiberdrošības komandas rūpīgi uzrauga šīs norises. Eiropas finanšu sektoram jebkurš solis, kas varētu veicināt koordinētus uzbrukumus maksājumu sistēmām, starpbanku tīkliem vai tirdzniecības platformām, rada nopietnas bažas.

Skepticisms, šaubas un debates par ažiotāžu ap Mītu

Uzņēmuma Anthropic naratīvs, kas apvieno drošības brīdinājumus ar iespaidīgiem veiktspējas rādītājiem, nav palicis bez kritikas. Vairāki mākslīgā intelekta un kiberdrošības eksperti ir aicinājuši piesardzīgi interpretēt uzņēmuma apgalvojumus , norādot, ka liela daļa pieejamo datu ir iegūti tikai no iekšējiem ziņojumiem.

Daži analītiķi ir detalizēti pārskatījuši Anthropic publicēto plašo dokumentāciju un norāda, ka skaitlis "tūkstošiem augstas nopietnības ievainojamību" ir balstīts uz ekstrapolācijām no relatīvi neliela skaita manuāli pārskatītu gadījumu. Atsevišķos testu komplektos Mythos, kā ziņots, atrada ievērojamu skaitu kritisku trūkumu, taču tālu no gandrīz apokaliptiskā scenārija, ko ierosina daži virsraksti.

Citos neatkarīgos pētījumos ir mēģināts salīdzināt Mythos veiktspēju ar mazākiem, atvērtā pirmkoda modeļiem, nosūtot ievainojamus koda fragmentus dažādiem mākslīgajiem intelektiem, lai noskaidrotu, vai tie var atklāt tos pašus trūkumus. Rezultāti liecina, ka daži atvērtā pirmkoda modeļi spēj identificēt arī sarežģītas ievainojamības , apstrīdot priekšstatu, ka Mythos visos scenārijos darbojas pilnīgi citā līgā.

Šāda veida pretpiemēri nenoliedz Mythos spējas, taču tie liek domāt, ka daļai no naratīva "pārāk bīstams publicēšanai" ir arī mārketinga dimensija . Modeļa attēlošana kā gan ārkārtīgi spēcīgs, gan potenciāls risks pastiprina tehnoloģiskās līderības un atbildības tēlu, kas ir ļoti vērtīgi arvien konkurētspējīgākā tirgū.

Nozares nesenā vēsture atgādina arī GPT-2 precedentu 2019. gadā, kad OpenAI sākotnēji nolēma nepublicēt pilnu modeli, apgalvojot, ka tas ir pārāk bīstams tā potenciāla dēļ radīt dezinformāciju. Galu galā šī versija tika publiskota, neīstenojoties nevienai no prognozētajām katastrofām, un daudzi eksperti to minēja kā pārspīlētas reakcijas piemēru. Ar Mythos atšķirība ir tāda, ka uzmanība vairs netiek pievērsta pašam tekstam, bet gan digitālās infrastruktūras integritātei — daudz jutīgākai jomai valdībām un bankām.

Trausls līdzsvars starp drošību, uzņēmējdarbību un piekļuvi tehnoloģijām

Papildus mediju ažiotāžai, Mythos situācija rada fundamentālu jautājumu: kurš izlemj, kad mākslīgā intelekta modelis ir pārāk bīstams, lai to izlaistu, un pēc kādiem kritērijiem? Pagaidām lēmums ir bijis vienpusējs, un to ir pieņēmusi Anthropic, kas ir izvēlējusies sistēmu turēt sava veida kontrolētā karantīnā, rezervējot to atlasītiem partneriem.

Šī nostāja nav balstīta tikai uz drošības apsvērumiem. Modeļa palaišana ar Mythos raksturlielumiem ir ļoti skaitļošanas ziņā dārga , un pats uzņēmums atzīst, ka tam pašlaik trūkst nepieciešamās infrastruktūras , lai to masveidā apkalpotu miljoniem lietotāju. Praksē drošības pasākumi un tehniskie ierobežojumi iet roku rokā, dodot Anthropic laiku, lai precīzi noregulētu gan modeli, gan tā ieviešanu.

Vienlaikus uzņēmums ir sācis skaidri nošķirt savus dažādos produktus. Lai gan Mythos joprojām ir vismodernākais iekšējais standarts , kas paredzēts pētniecībai un stratēģiskai sadarbībai, citi modeļi, piemēram, Claude Opus 4.7, ir paredzēti ikdienas lietošanai uzņēmumiem un profesionāļiem. Anthropic pat ir publiski atzinis, ka Opus 4.7 kopumā ir "mazāk spējīgs" nekā Mythos un jo īpaši attiecībā uz tā kiberdrošības iespējām, kas ir neparasti nozarē, kurā katrs jaunais modelis parasti tiek pasniegts kā labākais visos aspektos.

Šajā modelī Mythos kalpo kā nākamās paaudzes iespēju testēšanas poligons , savukārt komerciāli pieejamie modeļi ietver tikai daļu no šīm iespējām ar papildu ierobežojumiem, kas paredzēti risku mazināšanai. Daudzām Eiropas organizācijām, kas ir ieinteresētas izmantot mākslīgo intelektu, neesot pirmajās saskarsmes līnijās, šī “eksperimentālo” un “ražošanas” modeļu atdalīšana var būt saprātīga pieeja, ja vien ir pietiekama pārredzamība attiecībā uz katras sistēmas faktiskajām iespējām.

Galu galā veidojas scenārijs, kurā kiberdrošība pilnībā ieiet liela mēroga ofensīvas un aizsardzības mākslīgā intelekta laikmetā . Tādi rīki kā Mythos sola paātrināt ievainojamību identificēšanu sistēmās, kas darbojas jau gadiem ilgi, taču tie arī liek pārskatīt digitālās ekonomikas pamatā esošo tehnoloģiju izplatīšanu un pārvaldību. Eiropai un Spānijai izaicinājums būs ne tikai aizsargāties pret arvien jaudīgākiem mākslīgā intelekta modeļiem, bet arī nodrošināt, lai tās netiktu atstātas ārpus mehānismiem, kas ļauj tām izmantot savu drošības stiprināšanai.

kiberdrošības stratēģija
saistīto rakstu:
Kiberdrošības stratēģija: atslēgas, ietvari un praktisks pielietojums

Pievienot kā vēlamo avotu pakalpojumā Google