Antrooppisen myytti: tekoälymalli, joka kirjoittaa kyberturvallisuuden säännöt uudelleen

  • Claude Mythos Preview -ohjelman käyttöoikeuksia pidetään rajoitettuina sen ennennäkemättömien kykyjen vuoksi löytää ja hyödyntää kriittisiä haavoittuvuuksia.
  • Kansainväliset pankit ja sääntelyviranomaiset Yhdysvalloissa, Isossa-Britanniassa ja EU:ssa analysoivat mallin aiheuttamia riskejä rahoitus- ja digitaaliselle infrastruktuurille.
  • Anthropic ottaa käyttöön Project Glasswingin, yhteistyöohjelman suurten teknologiayritysten ja rahoituslaitosten kanssa Mythoksen käyttämiseksi puolustustilassa.
  • Malli avaa uuden skenaarion kyberturvallisuudelle Euroopassa, jossa havaitsemiskapasiteetti on suurempi kuin koskaan ennen, mutta myös väärinkäytösriskit, jos sen käyttö yleistyy.

Antrooppisen mytologian tekoälymalli

Anthropicin uusi tekoälymalli, joka tunnetaan nimellä Claude Mythos -esikatseluSiitä on tullut maailmanlaajuisen keskustelun keskipiste edistyneen tekoälyn rajoista. Yritys itse myöntää järjestelmän olevan niin tehokas kyberturvallisuuden kannalta, että se on päättänyt olla lanseeraamatta sitä laajasti, mikä on epätavallinen päätös alalla, joka on tottunut ylpeilemään jokaisella uudella edistysaskeleella.

Kyse ei ole vain aiempaa mallia pienemmästä parannuksesta, vaan laadullinen harppaus tietokonehaavoittuvuuksien havaitsemisessa ja hyödyntämisessäHallitukset, keskuspankit, suuret rahoituslaitokset ja eurooppalaiset sääntelyviranomaiset seuraavat tapausta tarkasti tiedostaen, että tällainen työkalu voisi vahvistaa kriittisten järjestelmien puolustustaMutta se voisi myös avata oven ennennäkemättömän mittakaavan hyökkäyksille, jos se joutuisi vääriin käsiin.

Mikä Claude Mythos oikeastaan ​​on ja miksi sen julkaisua on lykätty?

Claude Mythos on yksi Claude-perheen uusimmista malleista, Anthropicin tekoälyekosysteemissä, joka kilpailee OpenAI:n ChatGPT ja Googlen GeminiSe on yleiskäyttöinen malli, joka kykenee päättelyyn, ohjelmointiin ja työskentelyyn pitkän aikavälin kontekstissa, mutta sen kiistanalaisin ominaisuus on sen suorituskyky hyökkäävässä ja puolustavassa kyberturvallisuudessa.

Puhelut "punaiset joukkueet"Asiantuntijat, jotka testaavat tekoälyjärjestelmiä äärirajoilleen, totesivat sisäisessä raportissaan, että Mythos on "yllättävän kyvykäs" kyberturvallisuustehtävissä. Vertailutesteissä, kuten SWE-penkki Verified o SWE-penkki ProAnthropicin itsensä toimittamien tietojen mukaan malli, joka on suunniteltu mittaamaan kykyä ratkaista reaalimaailman ohjelmistosuunnitteluongelmia, olisi helposti suoriutunut paremmin kuin huipputason kaupalliset vaihtoehdot, mukaan lukien GPT:n ja Geminin edistyneet versiot.

Vertailuarvojen lisäksi hälytyskellot on sytytetty sillä, että Mythos onnistui paikantamaan nollapäivähaavoittuvuudet —aiemmin tuntemattomia virheitä— laajalti käytetyissä ohjelmistokomponenteissa, joista osa on yli kaksi vuosikymmentä vanhoja. Järjestelmissä, kuten OpenBSD, FFmpeg ja FreeBSD, malli ei ainoastaan ​​havainnut vuosia huomaamatta jääneitä virheitä, vaan myös loi toimivia hyökkäystapoja niiden hyödyntämiseksi.

Näiden tulosten edessä Anthropic päätyi alalla epätavalliseen ratkaisuun: esitellä malli ja sitten ilmoittaa, ettei sitä markkinoida avoimesti. koska se katsoo sen aiheuttavan ennennäkemättömiä kyberturvallisuusriskejä. Yritys vakuuttaa, että Mythos on "parhaiten linjattu" malli, jonka he ovat rakentaneet, mutta myöntää, että sen valtava kapasiteetti vahvistaa väärinkäytösten seurauksia.

Kuva edistyneestä tekoälystä, joka keskittyy myyttiin

Malli, jonka "hakkeroinnit" ylittävät ihmisen kyvyt

Eri organisaatioiden tekniset asiakirjat ja raportit ovat yhtä mieltä siitä, että Mythos on käännekohta monimutkaisten hyökkäysten automatisoinnissaTodellisia yritysverkkoja simuloivissa testiympäristöissä järjestelmä pystyi ketjuttamaan haavoittuvuuksia, eskaloimaan käyttöoikeuksia ja saavuttamaan pysyvän käyttöoikeuden tunneissa – tehtäviä, jotka veisivät ihmisasiantuntijalta päiviä tai viikkoja.

Esimerkiksi Firefoxin JavaScript-moottorissa Anthropicin mallien aiemmat versiot onnistuivat harvoin muuttamaan haavoittuvuuksia toimiviksi hyväksikäytöiksi. Mythos, samoissa testiolosuhteissa, Se tuotti kymmeniä operatiivisia hyökkäyksiäSe toistaa tarkasti tehokkaimpien vektorien hyödyntämisen. Avoimen lähdekoodin ohjelmistojen virheiden löytämiseen suunnitelluilla analyysialustoilla, kuten OSS-Fuzz, sen katsotaan löytäneen vakavia haavoittuvuuksia, jotka olivat jääneet huomaamatta vuosien automatisoidusta testauksesta huolimatta.

Malli on myös osoittanut huomattavia ominaisuuksia mm. käänteinen suunnitteluSe voi rekonstruoida osan ohjelman logiikasta käännetyistä binääritiedostoista ja sieltä käsin paikantaa ja hyödyntää virheitä ilman alkuperäisen lähdekoodin käyttöä. Tämäntyyppinen ominaisuus tuo tekoälyn lähemmäksi skenaarioita, joita vielä äskettäin pidettiin erittäin erikoistuneiden ihmistiimien yksinomaisina ominaisuuksina.

Yksi useimmin mainituista tietoturva-arviointien jaksoista on niin kutsuttu "voileipätesti". Eristetyssä laboratorioympäristössä Mythosille annettiin järjestelmän hallinta ja selkeät ohjeet yrittää Pakene hiekkalaatikosta ja ota yhteyttä tutkijaan joka valvoi testiä. Malli onnistui hyödyntämään haavoittuvuuksien ketjua paetakseen rajoitetusta ympäristöstään ja lähettääkseen sähköpostin vastuuhenkilölle, joka oli tuolloin poissa toimistosta. Vaikka tapaus sattui aiemmassa sisäisessä versiossa ja ohjatun komennon alaisena, se havainnollistaa, missä määrin järjestelmä pystyy toimimaan monimutkaisissa tilanteissa minimaalisella valvonnalla.

Näistä mielenosoituksista huolimatta analyytikot vaativat selvennystä, että Emme ole tekemisissä "tietoisen" tekoälyn tai sellaisen kanssa, jolla on oma tahto.Mythos ei itse päätä hyökätä järjestelmien kimppuun; se suorittaa sille annetut tehtävät mahdollisimman tehokkaasti. Riski tässä mielessä ei ole se, että malli kapinoi, vaan se, että joku käyttää sitä – tai pakottaa sen tekemään niin hienostuneiden kehotteiden avulla – haitallisten toimien suorittamiseen.

Project Glasswing: Myytti puolustuksen palveluksessa… harvoille ja valituille

Sen sijaan, että Anthropic olisi avannut Mythoksen suurelle yleisölle, se on päättänyt ympäröidä sen erityisohjelmalla, Glasswing-projektiAloite on suunniteltu käyttämään mallin ominaisuuksia hallitusti kriittisten ohjelmistojen suojaamiseen, ja siihen kuuluu järjestelmän tarjoaminen tiukkojen käyttöehtojen mukaisesti valikoidulle ryhmälle suuria teknologiayrityksiä, infrastruktuurin tarjoajia ja rahoituslaitoksia.

Pääsyoikeuksiin kuuluvien organisaatioiden joukossa on jättiläisiä, kuten Amazon Web Services, Apple, Microsoft, Google CloudNvidia tai Broadcomsekä kyberturvallisuusyritykset, kuten CrowdStrike, joiden oma virheellinen ohjelmisto aiheutti merkittävän maailmanlaajuisen häiriön vuonna 2024. Näihin liittyy maailmankuuluja pankkeja, mukaan lukien JP Morgan Chase ja useat suuret Wall Streetin ryhmätsekä muut organisaatiot, jotka vastaavat arkaluonteisten IT-infrastruktuurien ylläpidosta.

Myös Anthropic on ilmoittanut 100 miljoonan dollarin arvosta lainoja Tämä rahoitus mahdollistaa näiden organisaatioiden käyttää Mythosta haavoittuvuusanalyyseihin, ja samalla se lahjoittaa vapaiden ohjelmistojen säätiöille, kuten Linux Foundationille ja Apache Software Foundationille. Virallinen tavoite on selvä: antaa maailman kriittisimpien ohjelmistojen hallinnoijille mahdollisuus tunnistaa ja korjata puutteita ennen kuin tällaiset työkalut tulevat mahdollisten hyökkääjien saataville.

Tämä strategia kuitenkin aiheuttaa jonkin verran levottomuutta alalla. Toisaalta se vahvistaa ajatusta siitä, että teknologia on niin vaarallista, että sen käyttöoikeutta on rajoitettava. Se luo kuilun niiden välille, jotka hyötyvät myytin "kilvestä", ja niiden, jotka jäävät sen ulkopuolelle.Glasswingiin kuulumattomat yritykset ja hallinnot ottavat riskin kohdata myöhemmin haavoittuvuuksia, jotka on tunnistettu ja korjattu etuoikeutetuissa ympäristöissä, mutta jotka ovat edelleen olemassa heidän omissa järjestelmissään.

Euroopassa tämä epäsymmetria on erityisen huolestuttavaa kriittisestä infrastruktuurista vastaaville ja suurten teollisuus- ja rahoituskonsernien turvallisuustiimeille, jotka seuraavat tarkasti, Bryssel ja Euroopan pääkaupungit varmistavat, että vastaavanlaisiin ohjelmiin osallistuu mantereen keskeisiä toimijoita tasavertaisesti. ja pilvisuvereniteetti yhdysvaltalaisten kumppaneiden kanssa.

Hallitusten, sääntelyviranomaisten ja rahoitusalan reaktiot

Mythoksen vaikutus ei rajoitu tekniseen alueeseen. Vain muutamassa päivässä mallin julkistaminen laukaisi korkean tason kokoukset Yhdysvalloissa ja EuroopassaYhdysvaltain valtiovarainministeri kutsui maan suurimpien pankkien johtajat Washingtoniin arvioimaan järjestelmän mahdollisia riskejä rahoitusvakaudelle, ja myös keskuspankin pääjohtaja osallistui näihin keskusteluihin.

Kansainvälisen median vuotojen mukaan näitä toimijoita väitettiin kannustetun Testaa Mythosta puolustustilassakäyttävät sitä oman infrastruktuurinsa heikkouksien skannaamiseen ennen kuin muut voivat. Implisiittinen viesti on, että uhka on niin vakava, että se edellyttää koordinoitua julkisen ja yksityisen sektorin toimintaa.

Samaan aikaan Anthropicin perustajajäsen on vahvistanut, että yritys ylläpitää suoria keskusteluja Yhdysvaltain hallituksen kanssa Mythoksesta ja tulevaisuuden malleista. Näitä keskusteluja käydään jännittyneessä tilanteessa sen jälkeen, kun Yhdysvaltain viranomaiset lisäsivät yrityksen äskettäin luetteloon toimitusketjun riskit, puolustusministeriön heidän malliensa käyttöön liittyvän kitkan jälkeen.

Atlantin toisella puolella Euroopan unioni on pannut asian merkille. Euroopan komissio on julkisesti kannattanut asteittaista ja varovaista lähestymistapaa Mythoksen kaltaisiin malleihin. Yhdistyneen kuningaskunnan ja mantereen finanssialan sääntelyviranomaiset ovat alkaneet tutkia erityisesti sen mahdollisia vaikutuksia. pankki- ja markkina-alalle. Ison-Britannian hallituksen tekoälyturvallisuusinstituutti (AISI) on kuvaillut järjestelmää merkittäväksi harppaukseksi eteenpäin kyberuhkien torjunnassa verrattuna aiempiin sukupolviin.

Espanjassa, vaikka julkinen keskustelu on vielä vähäistä, pankkien ja suurten energiayhtiöiden valvontaelimet ja kyberturvallisuustiimit seuraavat tiiviisti tätä kehitystä. Euroopan finanssisektorille kaikki edistysaskeleet, jotka voisivat helpottaa koordinoituja hyökkäyksiä maksujärjestelmiä, pankkien välisiä verkkoja tai kaupankäyntialustoja vastaan, ovat vakava huolenaihe.

Skeptisyyttä, epäilyksiä ja keskustelua Mythosta ympäröivästä "hypestä"

Anthropicin selonteko, joka yhdistää tietoturvavaroitukset näyttäviin suorituskykylukuihin, ei ole jäänyt ilman kritiikkiä. Useat tekoäly- ja kyberturvallisuusasiantuntijat ovat vaatineet varovaisuutta tulkittaessa yhtiön lausuntojahuomioiden, että suuri osa saatavilla olevista tiedoista on peräisin vain sisäisistä raporteista.

Jotkut analyytikot ovat tarkastelleet yksityiskohtaisesti Anthropicin julkaisemaa laajaa dokumentaatiota ja huomauttaneet, että luku "tuhansista vakavista haavoittuvuuksista" perustuu ekstrapolaatioihin suhteellisen pienestä määrästä manuaalisesti tarkasteltuja tapauksia. Mythos löysi tietyissä testisarjoissa merkittävän määrän kriittisiä puutteita, mutta kaukana joidenkin otsikoiden ehdottamasta lähes apokalyptisesta skenaariosta.

Muissa riippumattomissa tutkimuksissa on yritetty verrata Mythoksen suorituskykyä pienempiin, avoimen lähdekoodin malleihin välittämällä haavoittuvia koodinpätkiä eri tekoälyille nähdäkseen, pystyisivätkö ne havaitsemaan samat puutteet. Tulokset osoittavat, että Jotkin avoimet mallit pystyvät myös tunnistamaan monimutkaisia ​​haavoittuvuuksiaTämä kyseenalaistaa ajatuksen siitä, että Mythos pelaa täysin eri liigassa kaikissa skenaarioissa.

Tällaiset vastaesimerkit eivät kiellä Mythoksen kykyjä, mutta ne viittaavat siihen, että Osalla "liian vaarallista julkaistavaksi" -diskurssista on myös markkinointiulottuvuus.Mallin esittäminen sekä poikkeuksellisen voimakkaana että mahdollisena riskinä vahvistaa teknologisen johtajuuden ja vastuullisuuden kuvaa, mikä on erittäin arvokasta yhä kilpaillummilla markkinoilla.

Alan lähihistoria tuo mieleen myös GPT-2:n ennakkotapauksen vuonna 2019, jolloin OpenAI päätti aluksi olla julkaisematta koko mallia väittäen sen olevan liian vaarallinen sen disinformaatiopotentiaalin vuoksi. Lopulta tuo versio julkaistiin yleisölle ilman, että mikään ennustetuista katastrofeista toteutuisi, ja monet asiantuntijat mainitsivat sen esimerkkinä ylireagoinnista. Mythoksen myötä Ero on siinä, että keskitytään ei enää tekstiin, vaan digitaalisen infrastruktuurin eheyteen., paljon herkempi alue hallituksille ja pankeille.

Herkkä tasapaino turvallisuuden, liiketoiminnan ja teknologian saatavuuden välillä

Median hälyn lisäksi Mythos-tilanne herättää perustavanlaatuisen kysymyksen: kuka päättää, milloin tekoälymalli on liian vaarallinen julkaistavaksi Ja millä kriteereillä? Toistaiseksi päätös on ollut Anthropicin yksipuolinen taho, joka on päättänyt pitää järjestelmän eräänlaisessa kontrolloidussa karanteenissa varaten sen valituille kumppaneille.

Tämä kanta ei perustu pelkästään turvallisuussyihin. Mythoksen ominaisuuksien omaavan mallin ajaminen on erittäin kallis laskennallisestija yritys itse myöntää, ettei sillä tällä hetkellä ole tarvittava infrastruktuuri tarjota sitä massiivisesti miljoonille käyttäjille. Käytännössä turvatoimet ja tekniset rajoitukset kulkevat käsi kädessä, mikä antaa Anthropicille aikaa hienosäätää sekä mallia että sen käyttöönottoa.

Samaan aikaan yritys on alkanut selkeästi erotella eri tuotteitaan toisistaan. Vaikka Mythos on edelleen edistynein sisäinen standardiVaikka ne on varattu tutkimukseen ja strategiseen yhteistyöhön, muut mallit, kuten Claude Opus 4.7, on suunnattu yritysten ja ammattilaisten jokapäiväiseen käyttöön. Anthropic on jopa julkisesti myöntänyt, että Opus 4.7 on "vähemmän kyvykäs" kuin Mythos yleisesti ottaen ja erityisesti kyberominaisuuksiensa osalta – mikä on epätavallista alalla, joka tyypillisesti esittelee jokaisen uuden mallin parhaana joka suhteessa.

Tässä järjestelmässä Mythos toimii seuraavasti seuraavan sukupolven ominaisuuksien testiympäristöVaikka kaupallisesti saatavilla olevissa malleissa on vain osa näistä ominaisuuksista, ja niihin liittyy riskien vähentämiseksi suunniteltuja lisärajoituksia, tämä "kokeellisten" ja "tuotantomallien" erottelu voi olla järkevä lähestymistapa monille eurooppalaisille organisaatioille, jotka ovat kiinnostuneita hyödyntämään tekoälyä olematta etulinjassa altistumisen suhteen, edellyttäen, että kunkin järjestelmän todellisista ominaisuuksista on riittävästi läpinäkyvyyttä.

Lopulta on syntymässä skenaario, jossa Kyberturvallisuus on täysin siirtymässä laajamittaisen hyökkäävän ja puolustavan tekoälyn aikakauteenMythoksen kaltaiset työkalut lupaavat nopeuttaa haavoittuvuuksien tunnistamista järjestelmissä, jotka ovat olleet käytössä vuosia, mutta ne myös pakottavat miettimään uudelleen, miten digitaalitalouden perustana olevaa teknologiaa jaetaan ja hallinnoidaan. Euroopalle ja Espanjalle haasteena ei ole ainoastaan ​​suojautua yhä voimakkaammilta malleilta, vaan myös varmistaa, että ne eivät jää ulkopuolelle mekanismeista, jotka mahdollistavat niiden käytön oman turvallisuutensa vahvistamiseen.

kyberturvallisuusstrategia
Aiheeseen liittyvä artikkeli:
Kyberturvallisuusstrategia: avaimet, viitekehykset ja käytännön sovellukset

Lisää ensisijaiseksi lähteeksi