Ang Mito ni Anthropic: Ang modelo ng AI na muling nagsusulat ng mga patakaran ng cybersecurity

  • Ang Claude Mythos Preview ay pinananatili sa ilalim ng pinaghihigpitang pag-access dahil sa mga walang kapantay na kakayahan nito na hanapin at gamitin ang mga kritikal na kahinaan.
  • Sinusuri ng mga internasyonal na bangko at regulator sa US, UK, at EU ang panganib na dulot ng modelo sa imprastraktura sa pananalapi at digital.
  • Inilunsad ng Anthropic ang Project Glasswing, isang programa sa pakikipagtulungan kasama ang mga pangunahing kumpanya ng teknolohiya at mga institusyong pinansyal upang gamitin ang Mythos sa depensibong paraan.
  • Ang modelo ay nagbubukas ng isang bagong senaryo para sa cybersecurity sa Europa, na may mas maraming kapasidad sa pagtukoy kaysa dati ngunit mayroon ding mga panganib ng pang-aabuso kung ang paggamit nito ay magiging laganap.

Modelo ng AI ng Antropikong Mito

Ang bagong modelo ng artificial intelligence ng Anthropic, na kilala bilang Preview ng Mito ni ClaudeIto ang naging sentro ng pandaigdigang debate tungkol sa mga limitasyon ng advanced AI. Inamin mismo ng kumpanya na ang sistema ay napakalakas sa usapin ng cybersecurity kaya nagpasya itong huwag itong ilunsad nang malawakan, isang hindi pangkaraniwang desisyon sa isang sektor na sanay na ipagmalaki ang bawat bagong pagsulong.

Ang nakataya ay hindi lamang isang unti-unting pagpapabuti kumpara sa mga nakaraang modelo, kundi isang kwalitatibong paglukso sa kakayahang matukoy at magamit ang mga kahinaan ng computerMahigpit na sinusubaybayan ng mga pamahalaan, mga bangko sentral, mga pangunahing institusyong pinansyal, at mga regulator sa Europa ang kaso, dahil alam nilang maaaring palakasin ang depensa ng mga kritikal na sistemaNgunit maaari rin nitong buksan ang pinto sa mga pag-atake na walang katulad kung sakaling mahulog ito sa maling mga kamay.

Ano nga ba ang Claude Mythos at bakit naantala ang paglulunsad nito?

Ang Claude Mythos ay isa sa mga pinakabagong modelo sa pamilyang Claude, ang AI ecosystem ng Anthropic na nakikipagkumpitensya sa ChatGPT ng OpenAI at Gemini ng GoogleIto ay isang pangkalahatang-gamit na modelo, may kakayahang mangatwiran, magprograma, at gumamit ng pangmatagalang konteksto, ngunit ang pinakakontrobersyal nitong katangian ay pagganap sa opensiba at depensibong cybersecurity.

Ang tinatawag na "Mga pulang koponan"Ang mga espesyalistang sumusubok sa mga sistema ng AI hanggang sa kanilang mga limitasyon ay nagtapos sa isang panloob na ulat na ang Mythos ay "nakakagulat na may kakayahan" sa mga gawain sa cybersecurity. Sa mga benchmark test tulad ng Na-verify ang SWE-bench o SWE-bench ProDinisenyo upang sukatin ang kakayahang lutasin ang mga problema sa software engineering sa totoong mundo, ang modelo ay madaling makakahigit sa mga nangungunang komersyal na alternatibo, kabilang ang mga advanced na bersyon ng GPT at Gemini, ayon sa datos na ibinigay mismo ng Anthropic.

Higit pa sa mga pamantayan, ang nagpaalala sa atin ay Nahanap ni Mythos zero-day na mga kahinaan —mga dating hindi kilalang kapintasan— sa malawakang ginagamit na mga bahagi ng software, ang ilan ay mahigit dalawang dekada nang gulang. Sa mga sistemang tulad ng mga bahagi ng OpenBSD, FFmpeg, at FreeBSD, ang modelo ay hindi lamang nakatuklas ng mga error na hindi napapansin sa loob ng maraming taon, kundi nakabuo rin ng mga gumaganang paraan upang samantalahin ang mga ito.

Dahil sa mga resultang ito, pinili ng Anthropic ang isang desisyon na hindi pangkaraniwan sa industriya: para ipakita ang modelo at pagkatapos ay ianunsyo na hindi ito ibebenta nang hayagan. dahil itinuturing nitong nagdudulot ito ng mga walang kapantay na panganib sa cybersecurity. Iginiit ng kumpanya na ang Mythos ang "pinakamahusay na nakahanay" na modelo na kanilang binuo, ngunit kinikilala na ang napakalaking kapasidad nito ay nagpapalakas sa mga bunga ng anumang maling paggamit.

Ilustrasyon ng advanced AI na nakatuon sa Mythos

Isang modelo na may mga kasanayang "hacker" na higit pa sa kakayahan ng tao

Sumasang-ayon ang mga teknikal na dokumento at ulat mula sa iba't ibang organisasyon na Ang Mythos ay nagmamarka ng isang mahalagang punto sa automation ng mga kumplikadong pag-atakeSa mga kapaligirang pangsubok na ginagaya ang mga totoong network ng korporasyon, nagawa ng sistema na i-chain ang mga kahinaan, i-escalate ang mga pribilehiyo, at makamit ang patuloy na pag-access sa loob ng ilang oras—mga gawaing aabutin ng ilang araw o linggo ng isang eksperto.

Halimbawa, sa JavaScript engine ng Firefox, ang mga naunang bersyon ng mga modelo ng Anthropic ay bihirang magawang gawing gumaganang mga exploit ang mga kahinaan. Ang Mythos, sa ilalim ng parehong mga kondisyon ng pagsubok, Nakabuo ito ng dose-dosenang mga operasyonal na pagsasamantalaTumpak nitong ginagaya ang paggamit ng mga pinakaepektibong vector. Sa mga platform ng pagsusuri tulad ng OSS-Fuzz, na idinisenyo upang maghanap ng mga bug sa open-source software, kinikilala ito sa pagtuklas ng mga kahinaan na may mataas na antas ng kalubhaan na hindi napansin sa kabila ng mga taon ng automated testing.

Nagpakita rin ang modelo ng mga kahanga-hangang kakayahan sa reverse engineeringKaya nitong buuin muli ang bahagi ng lohika ng isang programa mula sa mga na-compile na binary at, mula roon, hanapin at samantalahin ang mga depekto nang hindi ina-access ang orihinal na source code. Ang ganitong uri ng kakayahan ay naglalapit sa AI sa mga senaryo na, hanggang kamakailan lamang, ay itinuturing na eksklusibo sa mga highly specialized na pangkat ng tao.

Isa sa mga pinakamadalas banggiting pangyayari sa mga pagtatasa ng seguridad ay ang tinatawag na "sandwich test." Sa isang nakahiwalay na kapaligiran sa laboratoryo, binigyan si Mythos ng kontrol sa isang sistema na may mga tahasang tagubilin upang subukang tumakas sa sandbox at makipag-ugnayan sa mananaliksik na siyang nangangasiwa sa pagsubok. Nagawa ng modelo na samantalahin ang isang kadena ng mga kahinaan upang makatakas sa pinaghihigpitang kapaligiran nito at magpadala ng email sa taong namamahala, na wala sa opisina noong panahong iyon. Bagama't naganap ang insidente sa isang naunang panloob na bersyon at sa ilalim ng direktang pamumuno, inilalarawan nito ang lawak kung saan maaaring gumana ang sistema sa mga kumplikadong senaryo na may kaunting pangangasiwa.

Sa kabila ng mga demonstrasyong ito, iginiit ng mga analyst na linawin na Hindi tayo nakikitungo sa isang "malay" na AI o isa na may sarili nitong kagustuhan.Hindi nagdedesisyon ang Mythos na atakihin ang mga sistema nang mag-isa; isinasagawa nito ang mga gawaing ibinigay dito nang mahusay hangga't maaari. Ang panganib, sa ganitong diwa, ay hindi na magrerebelde ang modelo, kundi na may gagamit nito—o pipilitin itong gawin ito sa pamamagitan ng mga sopistikadong prompt—upang magsagawa ng mga mapaminsalang aksyon.

Project Glasswing: Mito sa serbisyo ng depensa… para sa piling iilan

Sa halip na buksan ang access sa pangkalahatang publiko, pinili ng Anthropic na palibutan ang Mythos ng isang partikular na programa, Proyekto GlasswingDinisenyo upang gamitin ang mga kakayahan ng modelo sa isang kontroladong paraan para sa proteksyon ng kritikal na software, ang inisyatibo ay kinabibilangan ng pag-aalok ng sistema, sa ilalim ng mahigpit na mga kondisyon ng paggamit, sa isang piling grupo ng malalaking kumpanya ng teknolohiya, mga tagapagbigay ng imprastraktura, at mga institusyong pinansyal.

Kabilang sa mga organisasyong may access ay ang mga higanteng kumpanya tulad ng Mga Serbisyo sa Web ng Amazon, Apple, Microsoft, Google CloudNvidia o Broadcompati na rin ang mga cybersecurity firm tulad ng CrowdStrike, na ang sariling depektibong software ay nagdulot ng malaking pandaigdigang pagkagambala noong 2024. Kasama rito ang mga kilalang bangko sa mundo, kabilang ang JP Morgan Chase at ilang malalaking grupo sa Wall Street, pati na rin ang iba pang mga organisasyong responsable sa pagpapanatili ng mga sensitibong imprastraktura ng IT.

Inihayag din ng Anthropic mga pautang na nagkakahalaga ng $100 milyon Ang pondong ito ay magbibigay-daan sa mga organisasyong ito na gamitin ang Mythos para sa pagsusuri ng kahinaan, kasama ang mga donasyon sa mga libreng pundasyon ng software tulad ng Linux Foundation at Apache Software Foundation. Malinaw ang opisyal na layunin: upang pahintulutan ang mga namamahala sa pinakamahalagang software sa mundo na matukoy at itama ang mga depekto bago pa man maging available ang mga naturang tool sa mga potensyal na umaatake.

Gayunpaman, ang estratehiyang ito ay lumilikha ng ilang pagkabalisa sa loob ng sektor. Sa isang banda, pinatitibay nito ang ideya na ang teknolohiya ay sapat na mapanganib upang mangailangan ng limitadong pag-access. Sa kabilang banda, Lumilikha ito ng agwat sa pagitan ng mga nakikinabang sa "kalasag" ng Mythos at ng mga naiiwan.Ang mga kumpanya at administrasyon na hindi bahagi ng Glasswing ay nanganganib na maharap sa mga kahinaan na natukoy at naayos sa mga pribadong kapaligiran, ngunit naroroon pa rin sa kanilang sariling mga sistema.

Sa Europa, ang kawalan ng simetriya na ito ay partikular na ikinababahala ng mga responsable para sa kritikal na imprastraktura at mga pangkat ng seguridad ng malalaking grupong industriyal at pinansyal, na mahigpit na nagmomonitor kung Tinitiyak ng Brussels at ng mga kabisera ng Europa na ang mga katulad na programa ay kinabibilangan ng mga pangunahing manlalaro mula sa kontinente sa pantay na mga termino at soberanya ng ulap kasama ang mga kasosyo ng Estados Unidos.

Reaksyon mula sa mga pamahalaan, mga regulator at sektor ng pananalapi

Ang epekto ng Mythos ay hindi limitado sa teknikal na larangan. Sa loob lamang ng ilang araw, ang anunsyo ng modelo ay nagdulot ng mga pagpupulong sa mataas na antas sa Estados Unidos at EuropaIpinatawag ng Kalihim ng Pananalapi ng Estados Unidos ang mga pinuno ng mga pangunahing bangko ng bansa sa Washington upang masuri ang mga panganib na maaaring idulot ng sistemang ito sa katatagan sa pananalapi, habang lumahok din sa mga usapang iyon ang Tagapangulo ng Federal Reserve.

Ayon sa mga leak na iniulat ng internasyonal na media, ang mga entidad na ito ay umano'y hinikayat na Subukan ang Mythos sa depensibong modeginagamit ito upang suriin ang sarili nilang imprastraktura para sa mga kahinaan bago pa man magawa ng iba. Ang ipinahihiwatig na mensahe ay sapat na seryoso ang banta upang bigyang-katwiran ang isang koordinadong tugon ng publiko at pribado.

Samantala, kinumpirma ng co-founder ng Anthropic na ang kumpanya nagpapanatili ng direktang pakikipag-usap sa gobyerno ng Estados Unidos tungkol sa Mythos at mga modelo sa hinaharap. Ang mga talakayang ito ay nagaganap sa isang tensiyonado na konteksto, matapos kamakailan ay idinagdag ng mga awtoridad ng US ang kumpanya sa isang listahan ng mga panganib sa supply chain, kasunod ng alitan na may kaugnayan sa paggamit ng kanilang mga modelo ng Kagawaran ng Depensa.

Sa kabila ng Atlantiko, napansin ito ng Unyong Europeo. Hayagan nang inendorso ng Komisyon ng Europa ang isang unti-unti at maingat na pamamaraan sa mga modelong tulad ng Mythos, at Sinimulan na ng mga regulator sa pananalapi sa UK at sa kontinente na partikular na pag-aralan ang mga potensyal na implikasyon nito. para sa pagbabangko at mga pamilihan. Inilarawan ng AI Security Institute (AISI) ng gobyerno ng UK ang sistema bilang isang mahalagang pagsulong sa mga tuntunin ng banta sa cyber kumpara sa mga nakaraang henerasyon.

Sa Espanya, bagama't limitado pa rin ang pampublikong debate, mahigpit na sinusubaybayan ng mga superbisor na lupon at mga pangkat ng cybersecurity mula sa mga bangko at malalaking kumpanya ng enerhiya ang mga pag-unlad na ito. Para sa sektor ng pananalapi sa Europa, ang anumang pagsulong na maaaring magpabilis sa mga koordinadong pag-atake laban sa mga sistema ng pagbabayad, mga network ng interbank, o mga platform ng pangangalakal ay isang dahilan para sa seryosong pag-aalala.

Pagdududa, pagdududa, at debate tungkol sa "hype" na nakapalibot sa Mito

Ang account ng Anthropic, na pinagsasama ang mga babala sa seguridad at mga kahanga-hangang bilang ng pagganap, ay hindi nawalan ng mga kritiko. Nanawagan ang ilang eksperto sa AI at cybersecurity para sa pag-iingat kapag binibigyang-kahulugan ang mga pahayag ng kumpanyabinabanggit na karamihan sa mga makukuhang datos ay nagmumula lamang sa mga panloob na ulat.

Detalyadong sinuri ng ilang analyst ang malawak na dokumentasyon na inilathala ng Anthropic at itinuturo na ang bilang ng "libu-libong kahinaan na may mataas na kalubhaan" ay batay sa mga ekstraporasyon mula sa medyo maliit na bilang ng mga manu-manong sinuring kaso. Sa ilang mga test suite, naiulat na nakatuklas ang Mythos ng isang makabuluhang bilang ng mga kritikal na depekto, ngunit malayo sa halos apokaliptikong senaryo na ipinahihiwatig ng ilang mga headline.

Sinubukan ng ibang mga independiyenteng pag-aaral na ihambing ang pagganap ng Mythos sa mas maliliit at open-source na mga modelo, na nagpapasa ng mga vulnerable code snippet sa iba't ibang AI upang makita kung matutukoy nila ang parehong mga depekto. Ipinapahiwatig ng mga resulta na Ang ilang bukas na modelo ay may kakayahang matukoy ang mga kumplikadong kahinaanIto ay nagdudulot ng pagdududa sa ideya na ang Mythos ay naglalaro sa isang ganap na kakaibang liga sa lahat ng mga senaryo.

Ang mga ganitong uri ng kontra-halimbawa ay hindi nagpapawalang-bisa sa mga kakayahan ng Mythos, ngunit ipinahihiwatig ng mga ito na Bahagi ng diskursong "masyadong mapanganib para ilathala" ay mayroon ding dimensyon sa marketing.Ang paglalahad ng isang modelo bilang parehong napakalakas at potensyal na panganib ay nagpapatibay sa imahe ng pamumuno at responsibilidad sa teknolohiya, isang bagay na napakahalaga sa isang lalong mapagkumpitensyang merkado.

Ang kamakailang kasaysayan ng industriya ay nagpapaalala rin sa nauna sa GPT-2 noong 2019, nang una ay nagpasya ang OpenAI na huwag ilathala ang buong modelo, na sinasabing ito ay masyadong mapanganib dahil sa potensyal nitong lumikha ng maling impormasyon. Kalaunan, ang bersyong iyon ay inilabas sa publiko nang hindi naganap ang anumang hinulaang mga sakuna, at binanggit ito ng maraming eksperto bilang isang halimbawa ng labis na reaksyon. Sa Mythos, Ang kaibahan ay ang pokus ay hindi na sa teksto, kundi sa integridad ng digital na imprastraktura., isang mas sensitibong bagay para sa mga pamahalaan at mga bangko.

Isang maselang balanse sa pagitan ng seguridad, negosyo, at pag-access sa teknolohiya

Higit pa sa ingay ng media, ang sitwasyon ng Mythos ay nagtataas ng isang pangunahing isyu: sino ang nagpapasya kung kailan masyadong mapanganib na ilabas ang isang modelo ng AI At sa ilalim ng anong mga pamantayan? Sa ngayon, ang desisyon ay unilateral sa panig ng Anthropic, na piniling panatilihin ang sistema sa isang uri ng kontroladong kuwarentenas, na inilalaan ito para sa mga piling kasosyo.

Ang posisyong ito ay hindi lamang batay sa mga kadahilanang pangseguridad. Ang pagpapatakbo ng isang modelo na may mga katangian ng Mythos ay napakamahal pagdating sa pagkukuwenta, at kinikilala mismo ng kompanya na sa kasalukuyan ay wala itong kinakailangang imprastraktura upang maihatid ito nang malawakan sa milyun-milyong gumagamit. Sa pagsasagawa, ang mga pag-iingat sa seguridad at mga limitasyong teknikal ay magkaugnay, na nagbibigay sa Anthropic ng oras upang pinuhin ang parehong modelo at ang pag-deploy nito.

Kasabay nito, sinimulan na ng kumpanya na malinaw na pag-iba-ibahin ang iba't ibang produkto nito. Habang nananatili ang Mythos bilang pinaka-advanced na panloob na pamantayanBagama't nakalaan para sa konteksto ng pananaliksik at estratehikong kolaborasyon, ang iba pang mga modelo tulad ng Claude Opus 4.7 ay nakatuon sa pang-araw-araw na paggamit ng mga negosyo at mga propesyonal. Kinilala pa nga ng Anthropic sa publiko na ang Opus 4.7 ay "hindi gaanong may kakayahan" kaysa sa Mythos sa pangkalahatang termino at, sa partikular, tungkol sa mga kakayahan nito sa cyber—isang bagay na hindi pangkaraniwan sa isang industriya na karaniwang nagpapakita ng bawat bagong modelo bilang ang pinakamahusay sa lahat ng aspeto.

Sa ganitong pamamaraan, ang Mythos ay gumaganap bilang testbed para sa mga kakayahan ng susunod na henerasyonBagama't ang mga modelong komersyal na makukuha ay naglalaman lamang ng isang bahagi ng mga kakayahang ito, na may karagdagang mga limitasyon na idinisenyo upang mabawasan ang mga panganib, ang paghihiwalay na ito sa pagitan ng mga modelong "eksperimento" at "produksyon" ay maaaring maging isang makatwirang pamamaraan para sa maraming organisasyong Europeo na interesado sa paggamit ng AI nang hindi nasa unahan ng pagkakalantad, kung mayroong sapat na transparency tungkol sa mga aktwal na kakayahan ng bawat sistema.

Ang sa huli ay lumilitaw ay isang senaryo kung saan Ang cybersecurity ay ganap na pumapasok sa panahon ng malawakang opensiba at nagtatanggol na AINangangako ang mga kagamitang tulad ng Mythos na mapapabilis ang pagtukoy sa mga kahinaan sa mga sistemang matagal nang gumagana, ngunit pinipilit din nito ang muling pag-iisip kung paano ipinamamahagi at pinamamahalaan ang teknolohiyang sumusuporta sa digital na ekonomiya. Para sa Europa at Espanya, ang hamon ay hindi lamang ang pagprotekta sa kanilang sarili mula sa lalong lumalakas na mga modelo, kundi pati na rin ang pagtiyak na hindi sila naiwan sa mga mekanismo na nagpapahintulot sa kanila na magamit upang palakasin ang kanilang sariling seguridad.

estratehiya sa cybersecurity
Kaugnay na artikulo:
Istratehiya sa cybersecurity: mga susi, balangkas at praktikal na aplikasyon

Idagdag bilang ginustong mapagkukunan