Mahigit 20 organisasyon ang lumitaw sa mga plano ng pag-target sa isang pinaghihinalaang operasyon ng paniniktik na may kaugnayan sa Russia na gumamit ng artificial intelligence sa phishing, pagbuo ng malware, pagnanakaw ng kredensyal at pag-exfiltration ng data, ayon sa isang bagong ulat ng banta mula sa Anthropic. Inilalarawan ng pagsisiwalat noong Setyembre 10 ang isang mas malawak na pagbabago mula sa mga kriminal na humihingi ng payo sa mga chatbot patungo sa mga ahente ng AI na nagsasagawa at nagko-coordinate ng malaking bahagi ng mga totoong operasyon sa cyber.

Sinabi ng Anthropic na natukoy at naantala nito ang maling paggamit ng mga modelong Claude nito sa pagitan ng Disyembre 2025 at Agosto 2026 sa pitong kategorya: mga operasyon sa cyber, pagmamatyag, mga kampanya sa impluwensya, pandaraya, maling paggamit ng biyolohikal, paggamit ng mga kumbensyonal na armas at hindi awtorisadong pag-distill ng modelo. Sa ilang mga kaso sa cyber, ang mga multi-agent system ay nagsagawa ng pagmamanman, pagsasamantala at pagnanakaw nang sabay-sabay habang ang mga tao ay pumipili ng mga target at sinusuri ang mga resulta. Hindi nito ginagawang awtonomiya ang mga pag-atake sa bawat makabuluhang kahulugan, ngunit binabago nito ang kanilang bilis, tauhan at ekonomiya.

Mahalaga ang mga natuklasan dahil inilalarawan ng mga ito ang naobserbahang aktibidad sa halip na isang pagtataya sa laboratoryo. Nangangailangan din ang mga ito ng pag-iingat. Pinili ng Anthropic ang mga kaso, inimbestigahan ang aktibidad sa sarili nitong platform at itinago ang maraming pangalan at teknikal na detalye. Karamihan sa mga paratang ay hindi pa nakapag-iisa na na-verify, at binigyang-diin ng kumpanya na ang mga halimbawa ay hindi pangkaraniwan sa halip na kumakatawan sa ordinaryong paggamit ni Claude. ng AP na sinabi ng Anthropic na ipinagbawal nito ang mga natukoy na account at ibinahagi ang impormasyon sa mga awtoridad at mga kasosyo sa industriya.

Lumilipat ang AI mula sa katulong patungo sa operator

Ang pangunahing pahayag sa teknolohiya ng ulat ay ang AI ay tumatawid mula sa pagbuo ng nilalaman patungo sa pagkontrol sa operasyon. Sinabi ng Anthropic na karamihan sa mga inilarawang cyber campaign ay gumamit ng mga modelo para sa direktang pagpapatupad o orkestrasyon, hindi lamang para sa pagbalangkas ng code. Maaaring siyasatin ng mga ahente ang kapaligiran ng biktima, magsulat at magpatakbo ng mga script, bigyang-kahulugan ang mga resulta, baguhin ang mga taktika at magpatuloy hanggang sa makamit ang isang mas malawak na layunin.

Isang panghihimasok na may motibasyon sa pananalapi ang umano'y lumala mula sa isang ninakaw na developer token patungo sa administratibong kontrol ng isang cloud environment sa loob ng humigit-kumulang tatlong oras. Isa pang operasyon ang kumuha ng datos na pagmamay-ari ng humigit-kumulang 200 downstream customer ng isang nakompromisong software provider at nakalap ng mahigit 2,100 cloud access token na sumasaklaw sa mahigit 40 corporate tenant sa loob ng humigit-kumulang 34 na oras. Sinabi ng Anthropic na ang mga AI agent ang nagsagawa ng halos lahat ng trabaho sa cluster na iyon, bagama't nanatiling responsable ang mga tao sa pagpili ng mga biktima at pagkita ng pera sa mga ninakaw na materyal.

Karaniwang pamilyar ang mga pamamaraan mismo: mga nakalantad na kredensyal, phishing, mga hindi na-patch na serbisyo, mga malisyosong script at pang-aabuso sa mga lehitimong cloud interface. Ang nagbago ay ang paggawang kinakailangan upang ikonekta ang mga hakbang na iyon. Sa halip na italaga ang pagmamanman, pag-coding, pagsasamantala at pagproseso ng data sa ilang mga espesyalista, maaaring italaga ng isang operator ang karamihan sa pagkakasunod-sunod na iyon sa isang modelo na tumatakbo sa pamamagitan ng mga tool ng software. Ang resulta ay hindi kinakailangang isang bagong uri ng kahinaan; ito ay isang mas mababang gastos sa bawat pagtatangkang paglabag.

Ang pagkakaibang iyan ay naaayon sa ng Reuters na ang mga tao ay kadalasang gumaganap bilang mga superbisor sa halip na mga hands-on na operator. Hindi nakapag-iisang nagpapasya ang AI kung sino ang aatakehin o bakit. Pinalawak nito ang dami ng teknikal na gawaing maaaring gawin ng isang maliit na grupo, na nagpapahintulot sa maraming target at nagbabagong kapaligiran na mapangasiwaan nang sabay-sabay.

Ipinapakita ng isang kampanyang may kaugnayan sa Russia ang mekanismo

Iniugnay ng Anthropic ang isang operasyon sa isang aktor na nagsasalita ng Ruso na ang pag-uugali at mga target ay naaayon sa pampublikong pag-uulat sa Midnight Blizzard, isang grupong iniuugnay ng Estados Unidos at Britanya sa Foreign Intelligence Service ng Russia. Ang operasyon ay lubos na nakatuon sa mga target ng gobyerno ng Ukraine, militar at diplomatiko, pati na rin sa mga gumagawa ng drone, mga embahada, mga organisasyon ng depensa at mga taong konektado sa patakarang panlabas ng US.

Diumano'y ginamit ng aktor ang AI upang lumikha ng imprastraktura ng phishing, magpatakbo ng mga utos laban sa mga nakompromisong sistema, mangolekta ng mga kredensyal, lumipat sa mga network at mag-organisa ng malalaking volume ng ninakaw na data. Minomonitor ng mga tool nito kung natukoy ng mga produktong pangseguridad ang malware; kapag natukoy nila, binabago at muling binubuo ng mga ahente ang code hanggang sa muli nitong naiwasan ang mga depensang iyon. Nagbabanta ang closed-loop na prosesong iyon na paikliin ang panahon kung saan ang isang bagong deploy na pag-detect ay maaasahang nagpapataw ng mga gastos sa isang attacker.

Sinusuportahan ng independiyenteng pag-uulat ang mahahalagang bahagi ng konteksto ng kampanya. Noong Hulyo, ng Microsoft ang isang kaugnay na operasyon na nakompromiso ang mga network ng hospitality, minamanipula ang trapiko ng captive-portal at naghatid ng malware sa pamamagitan ng mga pekeng update prompt. Sinabi ng Microsoft na ginamit ng aktor ang AI sa isang malaking bahagi ng kampanya at pinasalamatan ang Anthropic at OpenAI sa pagtulong sa imbestigasyon nito.

Mahalaga ang pagsasanib dahil nagbibigay ito ng ebidensya sa labas ng sariling telemetry ng Anthropic para sa aktor, imprastraktura, at mga taktika. Hindi nito independiyenteng kinukumpirma ang bawat bagong pahayag sa ulat ng Anthropic. Ang pagpapatungkol sa cyberespionage ay likas na probabilistiko, at gumamit ang ulat ng panloob na pagtatalaga para sa naobserbahang operator. Ang pinakaligtas na konklusyon ay maraming kumpanya ang nakakita ng konektadong aktibidad na nakahanay sa Russia gamit ang AI upang mapabilis ang mga naitatag na pamamaraan ng panghihimasok.

Pinalalawak ng mga gawain ng pagmamatyag at armas ang panganib

Ang ulat ay higit pa sa mga panghihimasok sa network. Sinabi ng Anthropic na ginamit ng mga aktor na may kaugnayan sa gobyerno si Claude upang bumuo ng mga sistema ng pagmamatyag, pag-aralan ang mga rekord ng social media at tukuyin ang mga potensyal na target. Sa isang halimbawa, isang consultant na nagtatrabaho para sa mga awtoridad sa seguridad ng Malian ang umano'y nagdisenyo ng isang sistemang may kakayahang mangolekta ng data mula sa mga mobile operator at gumawa ng mga indibidwal na dossier. Sa isa pa, isang tanggapan ng paniktik sa mga usaping pangrelihiyon ng Tsina ang iniulat na gumamit ng isang AI assistant upang gumawa ng libu-libong imbestigasyon bawat buwan.

ng Axios na ang mga kaso ng surveillance ay gumamit ng mga mas lumang modelo ng Haiku, Sonnet o Opus sa halip na ang mas bagong mga sistema ng Fable o Mythos-class ng Anthropic. Sinabi ng Anthropic na isinara nito ang mga account, ngunit kinilala ng pinuno ng threat-intelligence nito na ang ilang mga operator ay lumipat sa mga lokal na naka-host o bukas na mga modelo. Samakatuwid, ang pagpapatupad ng platform ay maaaring magpataas ng mga gastos nang hindi kinakailangang wakasan ang pinagbabatayang programa.

Inilarawan din ng Anthropic ang limang kaso na kinasasangkutan ng pananaliksik sa biyolohiya na maaaring magkaroon ng parehong kapaki-pakinabang at mapanganib na gamit. Ang isa ay kinasasangkutan ng pagpaplano ng mga eksperimento na may kaugnayan sa pagkahawa ng chikungunya at pag-iwas sa immune system; ang isa naman ay tungkol sa adaptasyon mula sa avian influenza. Malinaw na sinabi ng kumpanya na hindi nito alam kung may balak ba ang mga siyentipiko na makapinsala at itinago ang kanilang mga pagkakakilanlan at mga bansa. Binanggit ng Guardian na ipinakita ng kumpanya ang mga ito bilang mga potensyal na panganib na may dalawang gamit, hindi ebidensya na may ginawang biyolohikal na armas.

Mahalaga ang mga limitasyon. Ang isang modelo na tumutulong sa pagbalangkas ng isang aplikasyon para sa grant ay hindi katulad ng pagsasagawa ng gawaing laboratoryo, at ang isang nakababahalang tanong ay hindi nagpapatunay ng kakayahan sa pagpapatakbo. Gayunpaman, sinabi ng Anthropic na hindi na nito maibibigay ang parehong katiyakan ng limitadong tulong biyolohikal na ginawa nito tungkol sa mga lumang sistema. Nagpakilala ang kumpanya ng mas malawak na mga paghihigpit para sa mga mas bagong modelo, kabilang ang isang balangkas ng pananggalang na idinisenyo upang mabawasan ang mapaminsalang tulong sa cyber at siyentipiko.

Ang pagkuha ng modelo ay nagiging isang operasyong pang-industriya

Ang isang hiwalay na bahagi ng ulat ay tungkol sa mga kumpanyang umano'y nagtatangkang gayahin ang mga kakayahan ni Claude. Iniugnay ng Anthropic ang mahigit 151 milyong palitan sa pagitan ng Mayo at Hulyo sa isang kampanya ng distilasyon na nauugnay sa Alibaba, na umabot sa halos 3 milyong interaksyon kada araw sa libu-libong account. Ang distilasyon ay maaaring isang lehitimong paraan ng pagsasanay, ngunit inilarawan ng Anthropic ang aktibidad na ito bilang palihim at hindi awtorisadong pag-access na idinisenyo upang kopyahin ang mga kakayahan sa pangangatwiran na may pagmamay-ari.

Inakusahan din ng kumpanya ang Moonshot at DeepSeek ng pagruruta ng mga live na kahilingan ng customer sa pamamagitan ni Claude habang naniniwala ang mga user na nakikipag-ugnayan sila sa mga modelo ng mga kumpanyang iyon. Ang ilang mga prompt ay umano'y naglalaman ng sensitibong impormasyon sa komersyo, gobyerno o militar. ng Business Insider na ang pinagsamang aktibidad na inilarawan ng Anthropic ay umabot sa 190 milyong interaksyon. Ang mga pinangalanang kumpanya ay hindi nagbigay ng mga detalyadong tugon sa publiko nang mailathala ang mga ulat.

Ito ay parehong isang hindi pagkakaunawaan sa intelektwal na ari-arian at isang problema sa privacy. Kung ang isang serbisyo ay tahimik na nagpapasa ng mga prompt ng customer sa isang ikatlong partido, maaaring mawalan ng kontrol ang mga user sa kung saan pinoproseso ang sensitibong materyal. Para sa mga AI provider, ang paghinto sa kasanayan ay nangangailangan ng higit pa sa pagharang sa mataas na volume ng trapiko: ang mga naiulat na operator ay gumamit ng mga residential proxy, disposable account, virtual card at ninakaw na API credentials upang maging katulad ng ordinaryong demand.

Ang mga tagapagtanggol ay nangangailangan ng iba't ibang sukat

Ipinahihiwatig ng ulat na ang mga tradisyunal na indikasyon ng sopistikasyon ng mga umaatake ay nagiging hindi gaanong maaasahan. Ang pinakintab na code, mabilis na pag-aangkop, at sabay-sabay na mga kampanya ay dating nagpapahiwatig ng isang malaki o lubos na may kasanayang koponan. Maaari na ngayong kopyahin ng mga sistemang ahente ang ilan sa mga katangiang iyon para sa mas maliliit na grupo. Kakailanganing sukatin ng mga pangkat ng seguridad ang pag-ulit na bilis ng makina, koordinadong aktibidad ng API, pang-aabuso sa token, at hindi pangkaraniwang mga pagkakasunud-sunod ng tool sa halip na maghinuha ng kakayahan pangunahin mula sa maliwanag na kalidad ng malware.

Nahaharap din ang mga kompanya ng AI sa problema ng transparency. Taglay nila ang pinakamalinaw na ebidensya ng pang-aabuso sa antas ng plataporma, ngunit mayroon silang mga komersyal na insentibo upang bigyang-diin ang matagumpay na pagtuklas at mabawasan ang hindi natukoy na pinsala. Ang mga independiyenteng mananaliksik at gobyerno ay bihirang magkaroon ng katumbas na access sa mga prompt, account network, at internal classifier. Samakatuwid, ang kapaki-pakinabang na pagsisiwalat ay nangangailangan ng sapat na teknikal na detalye para sa panlabas na patunay nang hindi naglalathala ng mga tagubilin na nagpapadali sa mga pag-atake.

Hindi pinatutunayan ng ulat ng Anthropic na napalitan na ng AI ang mga bihasang umaatake o na karamihan sa cybercrime ay nagsasarili. Ipinapakita nito ang maraming operasyon kung saan binawasan ng mga modelo ang kinakailangang paggawa upang lumipat mula sa ninakaw na access patungo sa pagsasamantala at pagnanakaw. Ang praktikal na pagsubok ngayon ay kung matutukoy ba ng mga provider at tagapagtanggol ang koordinadong pag-uugali ng ahente nang kasingbilis ng kakayahang iakma ito ng mga umaatake. Itinatag ng mga kaso noong Setyembre na ang paligsahan ay gumagana na, hindi haka-haka lamang.