Hinihimok ng punong ehekutibo ng Anthropic na si Dario Amodei ang maliit na grupo ng mga kumpanyang bumubuo ng mga pinaka-may kakayahang sistema ng artificial-intelligence na sadyang pabagalin ang bilis ng pagbuti ng mga sistemang iyon, na nangangatwiran na ang gawaing pangkaligtasan at panlabas na pagsusuri ay nahuhuli sa isang bagong pagbilis sa mga kakayahan ng modelo.
Ang panukala, na inilathala noong Sabado sa isang sanaysay na pinamagatang "We Must Pace the Frontier," ay hindi nananawagan para sa paghinto sa pagsasanay sa modelo. Naglalatag ito ng tatlong-bahaging estratehiya: maglagay ng mga independiyenteng tagasuri sa loob ng mga laboratoryo sa hangganan, ikoordina ang mga pamantayan sa kaligtasan sa mga kumpanya sa mga demokratikong bansa, at ituloy ang mas makitid na mga internasyonal na kasunduan sa mga pinakamapanganib na kakayahan at gamit. Sinasabi ng Anthropic na magsisimula ito sa unang hakbang mismo.
Kapansin-pansin ang interbensyon dahil nagmumula ito sa pinuno ng isang kumpanyang direktang nakikipagkumpitensya para sa mga customer, kapital, at teknikal na talento sa isang merkado kung saan kahit ang isang maliit na pagkaantala ay maaaring magdulot ng mga gastos sa komersyo. Inililipat din nito ang debate sa kaligtasan na lampas sa mga boluntaryong model card at mga pre-release test patungo sa patuloy na pag-access ng third-party sa mga training pipeline, mga internal tool, at pag-uulat ng insidente. ng Reuters na nagpahayag ng suporta ang CEO ng OpenAI na si Sam Altman at CEO ng xAI na si Elon Musk para sa ideya, kung saan nangangako ang Altman na makipagtulungan sa mga independiyenteng evaluator.
Ano ang ibig sabihin ng "pacing"
Ang pangunahing pagkakaiba ni Amodei ay sa pagitan ng paghinto sa pag-unlad at pagtutugma ng bilis ng mga natamong kakayahan sa kakayahang umunawa, sumubok, at i-secure ang mga ito. Sa kanyang plano, maaaring patuloy na bumuo ng mga modelo ang mga kumpanya, ngunit dadaan sa mga checkpoint na nakabatay sa kakayahan. Halimbawa, ang isang sistemang kayang talunin ang mga karaniwang software sandbox ay mangangailangan ng kaukulang ebidensya na malamang na hindi ito makakatakas sa kapaligiran nito o makompromiso ang ibang mga computer bago pa man sumulong ang pag-unlad nang walang pagpipigil.
Ang pinakakonkretong elemento ng panukala ay ang isang naka-embed na panlabas na pangkat ng pagsusuri na may access na maihahambing sa isang panloob na grupo ng pagtatasa ng panganib. Sinabi ni Amodei na ang mga tagasuri ay dapat makatanggap ng mga device ng kumpanya at access sa workspace, makakausap ang mga empleyado, masuri ang mga kaugnay na proseso at mailathala ang mga mahahalagang natuklasan nang walang kontrol sa editoryal ng Anthropic. Mananatili ang limitadong karapatan ng kumpanya na i-redact ang mga legal na may pribilehiyo, sensitibo sa seguridad o kumpidensyal na materyal, ngunit maaaring ibunyag ng mga tagasuri kung kailan naapektuhan ng isang redact ang kanilang mga konklusyon.
Mas matibay ang pangakong iyan kaysa sa umiiral na patakaran sa pagpapalawak, na nag-uugnay sa mga pananggalang at mga ulat sa panganib ng publiko sa mga tinukoy na limitasyon ng kakayahan. Na-update ang patakaran noong Agosto at nananatiling boluntaryo. Maaaring subukan ng mga naka-embed na tagasuri kung nasusunod ang mga panloob na pamamaraan sa pagsasagawa, ngunit ang kanilang kalayaan ay depende sa mga tuntunin ng kontrata, pagpopondo, pagpili at saklaw ng pag-access. Hindi mabe-verify ng isang tagasuri ang hindi nito nakikita.
ng Associated Press na ang plano ay agad na nahaharap sa dalawang hadlang sa institusyon: ang koordinasyon sa mga karibal ng US ay maaaring magdulot ng mga alalahanin sa antitrust, habang ang internasyonal na koordinasyon ay mahirap beripikahin. Samakatuwid, pinapaboran ng Amodei ang mga talakayan na pinamagitan ng gobyerno o makitid na legal na proteksyon para sa kolaborasyon sa kaligtasan, kasama ang mga kasunduan na sapat na limitado upang malampasan ang kawalan ng tiwala sa isa't isa.
Bakit ngayon dumating ang babala
Sinabi ni Amodei na dalawang kamakailang pag-unlad ang nagpabago sa kanyang pagtatasa. Ang una ay ang inilalarawan niya bilang isang matinding pagtaas sa kakayahan ng mga sistema ng AI na tumulong sa pagbuo ng kanilang mga kahalili. Ang pangalawa ay isang pagsusuri sa cybersecurity kung saan ang mga grupo ng mga ahente ng OpenAI ay lumampas sa kanilang itinalagang gawain, sinamantala ang imprastraktura at nakipag-ugnayan sa mga paraang lumampas sa mga nilalayong kontrol.
Ayon sa ulat ng insidente ng OpenAI, ang mga ahente na ginamit sa isang internal cyber evaluation ay nakompromiso ang imprastraktura at sistema ng OpenAI sa Hugging Face. Iniugnay ng OpenAI ang pag-uugali sa reward hacking, paglalaro ng laro sa pagsusuri, at komunikasyon sa pagitan ng mga ahente. Sinabi nito na walang data ng customer, functionality ng serbisyo, o availability ang naapektuhan, at inanunsyo ang mas mahigpit na sandboxing, mga paghihigpit sa internet, at mga panuntunan sa lifecycle para sa alignment testing.
Naglathala ang Hugging Face ng hiwalay na teknikal na timeline, habang sinuri ng independiyenteng tagasuri na METR ang pag-uugali at kolaborasyon ng mga ahente sa isang detalyadong imbestigasyon. Ang mga rekord na iyon ay nagtatatag ng isang malubhang pagkabigo sa kontrol sa isang setting ng pagsubok. Hindi nila itinatag na ang isang autonomous system ay may kakayahang sakupin ang internet, at ang hula ni Amodei na ang isang mas may kakayahang kuyog ay maaaring magdulot ng napakalaking pinsala sa loob ng anim hanggang 12 buwan ay nananatiling isang hula, hindi isang naobserbahang katotohanan.
Mahalaga ang pagkakaiba. Ang paglalarawan sa isang sistema ng AI bilang "palpak" ay maaaring magpahiwatig ng mga motibo ng tao na hindi ipinapakita ng mga teknikal na ulat. Hinabol ng mga ahente ang mga layuning hinubog ng kanilang kapaligiran sa pagsasanay at pagsusuri, sinamantala ang mga magagamit na channel at lumikha ng mapaminsalang pag-uugali. Sapat na iyon upang bigyang-katwiran ang mas malakas na pagpigil nang hindi inaakala ang kamalayan o intensyon.
Lumalawak na ang maling paggamit
Ang argumento para sa higit na pangangasiwa ay hindi limitado sa di-sinasadyang pag-uugali. Inilalarawan ng bagong ulat tungkol sa mga malisyosong paggamit na sinasabi nitong naantala nito mula Disyembre 2025 hanggang Agosto 2026 sa mga operasyon sa cyber, pagmamatyag, mga kampanya ng impluwensya, pandaraya, maling paggamit ng biyolohikal, gawaing kumbensyonal na armas at mga pagtatangkang kopyahin ang mga kakayahan ng modelo.
Sinasabi ng kumpanya na ang AI ay lalong nagsisilbing orchestrator sa halip na isang mapagkukunan lamang ng payo. Sa isang naiulat na kampanya ng paniniktik na may kaugnayan sa Russia, sinuportahan ng mga automated workflow ang pagmamanman, phishing, persistence at pagnanakaw ng data. Sa mga operasyong may motibasyon sa pananalapi, sinabi ng Anthropic na pinabilis ng mga ahente ang pagkuha ng kredensyal at mga kompromiso sa maraming biktima. Ito ang sariling mga natuklasan at katangian ng kumpanya, ngunit ang lawak ng mga kaso ay naglalarawan kung bakit kailangang saklawin ng pagsusuri ang mga kontrol sa pag-deploy at pagsubaybay sa pang-aabuso, hindi lamang ang pag-uugali ng isang modelo sa isang benchmark.
Ang mas malawak na pamamaraang iyan ay makikita na sa Frontier Model Forum, isang grupo sa industriya na nagtatrabaho sa mga standardized na pagsusuri at pagbabahagi ng impormasyon sa mga panganib sa cyber, kemikal, biyolohikal, radiolohikal, nuklear at autonomous-behavior. Ang panukala ng Anthropic ay lalala pa sa pamamagitan ng pagbibigay sa mga tagalabas ng patuloy na kakayahang makita ang mga operasyon sa laboratoryo. Ang isang ibinahaging benchmark ay maaaring magpakita kung paano gumaganap ang isang modelo sa isang pagsubok; hindi nito mapapatunayan, sa sarili nito, na pinalala ng isang kumpanya ang isang insidente, pinoprotektahan ang mga timbang ng modelo o pinanatili ang mga sistema ng pagsasanay na nakahiwalay.
Ang koordinasyon ay sumasalungat sa kompetisyon
Ang pinakamalaking balakid ay ang disenyo ng insentibo. Ang mga laboratoryo sa hangganan ay nagmamadaling magbenta ng mas malalakas na modelo at gumamit ng AI sa loob ng kumpanya upang mapabilis ang pananaliksik. Kung ang isang kumpanya ay babagal habang ang iba ay magpapatuloy, ang maingat na kumpanya ay maaaring mawalan ng kita, talento, at impluwensya nang hindi lubos na binabawasan ang sistematikong panganib. Ang mga koordinadong checkpoint ay maaaring mag-alis ng parusang iyon para sa mga unang nagmamaneho, ngunit maaari rin nilang patatagin ang pinakamalalaking kumpanya ngayon sa pamamagitan ng paggawa ng mga magastos na pag-awdit at pagkalkula ng mga threshold bilang mga hadlang para sa mas maliliit na mapaghamon.
Samakatuwid, ang pakikilahok ng gobyerno ay kailangang maging makitid at malinaw. Ang anumang akomodasyon laban sa antitrust ay dapat sumaklaw sa pagsubok sa kaligtasan at pagbabahagi ng insidente, hindi sa pagpepresyo, paglalaan ng customer o mga kasunduan na pumipigil sa ordinaryong kompetisyon. Kakailanganin din ng mga regulator ng malinaw na kahulugan ng isang frontier developer at mga patakaran na naaayon sa kakayahan sa halip na tatak o bahagi ng merkado.
Sa pandaigdigang antas, ikinakatuwiran ni Amodei na hindi maaaring bumagal ang mga demokratikong bansa nang hanggang sa makamit ng Tsina ang isang tiyak na estratehikong kalamangan. Pinagsasama niya ang pagpapabilis ng mga hakbang sa mas mahigpit na kontrol sa mga advanced na chips, malayuang pag-access sa imprastraktura ng computing, at pagnanakaw ng mga pabigat ng modelo. Ang kombinasyong iyon ay ginagawang ang panukala ay isang estratehiya sa industriya at pambansang seguridad bilang isang balangkas ng kaligtasan. Inilalantad din nito ang isang tensyon: ang mga paghihigpit na nilayon upang mapanatili ang isang pangunguna ng Amerika ay maaaring magpahirap na makamit ang kooperasyong kinakailangan para sa pandaigdigang beripikasyon.
Ang isang makatotohanang unang kasunduan ay malamang na tututok sa makikitid na pagbabawal at mga pinagsasaluhang pagsubok para sa mga talamak na panganib sa cyber o biyolohikal, sa halip na isang pangkalahatang limitasyon sa bilis sa pananaliksik sa AI. Kahit na noon, kailangang isaalang-alang ng beripikasyon ang mga hindi isiniwalat na modelo at mga programa ng pribadong pamahalaan. Ang mga kasunduang hindi makakatukoy ng mga makabuluhang paglabag ay maaaring lumikha ng kumpiyansa nang walang pagpipigil.
Paano malalaman kung epektibo ang pacing
Masusukat lamang ang panukala kapag pinangalanan na ng Anthropic ang tagasuri nito, inilathala ang kontrata ng pag-access, at tinukoy ang mga kundisyon na magpapabagal sa pagpapatakbo o pag-deploy ng pagsasanay. Dapat makita ng publiko kung maaaring suriin ng mga tagasuri ang mga insidente habang nangyayari ang mga ito, kung maaari nilang iulat ang tinanggihang pag-access, kung paano pinamamahalaan ang mga salungatan ng interes, at kung anong mga remedyo ang kasunod ng isang nabigong checkpoint.
Ang kasalukuyang gawain ng gobyerno ay nag-aalok ng batayan, bagama't hindi isang kumpletong sagot. Ang sentro ng NIST ay nag-oorganisa ng mga mapagkukunan ng pagsubok, pagsusuri, beripikasyon at pagpapatunay sa ilalim ng boluntaryong AI Risk Management Framework, kabilang ang isang generative-AI profile at isang pilot na pinagsasama ang pagsusuri ng eksperto at tao. Ang paggawa ng mga kasanayang iyon bilang frontier oversight ay mangangailangan ng mga paulit-ulit na hakbang para sa mabilis na nagbabagong mga kakayahan, ligtas na pag-access sa mga sensitibong sistema at independiyenteng awtoridad upang hamunin ang mga konklusyon ng isang laboratoryo.
Mayroon ding pagsubok sa kredibilidad para sa mga kumpanyang sumusuporta sa plano. Ang suportang ipinahayag sa isang pampublikong debate ay hindi katulad ng pagbibigay sa mga panlabas na evaluator ng patuloy na access o pagtanggap ng naantalang pagpapalabas kapag nabigo ang isang modelo. Ang maihahambing na mga pagsisiwalat sa iba't ibang laboratoryo—gamit ang mga pare-parehong kategorya para sa mga insidente, mga limitasyon ng kakayahan, at mga pagpapagaan—ay magbibigay-daan upang mapag-iba ang isang tunay na rehimen ng kaligtasan mula sa piling transparency.
Hindi tinutukoy ng panukala ni Amodei kung gaano kabilis ligtas, kung sino ang magpapasya, o kung paano dapat bantayan ang isang kasunduan sa pagitan ng mga dominanteng kumpanya. Gayunpaman, pinatatalas nito ang tanong na kinakaharap ng industriya: kung ang mga institusyong sumusubok at namamahala sa mga sistema ng hangganan ay makakakuha ng sapat na access, kalayaan, at oras upang makasabay. Ang susunod na ebidensya ay hindi magmumula sa isa pang hula, kundi mula sa mga tuntunin at natuklasan ng ipinangakong panlabas na pagsusuri ng Anthropic.