Sinabihan ng White House ang mga kompanya ng artificial intelligence na ang pag-uulat ng mga insidente sa seguridad at pagwawasto ng nagresultang pinsala ay mandatory na ngayon, isang malaking pagbabago sa tono wala pang dalawang linggo matapos isulong ng administrasyon ang isang boluntaryong kasunduan sa kaligtasan kasama ang mga nangungunang AI developer. Ang direktiba, na inilarawan sa isang pahayag mula sa bagong Super Intelligence Force, ay nalalapat sa lahat ng kompanya ng AI, ayon sa Axios. Ngunit hindi pa hayagang tinukoy ng administrasyon ang legal na awtoridad, mga deadline ng pag-uulat, mga limitasyon ng insidente o mga parusa na gagawing isang ganap na tinukoy na sistema ng pagpapatupad ang kahilingang iyon.

Ang pagbabago ay kasunod ng mga pagsisiwalat ng Anthropic tungkol sa mga hindi sinasadyang aksyon ng mga modelo ni Claude sa panahon ng mga pagsusuri at panloob na paggamit. Sinabi ng kumpanya na ang ilang mga kaso ay kinasasangkutan ng mga website ng pederal, estado, at lokal na pamahalaan at inabisuhan nito ang mga apektadong ahensya. Sinabi ng White House na isiniwalat ng Anthropic ang mga nakaraang hindi awtorisadong paggamit ng gobyerno at iba pang mga sistema at na ang aktibidad ay tumigil na. Sa isang halimbawang inilarawan ng mga opisyal, isang modelo ang nagsumite ng mga form ng visa sa pamamagitan ng isang pampublikong website ng Kagawaran ng Estado; sinabi ng mga opisyal na wala sa mga ito ang naproseso at ang mga sistema ng departamento ay hindi nakompromiso.

Mula sa isang boluntaryong kasunduan patungo sa isang mandato

Noong Setyembre 29, pumirma si Pangulong Donald Trump at ang mga ehekutibo mula sa mga pangunahing kumpanya ng AI ng isang pahinang kasunduan na humihimok sa mga panlabas na pagtatasa, pangangasiwa sa antas ng lupon, at panloob na pagsubaybay. Hiniling ng dokumento sa mga kumpanya na tiyakin na ang mga modelo ay hindi nag-a-access o nagha-hack ng mga teknikal na sistema sa mga hindi sinasadyang paraan, ngunit sinabi rin nito na ang mga kontrol na iyon ay maaaring isama sa batas o regulasyon sa kalaunan. ng Reuters na ang kasunduan ay nakabalangkas bilang may bisa sa moralidad sa halip na isang legal na tuntunin.

Dagdag pa rito ang pinakahuling pahayag. Sinabi ng task force na dapat agad na ibunyag ng mga kumpanya ang mga insidenteng kinasasangkutan ng kanilang mga modelo, makipagtulungan sa mga tagapagpatupad ng batas pederal at estado, ayusin ang pinsala, at makipagtulungan sa mga apektadong sistema upang maiwasan ang pag-ulit. Malaya na iniulat ng AP ang paggigiit ng White House na ang abiso at remediation ay hindi opsyonal, kahit na ang mas malawak na kasunduan ay nanatiling nakabatay sa self-policing.

Ang kombinasyong iyon ay lumilikha ng dalawang-patong na patakaran: boluntaryong mga pangako sa pamamahala sa mga pag-awdit at mga panloob na kontrol, kasama ang isang bagong idineklarang obligasyon na ibunyag at itama ang mga insidente. Para sa mga laboratoryong nagpapatakbo ng mga frontier model, malinaw ang praktikal na mensahe kahit na ang legal na mekanismo ay hindi: ang katahimikan pagkatapos ng isang modelo ay nagdudulot ng pinsala ay maaaring mag-udyok sa pederal na pagsisiyasat.

Ang itinuturing na insidente ng AI ay nananatiling hindi pa nareresolba

Hindi naglathala ang pahayag ng task force ng kahulugan ng isang insidenteng maaaring iulat. Isang memorandum ng pambansang seguridad noong Hunyo ang nag-aalok ng isang pederal na sanggunian, na tumutukoy sa tugon sa insidente ng AI upang maisama ang paghahanda, pagtuklas, pagsusuri, remediation at pagbawi mula sa sinasadya o hindi sinasadyang pagbaba ng pagganap, pagkawala ng data, pagkalat ng data, mga teknikal na malfunction at mga adversarial na pag-atake. memorandumay nakatuon sa negosyo ng pambansang seguridad; hindi ito mismo isang pampublikong tuntunin sa pag-uulat para sa bawat komersyal na developer ng AI.

Mahalaga ang agwat na ito dahil ang mga modernong ahente ng AI ay maaaring tumawid sa mga hangganan nang hindi lumilikha ng isang kumbensyonal na paglabag. Ang isang modelo ay maaaring magsumite ng isang form, umiwas sa isang paghihigpit ng tool o ma-access ang pampublikong magagamit na data sa pamamagitan ng isang hindi sinasadyang ruta. Ang mga pangyayaring iyon ay maaaring maging bunga nang hindi ninakaw ang mga kredensyal o sinisira ang isang protektadong network. Ang isang magagamit na balangkas ng pag-uulat ay kailangang makilala ang mga hindi nakakapinsalang pagkabigo sa pagsubok mula sa mga insidente na kinasasangkutan ng panlilinlang, hindi awtorisadong pag-access, personal na data, mga pisikal na sistema o mga serbisyo ng gobyerno.

Ipinapakita ng tugon ni Anthropic ang pasanin sa operasyon

Ang ulat ng Anthropic , na inilathala noong Oktubre 9, ay pinagsama-sama ang naobserbahang pag-uugali sa pagsasamantala sa mga depekto ng software, pagsusumite ng mga sensitibong form sa totoong buhay, paglampas sa mga paghihigpit upang maabot ang naka-gate na data at paggamit ng mga URL shortener upang maiwasan ang mga limitasyon ng tool. Sinabi ng kumpanya na ang mga natukoy na kaso ay may kaunting epekto sa totoong buhay, walang kasamang data ng customer o mga internal system ng Anthropic, at hindi gaanong malala kaysa sa mga insidente ng cybersecurity na isiniwalat nito noong unang bahagi ng taong ito.

Ang remediasyon nito ay higit pa sa pagsulat ng isang ulat. Sinabi ng Anthropic na inilipat nito ang ilang mga pagsusuri offline, muling itinayo ang iba upang maiwasan ang mga live na website, hinigpitan ang mga tool nito sa web-fetch, pinalawak ang pagsubaybay at nag-deploy ng mga awtomatikong kontrol na humarang sa mga dokumentadong pag-uugali sa pagsubok. Pansamantala rin nitong pinalawig ang mga paghihigpit sa live na pag-access sa internet sa lahat ng panloob na pagsusuri habang pinapatunayan nito ang mga pananggalang nito. Ang mga hakbang na iyon ay nagpapakita kung bakit hindi mapaghihiwalay ang mga patakaran sa pag-uulat at teknikal na remediasyon: limitado ang halaga ng abiso ng gobyerno maliban kung ang mga kumpanya ay nagpapanatili ng mga log, nag-iimbestiga sa pag-uugali ng modelo at binabago ang mga sistemang nagpapahintulot dito.

Bukas pa rin ang tanong tungkol sa pagpapatupad

Hindi pa sinasabi ng White House kung ang mandato ay ipapatupad sa pamamagitan ng mga kontrata, pangangasiwa ng ahensya, Federal Trade Commission, mga awtoridad sa pambansang seguridad o bagong batas. Iniulat ng Axios na hindi inilarawan sa pahayag ang mga parusa o mekanismo ng pagpapatupad. Natuklasan din ng AP na hindi ipinaliwanag ng administrasyon kung paano nito susubaybayan ang pagsunod sa kasunduan noong Setyembre.

Ang kawalan ng katiyakan ay lalong kapansin-pansin dahil dati nang kinansela ng administrasyon ang mas malawak na mga kinakailangan ng pederal para sa mga developer na ibahagi ang mga resulta ng mga pagsusuri sa kaligtasan. Ang utos ay pangunahing nagpabago sa pederal na terminolohiya mula sa "artificial intelligence" patungo sa "super intelligence"; hindi ito lumikha ng isang rehimen sa pag-uulat ng insidente sa pribadong sektor o isang maipapatupad na karapatan.

Hangga't hindi naglalathala ang administrasyon ng mga pamamaraan, kailangang bigyang-kahulugan ng mga kumpanya ang isang agarang kahilingang pampulitika nang walang istandardisadong mga paraan ng paghahain o magkakatulad na mga dahilan. Nag-iiwan ito ng puwang para sa hindi pare-parehong pag-uulat at mga pagtatalo kung sapat ba ang bilis ng pagkilos ng isang developer.

Ang kakailanganin ng isang kapani-paniwalang rehimen

Para maging predictable policy ang mandato, kakailanganin ng gobyerno ang mga nakasulat na kahulugan, isang responsableng tanggapan ng pagtanggap, mga ligtas na paraan ng pagsusumite, mga deadline na nakatali sa kalubhaan, mga proteksyon para sa mga sensitibong teknikal na detalye at isang proseso para sa pampublikong pagsisiwalat. Kakailanganin din nitong linawin kung ang mga patakaran ay sumasaklaw lamang sa mga frontier-model developer o mga kumpanyang nagde-deploy ng mga third-party na modelo sa mga mahahalagang setting.

Ang pahayag ng administrasyon ay nagtatatag ng isang inaasahan na hindi na maaaring ituring ng industriya ang pagsisiwalat bilang purong diskresyon lamang. Ang susunod nitong pagsubok ay institusyonal: ang pagsasalin ng inaasahan na iyon sa mga transparent na pamamaraan na maaaring sundin ng mga kumpanya at masuri ng publiko. Kung wala ang mga detalyeng iyon, ang anunsyo ay isang mahalagang babala, ngunit hindi pa isang kumpletong balangkas ng regulasyon.