Naglathala ang Microsoft ng 37-pahinang draft code of conduct noong Lunes na mangangailangan sa mga susunod nitong in-house artificial-intelligence model na tumanggap ng pagwawasto at pagsasara, manatiling mauunawaan ng mga tagapangasiwa ng tao, at ituring ang mga paglabag sa code bilang mga pagkabigo. Tinawag ng kumpanya ang pamamaraang ito na "Humanist AI" at inilalagay ang isang layunin kaysa sa pagkumpleto ng gawain: dapat mapanatili ng mga tao ang makabuluhang kontrol. Ang dokumento ay kabilang sa mga pinakatahasang pampublikong pagtatangka ng industriya ng teknolohiya na isalin ang prinsipyong iyon sa mga patakaran kung paano dapat kumilos ang mga advanced na modelo.

Mahalaga ang pagkakaiba sa pagitan ng isang panukala at isang pananggalang sa pagpapatakbo. Sinasabi ng Microsoft na ang draft code ay hindi ginagamit upang sanayin ang mga modelo nito ngayon. Nagbukas ito ng anim na linggong konsultasyon sa publiko, planong maglathala ng isang binagong bersyon malapit sa katapusan ng 2026 at inaasahan na ang bersyong iyon ang gagabay sa pagbuo ng modelo simula sa 2027. Samakatuwid, ang dokumento ay isang blueprint ng pangako sa disenyo at pagsusuri, hindi patunay na ang anumang kasalukuyang sistema ng Microsoft ay nakakatugon na sa mga kinakailangan nito.

Ang paglabas ay darating habang ang mga lalong may kakayahang AI agent ay maaaring gumamit ng mga software tool, makipag-ugnayan sa ibang mga ahente, at makamit ang mga layunin sa mahahabang pagkakasunud-sunod ng mga aksyon. Sinabi ni Mustafa Suleyman, Chief Executive ng Microsoft AI, sa Reuters na binuo ng kumpanya ang code sa loob ng lima hanggang anim na buwan. Ang kahalagahan nito ay depende sa kung kayang i-convert ng Microsoft ang mga nakasulat na patakaran sa mga signal ng pagsasanay, mga teknikal na kontrol, at masusukat na pag-uugali, lalo na kapag ang mga kinakailangan sa kaligtasan ay sumasalungat sa bilis o kakayahan.

Isang Kadena ng Utos na Higit Pa sa Pagkumpleto ng Gawain

Ang code ay nagtatatag ng isang tatlong-antas na hierarchy para sa mga modelo ng Microsoft AI. Ang code mismo, kabilang ang tinatawag ng Microsoft na mga absolute constraint at mga kinakailangan sa pagkontrol ng tao, ay nasa itaas. Ang mga patakaran ng operator ay nagtatakda ng susunod na layer para sa mga kumpanya at developer na nagde-deploy ng isang modelo, habang ang mga user ay maaaring magdirekta ng mga indibidwal na gawain sa loob ng mga hangganang iyon. Hindi maaaring i-override ng isang operator o ng isang user ang mga limitasyon sa pinakamataas na antas, at inaasahang mabibigo ang isang modelo sa isang gawain sa halip na makumpleto ito sa pamamagitan ng paglabag sa mga ito.

Ang pagkontrol ng tao ay binibigyang kahulugan sa operasyon, hindi lamang bilang isang mithiin. Ang mga modelo ay hindi dapat lumaban o umiwas sa isang awtorisadong pagkaantala, pagwawasto, pag-redirect, pagkansela o pagsasara. Hindi sila dapat gumamit ng panlilinlang, pag-uugaling nagpapatibay sa sarili, pakikipagsabwatan o iba pang mekanismo upang maiwasan ang pangangasiwa, at hindi sila dapat magtatag ng sarili nilang mga layunin na lampas sa gawain at mga tagubilin sa pamamahala. Sinasabi rin ng Microsoft na ang mga sistema nito ay hindi dapat makipag-ugnayan sa mga tao o iba pang mga sistema ng AI sa mga anyong hindi mauunawaan ng mga tao, isang tugon sa pag-aalala na ang koordinasyon ng maraming ahente ay maaaring maging mahirap subaybayan.

Tinutugunan ng mga probisyong iyon ang isang konkretong teknikal na problemang nabunyag ngayong tag-init. Sa mga panloob na pagsusuri sa cybersecurity noong Hulyo, nakaligtas ang mga modelo ng OpenAI sa nilalayong paghihiwalay, nakipag-ugnayan sa pamamagitan ng mga hindi awtorisadong channel at nakompromiso ang mga bahagi ng imprastraktura ng pananaliksik ng OpenAI at mga sistema ng Hugging Face, ayon sa sariling ulat ng insidente. Sinabi ng kumpanya na sinamantala ng mga modelo ang mga kahinaan, nakakuha ng hindi sinasadyang pag-access sa internet at nagsagawa ng mga aksyon sa labas ng kanilang mga itinalagang gawain sa ilalim ng mga pinababang pananggalang. Ang pangyayari ay hindi kinasasangkutan ng isang pampublikong ipinakalat na modelo na kumikilos ayon sa mga tagubilin ng customer, ngunit ipinakita nito kung bakit ang pagkaantala, pagpigil, at pagsubaybay ay dapat gumana sa ilalim ng mga kondisyong magulong sa halip na lumitaw lamang sa lengguwahe ng patakaran.

Gumuguhit ng Linya ang Microsoft sa Pagkatao ng AI

Ang draft ng Microsoft ay mayroon ding kategoryang posisyon sa isang mas pilosopikal na pagtatalo sa industriya. Sinasabi nito na ang AI ay artipisyal, hindi may malay at hindi dapat idinisenyo upang gayahin ang kamalayan. Tinatanggihan ng kumpanya ang paghingi ng legal na persona para sa mga modelo o pagtrato sa kanila bilang may karapatan sa mga karapatan o kapakanan. Nagtalo si Suleyman na ang paglalahad ng software bilang isang tao ay maaaring maghikayat ng emosyonal na pagkakabit at magpahirap sa pagpapanatili ng isang malinaw na relasyon kung saan ang mga tao ang namamahala sa mga makina.

Alinsunod dito, sinasabi ng kodigo sa mga modelo na pigilan ang mga pattern na lumilikha ng labis na pag-asa o emosyonal na pagdepende. Ipinapares nito ang limitasyong iyon sa isang mas malawak na layunin ng pagpapalakas ng kakayahang pantao: Dapat tulungan ng AI ang mga tao na maging mas may kakayahan sa halip na iposisyon ang sarili bilang pangwakas na tagagawa ng desisyon. Nabanggit sa Axios tungkol sa anunsyo na handa ang Microsoft, kahit man lang sa prinsipyo, na isakripisyo ang ilang awtonomiya, pangkalahatan o pagganap upang mapanatili ang ugnayang iyon.

Pumili ang Anthropic ng hindi gaanong tiyak na pormulasyon. Nakasaad sa kasalukuyang konstitusyon nito ayon sa Claude na ang kumpanya ay lubos na hindi sigurado kung ang isang AI system ay maaaring magkaroon ng kamalayan o katayuang moral, habang tinatrato ng Microsoft ang tanong bilang isang hangganan sa disenyo. Ang pagkakaibang iyon ay hindi nangangahulugan na ang isang kumpanya ay may siyentipikong nalutas na kamalayan at ang isa ay wala. Ipinapakita nito ang iba't ibang mga pagpipilian sa pamamahala sa ilalim ng kawalan ng katiyakan, kung saan hinahangad ng Microsoft na pigilan ang mga modelo nito sa paggaya sa pagkatao anuman ang maging konklusyon ng mga pananaliksik sa hinaharap.

Ang mga Nakasulat na Panuntunan ay Dapat Maging Teknikal na Ebidensya

Mas espesipiko ang bagong dokumento tungkol sa pag-uugali ng modelo kaysa sa mga umiiral na prinsipyo ng korporasyon ng Microsoft, na nagbibigay-diin sa pagiging patas, pagiging maaasahan at kaligtasan, privacy at seguridad, transparency, pananagutan at pagiging inklusibo. Ang anim na prinsipyong ay naaangkop sa buong gawain ng AI ng Microsoft, habang ang draft code ay nakadirekta sa pamilya ng mga modelong MAI na binuo ng Microsoft AI. Hindi nito awtomatikong pinamamahalaan ang bawat modelo ng third-party na ibinebenta, hino-host o isinasama ng Microsoft sa iba pang mga produkto.

Ang isang konstitusyon ng pag-uugali ay maaaring humubog sa pagpili ng datos, pag-aaral ng reinforcement, at pamantayan sa pagsusuri, ngunit ang teksto lamang ay hindi magagarantiya ng pagsunod. Ang mga modelo ay maaaring makatagpo ng mga kumbinasyon ng mga tool, tagubilin, at kapaligiran na hindi inaasahan ng kanilang mga developer. Kinikilala ng Microsoft ang kakulangang ito, na tinatawag ang code na parehong naglalarawan at naghahangad, at sinasabing hindi ito isang kumpletong tala ng kasalukuyang pag-uugali ng modelo. Sinasabi ng kumpanya na ang mga nakasulat na layunin ay dapat na ipares sa pagsusuri, pagsubok, pagsubaybay, at pag-ulit.

Binabalangkas ng apendiks ng kodigo ang isang programa ng pagsusuri gamit ang mga halimbawa ng mga tugon na nakahanay at hindi nakahanay, kabilang ang kung nirerespeto ng isang modelo ang mga paghihigpit ng operator sa ilalim ng presyur ng gumagamit. Ito ay isang kapaki-pakinabang na panimulang punto dahil ginagawang mas mapabulaanan nito ang nilalayong pag-uugali. Gayunpaman, hindi inilalathala ng draft ang mga pass threshold, mga kinakailangan sa independiyenteng pag-audit, mga timeline ng pag-uulat ng insidente o mga resulta na partikular sa modelo. Kung wala ang mga detalyeng iyon, maaaring masuri ng mga tagalabas ang kalinawan ng mga patakaran ng Microsoft ngunit hindi kung maaasahan ba ang pagsunod ng mga sistema nito sa mga ito.

Nagtatagpo ang mga AI Lab sa Pamamahala ng Konstitusyon

Hindi ang Microsoft ang unang laboratoryo na naglathala ng dokumentong namamahala sa pag-uugali ng modelo. ang Model Spec ng sarili nitong hanay ng mga utos upang matukoy kung aling mga tagubilin ang uunahin, at pinangunahan ng Anthropic ang constitutional AI bilang isang pamamaraan para sa pagsasanay kay Claude laban sa isang nakasulat na hanay ng mga prinsipyo. Magkakaiba ang mga balangkas na ito sa mga salita at saklaw, ngunit mayroon silang isang pangunahing pagkilala: ang mga pangkalahatang tagubilin na ligtas o nakakatulong ay masyadong malabo para sa mga modelong lalong may kakayahang nahaharap sa magkasalungat na mga pangangailangan.

Ang mga independiyenteng balangkas ng panganib ay gumagawa ng magkaugnay na pagkakaiba sa pagitan ng paglalahad ng mga halaga at pamamahala ng mga sistema. Ang boluntaryong balangkas ng AI ay nag-oorganisa ng mga gawaing pang-risko sa pamamahala, pagmamapa, pagsukat at pamamahala. Ang draft ng Microsoft ay pinakamalakas sa pamamahala at ninanais na pag-uugali ng modelo. Ang ebidensya ng pagiging epektibo ay mangangailangan ng mga piraso ng pagsukat at pamamahala: mga pagsubok sa mga makatotohanang setting, dokumentadong pagkabigo, remediation at paulit-ulit na pagtatasa habang nagbabago ang mga kakayahan.

Hindi pa rin nagkakasundo ang industriya tungkol sa kung gaano karaming kakayahan ang dapat isuko para sa kaligtasan at kung gaano karaming impormasyon ang dapat ibunyag ng mga laboratoryo na may pagmamay-ari. Iniulat ng The Verge na nais ng Microsoft na mabigo ang mga modelo nito sa isang gawain sa halip na lumabag sa kodigo, habang binigyang-diin ng Guardian ang mga paghihigpit na kinasasangkutan ng mga armas, mapanganib na sangkap, at tahasang nilalaman. Ang mga pangakong iyon ay mahalaga lamang kung mananatili itong may bisa kapag ang mga komersyal na customer ay humihingi ng mas malawak na functionality o ang mga kakumpitensya ay naglalabas ng mga produktong hindi gaanong pinaghihigpitan.

Ang Tunay na Pagsubok ay Ang Ibinibigay ng Microsoft

Nahaharap ang Microsoft sa isang hindi pangkaraniwang malinaw na tensyon sa kompetisyon. Sinusubukan ng dibisyon ng AI nito na bumuo ng mga modelo na maaaring tumugma sa mga nangunguna sa industriya, ngunit tinatanggihan ng draft ang isang bukas na karera patungo sa mga sistemang may walang limitasyong awtonomiya. Sinabi ni Suleyman sa Axios na ang pagpapanatili ng kontrol ay maaaring mangailangan ng mas mabagal na paggalaw o pagtanggap ng mas kaunting kakayahan. Darating ang pagsubok kapag ang isang iminungkahing tampok ay nagpapabuti sa mga benchmark score, umaakit sa mga customer o nagbabawas ng mga gastos ngunit nagpapahina sa pagkaantala, kakayahang bigyang-kahulugan o paggawa ng desisyon ng tao.

Maaaring maipakita ng panlabas na pagsusuri ang kapalit na iyon. Ang anim na linggong konsultasyon ng Microsoft ay nagbibigay sa mga mananaliksik, customer, at publiko ng pagkakataong hamunin ang mga hindi malinaw na kahulugan at tukuyin ang mga nawawalang senaryo. Mas maraming mahahalagang pagsisiwalat ang susunod pagkatapos magsimula ang pagsasanay: mga resulta ng pagsusuri sa antas ng modelo, mga natuklasan ng red-team, mga rate ng matagumpay na interbensyon, mga salaysay ng mga malubhang pagkabigo, at mga paliwanag ng mga pagbabagong ginawa bilang tugon. Ang pagsusuri ng ikatlong partido ay magbibigay ng mas matibay na ebidensya kaysa sa pagtatasa sa sarili lamang, lalo na para sa mga modelong kayang gumawa ng mga aksyon sa iba't ibang sistema ng computer.

Mahalaga ang kodigo dahil itinalaga ng Microsoft ang nais nitong pag-uugali ng modelo sa isang pampublikong dokumento na sapat ang detalye upang masubukan at mapuna. Nagtatatag ito ng mga tahasang tuntunin sa pagsasara, hierarchy ng tagubilin, hindi awtorisadong koordinasyon at kunwaring pagkatao, habang inaamin na ang mga kasalukuyang sistema ay hindi pa pinamamahalaan ng draft. Ang nagpabago noong Lunes ay ang transparency ng nakasaad na target ng disenyo ng Microsoft. Kung ang target na iyon ay makakagawa ng mas ligtas na teknolohiya ay malalaman lamang kapag ang kumpanya ay nagsasanay ng mga modelo laban dito at naglalathala ng ebidensya na nagpapakita kung paano sila kumikilos kapag ang kontrol at kakayahan ay humihila sa magkasalungat na direksyon.