Nagpataw ang gobyerno ng US ng mga bagong kinakailangan sa lisensya sa pag-export sa ilan sa pinakamalakas na processor ng artificial-intelligence sa mundo, na naghihigpit sa mga kargamento ng mga chips ng Nvidia at Advanced Micro Devices sa China at pinatitindi ang pagsisikap ng Washington na pigilan ang advanced na teknolohiya sa computing na maabot ang mga gumagamit ng militar.

Isiniwalat ng Nvidia na ipinaalam ng gobyerno noong Agosto 26 na ang anumang pag-export sa hinaharap sa China, kabilang ang Hong Kong, ng A100 at mga paparating na H100 integrated circuits nito ay mangangailangan ng lisensya. Sinabi ng kumpanya sa quarterly filing na sakop din ng kinakailangan ang mga produktong A100X, mga sistemang DGX na naglalaman ng mga chip at mga processor sa hinaharap na nakakatugon sa tinukoy na performance at mga threshold ng chip-to-chip interconnect. Sinabi ng Nvidia na binanggit ng mga opisyal ang panganib na ang mga produktong sakop ay maaaring gamitin o ilipat sa isang end use ng militar o end user ng militar.

Ang mga kontrol ay naka-target sa mga makina sa likod ng malakihang AI

Ang mga apektadong produkto ay hindi mga ordinaryong graphics card. Ang A100 ng Nvidia ay isang data-center accelerator na idinisenyo para sa machine-learning training, inference, analytics at scientific computing. Nang ilunsad ng kumpanya ang arkitektura noong 2020, inilarawan nito ang A100 Tensor Core GPU bilang may kakayahang mapabilis ang AI training at inference nang hanggang 20 beses kumpara sa nakaraang henerasyon nito, na may mga sistemang idinisenyo upang mapalawak sa mga cloud at supercomputing installation.

Ang H100 ang susunod na henerasyon. Inanunsyo ng Nvidia ang arkitektura ng Hopper noong Marso, na nagsasabing ang H100 ay naglalaman ng 80 bilyong transistor at idinisenyo para sa malalaking modelo ng wika, mga sistema ng rekomendasyon, genomics at iba pang mga workload na nangangailangan ng malaking computation. Ang processor ay hindi pa malawakang magagamit, na nangangahulugang ang paghihigpit sa pag-export ay umaabot sa isang produkto bago pa makumpleto ang komersyal na paglulunsad nito.

Ang panahong iyon ay lumilikha ng isang hindi pangkaraniwang problema sa inhinyeriya. Sinabi ng Nvidia na ang tuntunin sa lisensya ay maaaring makaapekto sa kakayahan nitong makumpleto ang pagbuo ng H100 sa iskedyul o suportahan ang mga umiiral na customer ng A100 at maaaring pilitin ang ilang operasyon na lumipat palabas ng China. Inilarawan sa paunang pagsisiwalat ng kumpanya sa Form 8-K ang paghihigpit bilang epektibo kaagad at sinabing hihingi ito ng mga lisensya kung kinakailangan.

Sinabi ng Nvidia na $400 milyon ang nabunyag na benta sa Tsina

Maaaring maging mahalaga ang epekto sa pananalapi kahit bago pa man umabot sa malaking kargamento ang H100. Sinabi ng Nvidia na mayroon itong humigit-kumulang $400 milyon na potensyal na benta sa ikatlong kwarter sa Tsina na maaaring maapektuhan kung ang mga customer ay hindi bibili ng mga alternatibong produkto o kung ang gobyerno ay tumanggi na mag-isyu ng mga lisensya. Ang bilang na ito ay sumasalamin sa kahalagahan ng demand ng Tsina para sa mga data-center accelerator na ginagamit ng mga cloud provider, mga kumpanya ng internet, mga organisasyon ng pananaliksik at iba pang malalaking customer ng computing.

Hindi pa inilalabas ng Washington sa publiko ang isang detalyadong tuntunin na nagpapaliwanag sa lahat ng mga limitasyon sa pagganap sa likod ng bagong kinakailangan sa lisensya. Sa kasabay na pag-uulat, iniulat ng Guardian, na binanggit ang Reuters, noong Setyembre 1 na sinabi ng Commerce Department na sinusuri nito ang mga patakaran na may kaugnayan sa Tsina at gumagawa ng mga karagdagang hakbang upang maiwasan ang mga advanced na teknolohiya na gamitin nang hindi naaayon sa pambansang seguridad at mga interes ng patakarang panlabas ng US.

Ang mga kontrol ay nalalapat din bukod sa Nvidia. Sinabi ng AMD sa Reuters na nakatanggap ito ng mga bagong kinakailangan sa paglilisensya na nakakaapekto sa MI250 accelerator nito, bagama't hindi naniniwala ang kumpanya na sakop nito ang MI100. Inilunsad ng AMD ang mas malawak na serye ng Instinct MI200 noong Nobyembre 2021 para sa high-performance computing at AI, kabilang ang MI250X na ginagamit sa mga exascale-class system.

Ang pagkakaiba sa mga produkto ay nagpapahiwatig na sinusubukan ng Washington na gumuhit ng teknikal na linya sa paligid ng pinakamataas na antas ng pagganap sa computing sa halip na paghigpitan ang bawat processor ng data-center. Ang pag-aalala ng gobyerno ay ang mga accelerator na sapat ang lakas upang sanayin ang malalaking sistema ng AI ay maaari ring suportahan ang pagmomodelo ng militar, pagsusuri ng katalinuhan, pagkilala ng imahe at iba pang mga aplikasyon na may dalawahang paggamit.

Binabawasan ng pansamantalang pahintulot ang pagkaantala sa pagbuo ng H100

Matapos ang unang pagsisiwalat, binigyan ng gobyerno ang Nvidia ng limitadong mga pahintulot na idinisenyo upang mabawasan ang agarang pagkaantala sa operasyon. Sa isang Form 8-K noong Setyembre 1, sinabi ng Nvidia na maaari nitong ipagpatuloy ang mga pag-export at paglilipat na kinakailangan upang mabuo ang H100, suportahan ang mga customer ng A100 sa US hanggang Marso 1, 2023, at magsagawa ng katuparan at logistik ng order ng A100 at H100 sa pamamagitan ng pasilidad nito sa Hong Kong hanggang Setyembre 1, 2023.

Hindi inaalis ng mga awtorisasyong iyon ang pinagbabatayang paghihigpit sa mga benta sa mga sakop na customer na Tsino. Sa halip, pinapanatili nila ang mga partikular na tungkulin sa pag-unlad at logistik habang nananatili ang mas malawak na kinakailangan sa paglilisensya. Para sa Nvidia, mahalaga ang pagkakaibang iyon dahil ang mga sopistikadong chips ay nakasalalay sa mga sistema ng inhinyeriya, pagmamanupaktura, pagsubok at pamamahagi na ipinamamahagi sa buong mundo kahit na ang panghuling customer ay matatagpuan sa isang bansa.

Ang H100 ay lalong mahalaga dahil ipinoposisyon ito ng Nvidia bilang pundasyon para sa isang bagong henerasyon ng imprastraktura ng AI. Ayon sa anunsyo ng kumpanya noong Marso, walong H100 GPU sa isang sistema ang maaaring maghatid ng 32 petaflops ng pagganap ng AI sa bagong katumpakan ng FP8, na may mas malalaking kumpol na naglalayong sa napakalaking modelo ng wika at iba pang mga workload na nangangailangan ng libu-libong processor na magkakasamang gumagana.

Ang patakaran ay nagta-target ng kakayahan sa halip na isang partikular na aplikasyon

Ang desisyon sa pag-export ay sumasalamin sa mas malawak na problemang kinakaharap ng mga regulator ng teknolohiya: ang parehong hardware ay maaaring sumuporta sa komersyal na pananaliksik at mga aplikasyong militar. Ang isang high-end accelerator ay maaaring magsanay ng isang modelo ng rekomendasyon ng mamimili, suriin ang medikal na imaging, gayahin ang mga pisikal na sistema o iproseso ang imahe ng satellite. Ang chip mismo ay hindi nagpapakita ng layunin kung para saan ito gagamitin sa huli.

Samakatuwid, ang paglilisensya ay nagbibigay sa gobyerno ng mekanismo upang suriin ang mga partikular na pag-export sa halip na umasa lamang sa isang kategoryang pagbabawal. Maaaring humingi ng pahintulot ang mga kumpanya para sa mga transaksyon, at maaaring isaalang-alang ng mga regulator ang mga customer, mga pangwakas na gamit, mga destinasyon at iba pang mga salik. Ngunit ang proseso ay nagdudulot din ng kawalan ng katiyakan para sa mga tagagawa at mga customer dahil ang isang nakaplanong pagbebenta ay maaaring nakasalalay sa isang desisyon ng gobyerno na wala sa ilalim ng kontrol ng kumpanya.

Ang mga bagong kinakailangan ay maaaring magkaroon ng mga epekto na higit pa sa panandaliang kita. Maaaring mapabilis ng mga kumpanya ng teknolohiyang Tsino ang mga pagsisikap na bumuo ng mga lokal na alternatibo, habang maaaring kailanganin ng mga tagagawa ng US na muling idisenyo ang mga produkto o supply chain upang maglingkod sa mga merkado na nasa ilalim ng kontroladong mga limitasyon. Kailangan ding maunawaan ng mga cloud provider na tumatakbo sa iba't ibang hangganan kung ang pag-access sa mga advanced na accelerator sa pamamagitan ng mga serbisyo ng remote computing ay magtataas ng mga karagdagang tanong sa patakaran.

Isang makabuluhang pagtaas sa kompetisyon sa teknolohiya sa Tsina

Matagal nang ginagamit ng Washington ang mga kontrol sa pag-export upang paghigpitan ang mga partikular na kumpanyang Tsino, kagamitan sa telekomunikasyon, at mga end user na may kaugnayan sa militar. Iba ang saklaw ng bagong aksyon dahil umaabot ito sa isang klase ng advanced computing hardware batay sa teknikal na kakayahan at naaangkop sa mga produkto mula sa maraming pangunahing taga-disenyo ng chip sa US.

Dahil dito, ang mismong artificial-intelligence computing ay nagiging mas tahasang isyu sa pambansang seguridad. Ang A100 at H100 ng Nvidia at ang MI250 ng AMD ay mahalaga dahil kaya nilang magsagawa ng napakaraming kalkulasyon nang sabay-sabay, na nagpapahintulot sa mga mananaliksik at kumpanya na bumuo ng mga modelo at simulation na lalong may kakayahan. Ang parehong bentahe sa pagganap na lumilikha ng komersyal na halaga ang siyang dahilan kung bakit ang mga processor ay estratehikong sensitibo.

Para sa Nvidia, ang agarang hamon ay nasa operasyon: protektahan ang pagbuo ng H100, suportahan ang mga kasalukuyang customer, mag-aplay para sa mga lisensya at tukuyin kung gaano karami sa humigit-kumulang $400 milyon na nasa peligrong quarterly na benta ang maaaring mapanatili. Para sa AMD, ang paghihigpit sa MI250 ay lumilikha ng katulad na pangangailangan na tukuyin ang mga apektadong customer at transaksyon.

Para sa mas malawak na industriya ng teknolohiya, mas malaki ang kahalagahan nito. Ang mga advanced na AI hardware ay lumipat mula sa pagtrato pangunahin bilang isang komersyal na produkto patungo sa pagtrato bilang isang estratehikong kakayahan na napapailalim sa mga kontrol ng pambansang seguridad. Ang eksaktong mga hangganan ng patakarang iyon ay umuusbong pa rin, ngunit ang mga kinakailangan sa paglilisensya ngayong linggo ay nagtatatag na ang pagganap ng isang processor ay maaari na ngayong matukoy hindi lamang kung anong mga sistema ang maaari nitong paganahin, kundi pati na rin kung saan ito legal na maaaring ibenta.