Ginamit ng OpenAI ang unang kumperensya ng mga developer upang ipakilala ang malawakang pagpapalawak ng platform nito, sa pangunguna ng GPT-4 Turbo na may 128,000-token context window, mas mababang presyo ng API, mga bagong tool ng developer at isang sistema para sa mga user na bumuo ng mga customized na bersyon ng ChatGPT nang hindi nagsusulat ng code. Ang anunsyo ng kumpanya sa DevDay noong Lunes ay minarkahan ang pinakamaagresibong pagsisikap nito upang gawing isang pangkalahatang-gamit na software platform ang teknolohiya sa likod ng ChatGPT.
Mas maraming materyal ang kayang iproseso ng GPT-4 Turbo sa isang prompt kaysa sa mga karaniwang modelo ng GPT-4 na available ngayong taon, habang sinasabi ng OpenAI na mas may kakayahan din ang modelo sa pagsunod sa mga tagubilin at pagtatrabaho gamit ang mga nakabalangkas na output. Itinakda ng kumpanya ang presyo ng mga input token ng GPT-4 Turbo sa isang-katlo ng halaga ng GPT-4 at ang mga output token sa kalahati ng dating presyo, isang pagbabagong direktang naglalayong sa mga developer na nagsisikap na bumuo ng mga komersyal na mabubuhay na aplikasyon sa paligid ng malalaking modelo ng wika.
Binabago ng mas malaking context window kung ano ang maaaring subukan ng mga developer
Ang 128K context window ay halos katumbas ng daan-daang pahina ng teksto, na nagpapahintulot sa mga developer na maglagay ng mas malalaking dokumento, code base, o mga pag-uusap sa isang kahilingan ng modelo. Hindi nito ginagarantiyahan ang perpektong pag-alala sa bawat token, ngunit binabago nito ang praktikal na limitasyon para sa pagsusuri ng dokumento, mga daloy ng trabaho sa pagkuha, at mga pangmatagalang aplikasyon.
Nagdaragdag din ang OpenAI ng JSON mode, pinahusay na function calling, mga reproducible output sa pamamagitan ng seed parameter at access sa mga log probabilities. Ang mga feature na iyon ay hindi gaanong nakikita kumpara sa isang bagong pangalan ng modelo ngunit mahalaga sa mga software team dahil ginagawang mas madali nitong maisama ang pag-uugali ng modelo sa ordinaryong application logic. Ang umiiral na GPT-4 release noong Marso ay nagtatag ng multimodal at reasoning baseline; Ang GPT-4 Turbo ay idinisenyo upang gawing mas mura at mas madaling gamitin ang kakayahang iyon sa malawakang saklaw.
Ipinakilala rin ng kumpanya ang isang Assistants API na may built-in na mga tool sa pagkuha, pagpapatupad ng code, at pagtawag ng mga function. Sa halip na hilingin sa mga developer na i-assemble mismo ang bawat bahagi ng isang conversational application, direktang nag-aalok ang OpenAI ng higit pang bahagi ng orchestration layer.
Itinutulak ng mga custom na GPT ang ChatGPT patungo sa isang marketplace ng aplikasyon
Para sa mga mamimili at organisasyon, ang mas nakikitang anunsyo ay ang mga GPT: mga pasadyang bersyon ng ChatGPT na naka-configure kasama ang mga tagubilin, na-upload na kaalaman, at mga piling kakayahan. Sa isang hiwalay na anunsyo ng produkto, sinabi ng OpenAI na ang mga gumagamit ng Plus at Enterprise ay maaaring lumikha ng mga GPT para sa mga partikular na gawain at ibahagi ang mga ito sa iba. Plano ng kumpanya na maglunsad ng isang GPT Store sa huling bahagi ng buwang ito kung saan maaaring matuklasan ang mga pampublikong GPT.
Binabawasan ng ideya ang hadlang sa pagitan ng paggamit ng AI assistant at pagbuo ng isang maliit na aplikasyon. Maaaring i-configure ng isang guro ang isang tutoring GPT batay sa isang kurikulum, maaaring lumikha ang isang kumpanya ng isang internal policy assistant, o maaaring pagsamahin ng isang espesyalista ang mga tagubilin sa mga proprietary reference material. mga release notes ng ChatGPT ang paglulunsad sa Nobyembre 6 bilang isang bagong paraan upang iangkop ang ChatGPT para sa trabaho, tahanan, at mga espesyalisadong gawain.
Pinalalawak din ng estratehiya ang direksyon ng enterprise na inanunsyo ng OpenAI noong Agosto. ang ChatGPT Enterprise ng mga kontrol na administratibo, mas mahigpit na mga pangako sa privacy, mas mahabang konteksto at walang limitasyong mas mataas na bilis na access sa GPT-4 para sa mga organisasyon. Nag-aalok na ngayon ang mga GPT ng isa pang layer ng pagpapasadya na maaaring manatiling panloob sa isang kumpanya o maibahagi sa publiko.
Ang mga multimodal tool ay lumilipat sa parehong developer stack
Dinadala rin ng DevDay ang GPT-4 Turbo na may vision, DALL·E 3 image generation, at text-to-speech sa API. Dahil dito, posible para sa isang application na pagsamahin ang text reasoning, image understanding, image generation, at spoken output gamit ang isang karaniwang vendor at account infrastructure.
Ilang buwan nang patungo sa ganitong kombinasyon ang OpenAI. Inilarawan nito ang isang modelo ng imahe na idinisenyo upang mas matapat na sundin ang detalyadong mga tagubilin sa wika at upang makipagtulungan nang malapit sa ChatGPT bilang isang interface para sa pagpapahusay ng prompt. Ang pagbubukas ng DALL·E 3 at mga kakayahan sa paningin nang mas malawak para sa mga developer ay ginagawang mga bloke ng pagbuo para sa mga panlabas na produkto ang mga tampok na nakaharap sa mamimili.
Ang pinalawak na plataporma ay sinasamahan din ng Copyright Shield, kung saan sinasabi ng OpenAI na ipagtatanggol nito ang mga customer at babayaran ang mga gastos na natamo sa ilang mga paghahabol sa paglabag sa copyright na kinasasangkutan ng mga pangkalahatang magagamit na sistema ng OpenAI. Ang pangako ay nalalapat sa ChatGPT Enterprise at sa API, bagama't hindi sa lahat ng paggamit o pagbabago.
Ang presyo ay nagiging isang mapagkumpitensyang sandata
Ang pinakakagyat na epekto sa komersyo ay maaaring magmula sa pagpepresyo. Ang mga aplikasyon ng malalaking modelo ng wika ay maaaring maging magastos kapag pinoproseso nito ang malalaking prompt, nagsisilbi sa maraming gumagamit o paulit-ulit na tinatawag ang mga modelo sa loob ng iisang daloy ng trabaho. Ang pagbabawas ng mga presyo ng token ay nakakabawas sa gastos ng eksperimento at ginagawang mas makatotohanan ang ilang dating marginal na aplikasyon.
Itinampok ng napapanahong ulat ng TechCrunch tungkol sa DevDay ang mga pag-upgrade ng modelo at ang mga pagbabago sa presyo, kasama ang isang eksperimental na programa para sa pagpipino ng GPT-4. Tinataasan din ng OpenAI ang mga limitasyon sa rate para sa mga establisadong customer ng GPT-4 API, isa pang senyales na naghahanda ang kumpanya para sa mas mataas na volume ng paggamit ng produksyon.
Ang mga anunsyo ay naglalagay ng presyon sa mga karibal na tagapagbigay ng modelo upang makipagkumpitensya hindi lamang sa pagganap ng benchmark kundi pati na rin sa haba ng konteksto, kagamitan ng developer, pagiging maaasahan, mga kontrol ng data at gastos. Kasabay nito, ang OpenAI ay umaako ng mas maraming responsibilidad para sa mismong layer ng application. Habang nagbibigay ito ng pagkuha, pagpapatupad ng code, mga custom assistant at isang GPT marketplace, lumalapit ito sa mga lugar kung saan maraming mga startup ang bumubuo ng mga produkto sa ibabaw ng mga modelo nito.
Mula sa tagapagbigay ng modelo hanggang sa kumpanya ng platform
Ang mas malaking mensahe ng DevDay ay hindi na nais ng OpenAI na masuri lamang batay sa katalinuhan ng pinakabagong modelo nito. Binubuo nito ang mga bahagi ng isang plataporma: mga modelo, kagamitan, imbakan at pagkuha, mga multimodal API, mga kontrol ng enterprise, pagpapasadya, isang channel ng pamamahagi at mas mababang gastos sa yunit.
Ang pagbabagong iyon ay maaaring magpalalim sa impluwensya ng OpenAI sa pagbuo ng software, ngunit pinapataas din nito ang mga pangangailangan sa pagpapatupad. Huhusgahan ng mga developer ang platform batay sa uptime, katatagan ng bersyon, mahuhulaang presyo, privacy at kung mananatiling kapaki-pakinabang ang mga bagong abstraksyon habang nagbabago ang mga modelo.
Sa ngayon, ang 128K context window ng GPT-4 Turbo at ang mas murang presyo ay mga malaking teknikal na pagbabago, habang ang mga GPT ay kumakatawan sa isang taya na milyun-milyong gumagamit ay maaaring maging mga lightweight application builder. Kapag pinagsama-sama, ginagawa nitong hindi gaanong isang product refresh ang unang DevDay ng kumpanya kundi isang deklarasyon na ang generative AI ay nagiging isang application platform na mismo.