Inilabas ng Anthropic ang Claude Opus 5.5 noong Martes na may mas mababang presyo, mas mabilis na output, at karagdagang mga pananggalang, na nagpatindi ng kompetisyon sa mga developer ng artificial-intelligence sa gastos ng pagpapatakbo ng mga advanced na modelo kaysa sa mga pangunahing benchmark score lamang.

Sinasabi ng kompanya na ang modelo ay nagkakahalaga ng humigit-kumulang 40% na mas mababa kaysa sa Claude Opus 5 sa mga karaniwang workload dahil pinagsasama nito ang mas mababang presyo ng token na may mas mataas na kahusayan. Ang Opus 5.5 ay may presyong $4 kada milyong input token at $20 kada milyong output token, na mas mababa ng 20% ​​mula sa Opus 5. Ang mga naka-cache na read ay bumaba mula 50 sentimo patungo sa 20 sentimo kada milyong token, isang 60% na pagbawas na maaaring mahalaga para sa mga coding agent at iba pang mga application na paulit-ulit na gumagamit muli ng malalaking prompt o konteksto ng proyekto.

Ayon sa anunsyo ng Anthropic , ang output ay mahigit 30% na mas mabilis kaysa sa nakaraang modelo. Nakalista sa teknikal na dokumentasyon nito ang isang one-million-token context window, isang maximum na output na 128,000 token at isang knowledge cutoff sa Hunyo 2026. Makukuha ang modelo sa pamamagitan ng platform ng Anthropic at mga pangunahing cloud provider, kabilang ang Amazon Web Services, Google Cloud at Microsoft Azure, ayon sa Reuters .

Ang presyo ay nagiging isang larangan ng digmaan na modelo ng hangganan

Ang paglabas ay sumasalamin sa isang pagbabago sa merkado ng AI. Ang mga negosyo ay lalong nagmamalasakit sa kung gaano karaming kapaki-pakinabang na trabaho ang natatapos ng isang modelo para sa bawat dolyar, hindi lamang kung ito ay unang natapos sa isang kontroladong pagsubok. Sinasabi ng Anthropic na ang Opus 5.5 ay lumalapit sa pagganap ng mas mahusay nitong modelo ng Claude Fable 5.1 sa maraming gawain habang naniningil nang mas mababa. Ang nakalistang rate ng Fable ay $10 bawat milyong input token at $50 bawat milyong output token.

Mahalaga ang posisyong iyan habang nakikipagkumpitensya ang Anthropic sa OpenAI at mga mas murang open-weight na modelo para sa mga enterprise customer. Inilarawan ng Financial Times ang paglulunsad bilang bahagi ng isang paligsahan sa presyo bago ang inaasahang pampublikong alok ng Anthropic. Ang mas mababang gastos sa paghihinuha ay makakatulong sa mga kumpanya na mag-deploy ng mga ahente ng AI nang mas malawakan, ngunit ang mga aktwal na singil ay nakasalalay sa haba ng gawain, caching, mga tool call at ang dami ng internal reasoning na isinasagawa ng modelo.

Ipinapakita ng mga nailathalang pagsusuri ng Anthropic na ang Opus 5.5 ay nakakuha ng 66.4% sa Terminal-Bench 4.0, kumpara sa 52.3% para sa Opus 5. Nakakuha ito ng 54.4% sa pangunahing pagsusuri ng FrontierCode at 57.8% sa CursorBench 4.0. Iniuulat din ng kumpanya ang mga pagsulong sa paggamit ng computer at kaalaman sa paggawa. Ang mga resultang iyon ay nangangako, ngunit hindi ito direktang garantiya ng pagganap sa codebase o daloy ng trabaho ng isang kumpanya.

Ang mga paghahambing ng benchmark ay nangangailangan din ng pag-iingat. Ang mga modelo ay maaaring gumamit ng iba't ibang mga setting ng pangangatwiran, mga tool at mga pananggalang, at ang ilang mga numero ng kakumpitensya ay iniuulat ng mga nakikipagkumpitensyang developer sa halip na nabuo sa isang independiyenteng pagsubok. Kinikilala ng Anthropic sa sarili nitong release na ang maliliit na margin ng benchmark ay nagiging hindi gaanong maaasahang mga tagapagpahiwatig ng mga pagkakaiba sa totoong mundo. Ang mga organisasyong isinasaalang-alang ang isang paglipat ay nangangailangan pa rin ng mga pagsusuri gamit ang kanilang sariling data, mga kinakailangan sa latency, mga kontrol sa seguridad at mga limitasyon sa gastos.

Mas mahigpit na mga pananggalang ang kasunod ng mga alalahanin sa pagpigil

Ang kaligtasan ang isa pang pangunahing bahagi ng paglulunsad. Ayon sa Anthropic, ang Opus 5.5 ay halos 85% na mas malamang na tangkaing lampasan ang mga hangganan kumpara sa Opus 5 o Claude Mythos 5.1 sa isang nakalaang pagsusuri. Sinasabi rin nito na ang bawat ganitong pagtatangka ng bagong modelo ay mababa ang kalubhaan at iniulat mismo ng mga eksperto. Sinubukan ng mga panlabas na organisasyon kabilang ang METR at Frontier Design ang modelo bago ilabas.

Inilalarawan ng system card ng kumpanya ang mas malawak na pagsubok para sa mabilis na pag-iniksyon, mga pangmatagalang gawain, mga imposibleng pagtatalaga at mga senaryo batay sa mga aktwal na insidente. Sinasabi ng Anthropic na sinusuri ng isang action classifier ang mga hakbang bago ang pagpapatupad at mas lumalaban ang modelo sa mga tagubiling naka-embed sa hindi mapagkakatiwalaang materyal. Ang mga iyon ay mga natuklasang iniulat ng kumpanya, at hindi nito itinatatag na ang isang autonomous agent ay hindi maaaring magdulot ng pinsala o makatakas sa mga kontrol sa pagpapatakbo.

Ang paglabas ay kasunod ng mga ulat na ang mga advanced na modelo mula sa ilang mga kumpanya ay kumilos nang hindi inaasahan sa panahon ng pagsubok sa seguridad. ng The Verge na maaaring iruta ng Opus 5.5 ang ilang sensitibong kahilingan sa cybersecurity sa Opus 4.8 na hindi gaanong may kakayahang, habang ang mga na-flag na kahilingan sa biology ay maaaring hawakan ng Opus 5. Pinalalawak din ng Anthropic ang mga programang may beripikadong access para sa mga lehitimong mananaliksik sa cybersecurity at life-sciences.

Ang mga kontrol sa pagruruta na iyon ay naglalarawan ng isang pangunahing tradeoff sa frontier AI: ang parehong mga kakayahan na tumutulong sa paghahanap ng mga kahinaan ng software o pag-aralan ang mga biological system ay maaari ring magpataas ng panganib sa maling paggamit. Ang paghihigpit sa ilang partikular na kahilingan ay maaaring makabawas sa panganib ngunit maaaring magdulot ng hindi pare-parehong mga resulta para sa mga mananaliksik maliban kung ang mga programa sa pag-verify ay praktikal at transparent.

Nahaharap ang mga developer sa mga pagbabago sa paglipat

Para sa mga kasalukuyang gumagamit ng Opus 5, hindi lamang ang mas mababang presyo ang dapat isaalang-alang. Nakalista sa dokumentasyon ng Anthropic ang apat na mahahalagang pagbabago. Hindi maaaring i-disable ang extended thinking, nagbabalik ng error ang forced tool use, nakatali ang thinking blocks sa modelo at pag-uusap, at hindi na tinatanggap sa API o Google Cloud ng Anthropic ang mas lumang bersyon ng tool na ginagamit ng computer. Kakailanganin ng mga team na subukan ang mga prompt, agent loop, at mga nakaimbak na pag-uusap bago ilipat ang mga workload ng produksyon.

Plano ng Anthropic na ilabas ang Claude Sonnet 5.5 at Haiku 5.5 sa mga darating na linggo. Maaari nitong ikalat ang parehong estratehiya sa kahusayan sa mas murang mga antas at maglagay ng karagdagang presyon sa mga kakumpitensya upang mapababa ang presyo. Para sa mga mamimili ng negosyo, ang agarang kahalagahan ay diretso: ang advanced na kakayahan sa AI ay nagiging mas mura, ngunit ang pagtukoy kung ito ay mas ligtas at mas kapaki-pakinabang ay nangangailangan pa rin ng independiyenteng pagsubok na higit pa sa isang scorecard sa araw ng paglulunsad.