Teknologi

Claude Opus 5.5 er 40% billigere og lanseres mens Anthropic ber om AI-forsiktighet

Susan Hill
Legg oss til på Google

Claude Opus 5.5 gjør noe Anthropics tidligere modeller ikke gjorde: den koster mindre og kjører raskere, samtidig som den matcher eller overgår et større og dyrere system. Modellen håndterer agentisk koding, datamaskinbruk, diagramlesing og tverrfaglig resonnering på nivåer som ifølge Anthropics egne data overgår Claude Fable 5.1 – selskapets tidligere mest kapable modell – på flere mål. For personer og utviklere som syntes Opus 5 var nyttig, men dyr, har gapet mellom hva modellen kan gjøre og hva den koster, endret seg betydelig.

Prisforskjellen er spesifikk. Opus 5.5 tar 4 dollar per million input-tokens og 20 dollar per million output-tokens; Opus 5 kostet henholdsvis 5 og 25 dollar. Mellomlagrede lesinger faller fra 0,50 til 0,20 dollar per million tokens. Anthropic sier at typiske arbeidsmengder totalt sett blir omtrent 40 prosent billigere. Hastigheten går i samme retning: standardmodellen genererer tekst mer enn 30 prosent raskere enn Opus 5. En egen hurtigmodus, priset til 8 dollar input og 40 dollar output per million tokens, når opptil 2,5 ganger hastigheten til standard Opus 5 – en nyttig innstilling for latenssensitive applikasjoner.

Anthropics publiserte ytelsestall plasserer Opus 5.5 foran Fable 5.1, Opus 5 og GPT-6 Astra på fire av seks referansetester. På Terminal-Bench 4.0, som tester kodekjøring i et levende terminalmiljø, skårer Opus 5.5 66,4 prosent mot Fable 5.1s 55,8 prosent. På Humanity’s Last Exam, en test som spenner over akademisk og profesjonell kunnskap på tvers av fagfelt, er resultatet 67,7 prosent mot 65,6 prosent. OSWorld 2.0, som måler betjening av datamaskingrensesnitt, viser 81,8 prosent mot 80,7 prosent. En Deloitte-test fant at Opus 5.5 på sitt laveste innsatsnivå oppdaget 72 prosent av kjente kodefeil i gjennomgang, mot 56 prosent for Opus 5 på høyt innsatsnivå. Disse tallene kommer fra Anthropic og dets utvalgte partnere; oppgitte feilmarginer varierer fra ±1,6 til ±5 prosentpoeng, og ingen uavhengig tredjepartsverifisering er publisert ved lansering.

To områder bryter mønsteret. På AutomationBench skårer GPT-6 Astra 41,4 prosent mot Opus 5.5s 40,0 prosent. På Terminal-Bench-Science er gapet større: Astra når 64,6 prosent mens Opus 5.5 lander på 58,7 prosent. Begge forskjellene ligger innenfor de oppgitte feilmarginene – de kan være støy – men de trenger ikke å være det. Anthropic inkluderer disse radene i sin egen publiserte tabell, noe som er mer enn de fleste AI-selskaper gjør ved lansering. Tallene trenger fortsatt uavhengig gransking før de kan behandles som endelige.

Når det gjelder sikkerhet, sier Anthropic at Opus 5.5 ble evaluert før lansering av eksterne team, deriblant METR. I selskapets egen interne adferdsrevisjon – nesten 2 000 scenarier utformet for å teste om modellen forsøker å omgå begrensninger som er satt for den – beskrives Opus 5.5 som 85 prosent mindre sannsynlig enn Opus 5 til å forsøke slik omgåelse. Sterkere modeller har en tendens til å være mer i stand til å finne smutthull, noe som gjør forbedringen meningsfull hvis den holder. Erfaring fra faktisk bruk vil bli den virkelige testen.

Det som gjør denne lanseringen uvanlig, er tidspunktet. Tidligere denne måneden publiserte Anthropics administrerende direktør Dario Amodei et essay der han skrev at han var blitt overbevist om at fullverdig håndtering av AI-risiko krever «å sette tempoet i kapabilitetsutviklingen slik at risikoforebygging har tid til å holde følge». OpenAIs Sam Altman og Elon Musk ga uttrykk for enighet med den generelle bekymringen. Nvidias administrerende direktør Jensen Huang sa at den underliggende vitenskapen ikke støtter den. Og så sendte Anthropic en modell som er raskere, billigere og mer kapabel enn forgjengeren. Én lesning: en modell med bedre sikkerhetsevalueringer og bredere tilgang er nettopp det Amodei hadde i tankene. En annen: essayet pekte på kapabilitetsutvikling som bekymringen, og kapabilitetene utviklet seg. Begge lesningene hviler på samme sett av fakta, og Anthropics referansetester alene kan ikke avgjøre hvilken som er riktig.

Claude Opus 5.5 er tilgjengelig fra og med 22. september 2026 under API-modell-ID-en claude-opus-5-5. Den kjører inne i Claude på Pro-, Max-, Team- og Enterprise-planene, og er tilgjengelig via AWS, Google Cloud og Microsoft Azure. Anthropic øker bruksbegrensningene på abonnementsnivåer med fem timers varighet. Sonnet 5.5 og Haiku 5.5, de resterende medlemmene av 5.5-familien, er planlagt å følge i løpet av de kommende ukene, uten at pris eller spesifikk lanseringsdato er kunngjort for noen av dem.

Tagger: , , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.