Opus 5 leverer frontier til halv pris

Anthropic lancerede Opus 5 i torsdags. Prisen er uændret, men en effort-skala fra low til max lader dig selv vælge, hvor meget modellen skal tænke.

Opus 5 leverer frontier til halv pris

Anthropic udgav i torsdags Claude Opus 5, den fjerde model i Claude 5-familien. Prisen er den samme som forgængeren Opus 4.8, og virksomheden fremhæver selv, at den er halvdelen af hvad Fable 5 koster. Det interessante ligger ikke i benchmarktallene, men i en lille parameter der hedder effort - og som flytter beslutningen om pris versus kvalitet fra leverandøren over til kunden.

Hvad modellen kan

Anthropic beskriver Opus 5 som et spring frem for Opus 4.8, ikke en inkrementel opdatering. De største fremskridt ligger i dyb ræsonnering, agentisk kodning over lange forløb og evnen til at omsætte ekstra beregning til bedre resultater.

Tallene fra Anthropics egen annoncering ser sådan ud:

  • Frontier-Bench v0.1: dobbelt så høj score som Opus 4.8 til lavere omkostning
  • CursorBench 3.2: inden for 0,5 procent af Fable 5 til det halve af prisen
  • ARC-AGI 3: tre gange så høj score som den næstbedste model
  • OSWorld 2.0: overgår Fable 5 til en tredjedel af prisen
  • Organisk kemi: 10,2 procentpoint over Opus 4.8
  • Proteinforudsigelse: 7,7 procentpoint over Opus 4.8

Den sædvanlige forsigtighed gælder. Det er leverandørens egne målinger på benchmarks, hvoraf flere er offentligt tilgængelige og dermed potentielt en del af træningsdata. Retningen er troværdig. Præcisionen i decimalerne er ikke nødvendigvis.

Anthropic er samtidig usædvanligt tydelig om, hvor modellen ikke er bedst. Fable 5 er stadig virksomhedens anbefaling til de mest ambitiøse opgaver og til agenter, der arbejder over lange forløb. Opus 5 markedsføres som hverdagsmodellen til videnarbejde og biologi.

Opus 5 mod forgængeren og storesøsteren

Stillet op ved siden af hinanden bliver positioneringen tydelig. Opus 5 koster det samme som Opus 4.8 og halvdelen af Fable 5, men rykker på næsten alle andre parametre.

Opus 4.8 Opus 5 Fable 5
Pris per mio. tokens35 / 175 kr35 / 175 kr70 / 350 kr
Kontekstvindue1 mio. tokens1 mio. tokens1 mio. tokens
Maks. output128.000 tokens128.000 tokens128.000 tokens
Tænkning som standardNej, skal slås tilJaJa, kan ikke slås fra
Højeste effort-niveauxhighmaxmax
Minimum for caching1.024 tokens512 tokens512 tokens
VidenskæringsdatoJanuar 2026Maj 2026Januar 2026
Status i dokumentationenLegacyAnbefalet standardvalgHøjeste kapacitet

Den vigtigste linje er den øverste. Anthropic har lagt et generationsspring ind uden at røre listeprisen, og det er sjældnere, end det lyder. Den næstvigtigste er den nederste - virksomheden anbefaler ikke længere sin dyreste model til alt.

Effort-skalaen er den egentlige nyhed

Opus 5 understøtter fem niveauer: low, medium, high, xhigh og max. Parameteren styrer, hvor mange tokens modellen bruger på at tænke, før den svarer. Tænkning er slået til som standard, hvilket er nyt - på Opus 4.8 skulle man aktivt bede om det.

I praksis betyder det, at den samme model kan være tre forskellige produkter. På low leverer den ifølge Anthropic stærk kvalitet til en brøkdel af tokens og ventetid. På max tænker den så dybt, den kan, og bruger tilsvarende flere tokens - som man selv betaler for.

Diagram over Opus 5's effort-skala fra low til max med tokenforbrug, ventetid og typiske anvendelser for hvert niveau

Det er en reel ændring i, hvordan man køber AI. Tidligere valgte man en model og fik den ydelse, leverandøren havde besluttet. Nu vælger man et punkt på en kurve. Til klassificering og udtræk af felter er low nok. Til en større refaktorering på tværs af filer giver xhigh mening. Forskellen i regningen mellem de to yderpunkter er betydelig, og den beslutning ligger nu hos den der bygger systemet.

Der er en fælde i det. Fordi tænkning er slået til som standard, bruger de samme kald flere tokens end på Opus 4.8. Anthropic advarer direkte om at gennemgå sin max_tokens-indstilling, fordi den er et loft over tænkning og svar tilsammen. Man kan altså opleve, at svar bliver klippet af, uden at have ændret en linje kode.

Prisen står stille

Opus 5 koster omkring 35 kroner per million input-tokens og 175 kroner per million output-tokens. Præcis det samme som Opus 4.8, og cirka det halve af Fable 5.

Det er værd at hæfte sig ved i en periode, hvor branchen har været under kritik for skjulte forbrugslofter og for at flytte omkostninger over på kunderne ad bagveje. Anthropic vælger her at holde listeprisen i ro og i stedet lade kunden regulere sit eget forbrug via effort-parameteren. Det er en mere ærlig konstruktion end et loft, ingen kan se.

Ved siden af ligger Fast mode, der lanceres som research preview. Den giver cirka 2,5 gange højere hastighed for det dobbelte af prisen, altså omkring 70 og 350 kroner per million tokens. Den findes kun på Anthropics eget API, ikke via Amazon Bedrock, Google Cloud eller Microsoft Foundry.

Sikkerheden er en del af produktet nu

Opus 5 kommer få uger efter, at amerikanske myndigheder greb ind over for Fable 5 og lukkede adgangen for alle uden for USA. Den episode hænger tydeligt over lanceringen.

Anthropic kalder Opus 5 den mest velafstemte Opus-model til dato og den, der er sværest at narre til misbrug. Modellen har stærkere sikkerhedsforanstaltninger på cyberområdet end Opus 4.8. Samtidig fremhæver virksomheden, at Opus 5 i test var mindre i stand til at udnytte sårbarheder end Mythos 5 - og at dens restriktioner derfor er mindre stramme end Fable 5's.

Adspurgt af The Verge om modellen var forbi Trump-administrationen inden lanceringen svarede Anthropics talsperson Danielle Ghiglieri, at virksomheden fortsat samarbejder med sine myndighedspartnere om uafhængig test af modellerne, og at det også gælder Opus 5.

Der er også en ny praktisk funktion knyttet til afvisninger. Man kan slå automatisk fallback til, så en anmodning, Opus 5 afviser af sikkerhedshensyn, i stedet sendes videre til en mindre restriktiv model. Anthropic leverer nu en anbefalet standardopsætning for det, i stedet for at man selv skal vedligeholde en liste. Det løser et konkret driftsproblem, hvor en enkelt afvisning ellers kunne stoppe en hel automatiseret arbejdsgang.

Hvad der ellers er nyt

Ud over effort-skalaen følger en håndfuld ændringer med, som er nemme at overse i en annoncering, men som mærkes i drift.

Nyhed Hvad den gør Betydning
Tænkning som standardModellen afgør selv, hvornår og hvor meget den tænkerFlere tokens per kald end på Opus 4.8
Effort-niveauet maxNyt øverste trin over xhighKræver højt sat max_tokens for at virke
Værktøjer kan ændres undervejsTilføj eller fjern værktøjer mellem ture uden at miste cachenBilligere agenter med skiftende værktøjssæt (beta)
Standard-fallbackAfviste anmodninger sendes videre efter Anthropics egen anbefalingIngen egen liste at vedligeholde (beta)
Lavere cache-minimum512 i stedet for 1.024 tokensKorte systemprompts kan nu caches
Fast mode2,5 gange hastighed for dobbelt prisKun på Anthropics eget API

Selve migreringen er et skift af model-id fra claude-opus-4-8 til claude-opus-5. Men to ting kan ikke ignoreres.

Den ene er standardtænkningen og dens effekt på max_tokens. Den anden er en decideret brydende ændring: man kan kun slå tænkning fra, hvis effort er sat til high eller lavere. Kombinerer man thinking: disabled med xhigh eller max, får man en 400-fejl. Kode der kørte fint i går, fejler i dag.

Modellen opfører sig også anderledes uden at man ændrer noget. Svarene er længere. Den fortæller oftere, hvad den er i gang med. Den uddelegerer lettere til underagenter. Og den verificerer sit eget arbejde uopfordret - hvilket betyder, at gamle instruktioner om at tilføje et verifikationstrin nu giver dobbeltarbejde og bør fjernes. Det er en påmindelse om, at prompts er noget man vedligeholder, ikke noget man skriver én gang.

Samtidig rykker Anthropic rundt på resten af sortimentet. Opus 4.8 er flyttet ned i dokumentationens legacy-afsnit, og Opus 4.1 er sat til at blive lukket ned den 5. august 2026 med Opus 5 som den anviste erstatning. Kører man stadig på en ældre Opus, er der en frist at forholde sig til.

Hvad det betyder i praksis

Den store historie i første halvår af 2026 har været, at ingen længere bygger på én model alene. Opus 5 passer ind i det billede snarere end at bryde det. En model med fem effort-niveauer er reelt fem forskellige pris- og ydelsespunkter fra samme leverandør, og valget mellem dem ligner til forveksling den routing, mange allerede har bygget mellem forskellige modeller.

Tre ting er konkrete nok til at handle på:

  • Test på low og medium før du vælger høj effort. De fleste opgaver i en virksomhed er klassificering, opsummering og udtræk. Hvis low løser dem, er der ingen grund til at betale for tænkning, ingen læser.
  • Gennemgå dine max_tokens og eventuelle thinking: disabled. Begge kan fejle stille eller højlydt efter et modelskift, og begge tager få minutter at tjekke.
  • Mål på dine egne opgaver, ikke på benchmarks. Et fast evalueringssæt med tyve reelle opgaver fra din egen forretning fortæller mere om, hvilket effort-niveau der er rigtigt, end nogen offentlig score gør.

Lanceringen falder på et tidspunkt, hvor Anthropic forbereder børsnotering og henter omkring 80 procent af sin omsætning fra erhvervskunder. En model der markedsføres som hverdagsværktøjet til videnarbejde, til uændret pris, med en knap kunden selv kan skrue på, er ikke tilfældigt timet. Det er et forsøg på at gøre modellen til en driftsudgift, man ikke tænker over - i stedet for en post nogen skal forsvare på næste budgetmøde.

Kilder: The Verge · Anthropic - Introducing Claude Opus 5 · Claude Platform Docs

Michael Nielsen

Michael Nielsen

Michael Nielsen er AI-konsulent hos Nordium ApS og skriver om AI fra et praktisk standpunkt - hvad virker, hvad er hype, og hvordan danske virksomheder kan bruge teknologien til at skabe reel værdi. Han følger udviklingen tæt og dækker alt fra konkrete værktøjer og automatisering til de større tendenser, der former fremtidens arbejdsmarked.