Anthropic udgav i torsdags Claude Opus 5, den fjerde model i Claude 5-familien. Prisen er den samme som forgængeren Opus 4.8, og virksomheden fremhæver selv, at den er halvdelen af hvad Fable 5 koster. Det interessante ligger ikke i benchmarktallene, men i en lille parameter der hedder effort - og som flytter beslutningen om pris versus kvalitet fra leverandøren over til kunden.
Hvad modellen kan
Anthropic beskriver Opus 5 som et spring frem for Opus 4.8, ikke en inkrementel opdatering. De største fremskridt ligger i dyb ræsonnering, agentisk kodning over lange forløb og evnen til at omsætte ekstra beregning til bedre resultater.
Tallene fra Anthropics egen annoncering ser sådan ud:
- Frontier-Bench v0.1: dobbelt så høj score som Opus 4.8 til lavere omkostning
- CursorBench 3.2: inden for 0,5 procent af Fable 5 til det halve af prisen
- ARC-AGI 3: tre gange så høj score som den næstbedste model
- OSWorld 2.0: overgår Fable 5 til en tredjedel af prisen
- Organisk kemi: 10,2 procentpoint over Opus 4.8
- Proteinforudsigelse: 7,7 procentpoint over Opus 4.8
Den sædvanlige forsigtighed gælder. Det er leverandørens egne målinger på benchmarks, hvoraf flere er offentligt tilgængelige og dermed potentielt en del af træningsdata. Retningen er troværdig. Præcisionen i decimalerne er ikke nødvendigvis.
Anthropic er samtidig usædvanligt tydelig om, hvor modellen ikke er bedst. Fable 5 er stadig virksomhedens anbefaling til de mest ambitiøse opgaver og til agenter, der arbejder over lange forløb. Opus 5 markedsføres som hverdagsmodellen til videnarbejde og biologi.
Opus 5 mod forgængeren og storesøsteren
Stillet op ved siden af hinanden bliver positioneringen tydelig. Opus 5 koster det samme som Opus 4.8 og halvdelen af Fable 5, men rykker på næsten alle andre parametre.
| Opus 4.8 | Opus 5 | Fable 5 | |
|---|---|---|---|
| Pris per mio. tokens | 35 / 175 kr | 35 / 175 kr | 70 / 350 kr |
| Kontekstvindue | 1 mio. tokens | 1 mio. tokens | 1 mio. tokens |
| Maks. output | 128.000 tokens | 128.000 tokens | 128.000 tokens |
| Tænkning som standard | Nej, skal slås til | Ja | Ja, kan ikke slås fra |
| Højeste effort-niveau | xhigh | max | max |
| Minimum for caching | 1.024 tokens | 512 tokens | 512 tokens |
| Videnskæringsdato | Januar 2026 | Maj 2026 | Januar 2026 |
| Status i dokumentationen | Legacy | Anbefalet standardvalg | Højeste kapacitet |
Den vigtigste linje er den øverste. Anthropic har lagt et generationsspring ind uden at røre listeprisen, og det er sjældnere, end det lyder. Den næstvigtigste er den nederste - virksomheden anbefaler ikke længere sin dyreste model til alt.
Effort-skalaen er den egentlige nyhed
Opus 5 understøtter fem niveauer: low, medium, high, xhigh og max. Parameteren styrer, hvor mange tokens modellen bruger på at tænke, før den svarer. Tænkning er slået til som standard, hvilket er nyt - på Opus 4.8 skulle man aktivt bede om det.
I praksis betyder det, at den samme model kan være tre forskellige produkter. På low leverer den ifølge Anthropic stærk kvalitet til en brøkdel af tokens og ventetid. På max tænker den så dybt, den kan, og bruger tilsvarende flere tokens - som man selv betaler for.
Det er en reel ændring i, hvordan man køber AI. Tidligere valgte man en model og fik den ydelse, leverandøren havde besluttet. Nu vælger man et punkt på en kurve. Til klassificering og udtræk af felter er low nok. Til en større refaktorering på tværs af filer giver xhigh mening. Forskellen i regningen mellem de to yderpunkter er betydelig, og den beslutning ligger nu hos den der bygger systemet.
Der er en fælde i det. Fordi tænkning er slået til som standard, bruger de samme kald flere tokens end på Opus 4.8. Anthropic advarer direkte om at gennemgå sin max_tokens-indstilling, fordi den er et loft over tænkning og svar tilsammen. Man kan altså opleve, at svar bliver klippet af, uden at have ændret en linje kode.
Prisen står stille
Opus 5 koster omkring 35 kroner per million input-tokens og 175 kroner per million output-tokens. Præcis det samme som Opus 4.8, og cirka det halve af Fable 5.
Det er værd at hæfte sig ved i en periode, hvor branchen har været under kritik for skjulte forbrugslofter og for at flytte omkostninger over på kunderne ad bagveje. Anthropic vælger her at holde listeprisen i ro og i stedet lade kunden regulere sit eget forbrug via effort-parameteren. Det er en mere ærlig konstruktion end et loft, ingen kan se.
Ved siden af ligger Fast mode, der lanceres som research preview. Den giver cirka 2,5 gange højere hastighed for det dobbelte af prisen, altså omkring 70 og 350 kroner per million tokens. Den findes kun på Anthropics eget API, ikke via Amazon Bedrock, Google Cloud eller Microsoft Foundry.
Sikkerheden er en del af produktet nu
Opus 5 kommer få uger efter, at amerikanske myndigheder greb ind over for Fable 5 og lukkede adgangen for alle uden for USA. Den episode hænger tydeligt over lanceringen.
Anthropic kalder Opus 5 den mest velafstemte Opus-model til dato og den, der er sværest at narre til misbrug. Modellen har stærkere sikkerhedsforanstaltninger på cyberområdet end Opus 4.8. Samtidig fremhæver virksomheden, at Opus 5 i test var mindre i stand til at udnytte sårbarheder end Mythos 5 - og at dens restriktioner derfor er mindre stramme end Fable 5's.
Adspurgt af The Verge om modellen var forbi Trump-administrationen inden lanceringen svarede Anthropics talsperson Danielle Ghiglieri, at virksomheden fortsat samarbejder med sine myndighedspartnere om uafhængig test af modellerne, og at det også gælder Opus 5.
Der er også en ny praktisk funktion knyttet til afvisninger. Man kan slå automatisk fallback til, så en anmodning, Opus 5 afviser af sikkerhedshensyn, i stedet sendes videre til en mindre restriktiv model. Anthropic leverer nu en anbefalet standardopsætning for det, i stedet for at man selv skal vedligeholde en liste. Det løser et konkret driftsproblem, hvor en enkelt afvisning ellers kunne stoppe en hel automatiseret arbejdsgang.
Hvad der ellers er nyt
Ud over effort-skalaen følger en håndfuld ændringer med, som er nemme at overse i en annoncering, men som mærkes i drift.
| Nyhed | Hvad den gør | Betydning |
|---|---|---|
| Tænkning som standard | Modellen afgør selv, hvornår og hvor meget den tænker | Flere tokens per kald end på Opus 4.8 |
| Effort-niveauet max | Nyt øverste trin over xhigh | Kræver højt sat max_tokens for at virke |
| Værktøjer kan ændres undervejs | Tilføj eller fjern værktøjer mellem ture uden at miste cachen | Billigere agenter med skiftende værktøjssæt (beta) |
| Standard-fallback | Afviste anmodninger sendes videre efter Anthropics egen anbefaling | Ingen egen liste at vedligeholde (beta) |
| Lavere cache-minimum | 512 i stedet for 1.024 tokens | Korte systemprompts kan nu caches |
| Fast mode | 2,5 gange hastighed for dobbelt pris | Kun på Anthropics eget API |
Selve migreringen er et skift af model-id fra claude-opus-4-8 til claude-opus-5. Men to ting kan ikke ignoreres.
Den ene er standardtænkningen og dens effekt på max_tokens. Den anden er en decideret brydende ændring: man kan kun slå tænkning fra, hvis effort er sat til high eller lavere. Kombinerer man thinking: disabled med xhigh eller max, får man en 400-fejl. Kode der kørte fint i går, fejler i dag.
Modellen opfører sig også anderledes uden at man ændrer noget. Svarene er længere. Den fortæller oftere, hvad den er i gang med. Den uddelegerer lettere til underagenter. Og den verificerer sit eget arbejde uopfordret - hvilket betyder, at gamle instruktioner om at tilføje et verifikationstrin nu giver dobbeltarbejde og bør fjernes. Det er en påmindelse om, at prompts er noget man vedligeholder, ikke noget man skriver én gang.
Samtidig rykker Anthropic rundt på resten af sortimentet. Opus 4.8 er flyttet ned i dokumentationens legacy-afsnit, og Opus 4.1 er sat til at blive lukket ned den 5. august 2026 med Opus 5 som den anviste erstatning. Kører man stadig på en ældre Opus, er der en frist at forholde sig til.
Hvad det betyder i praksis
Den store historie i første halvår af 2026 har været, at ingen længere bygger på én model alene. Opus 5 passer ind i det billede snarere end at bryde det. En model med fem effort-niveauer er reelt fem forskellige pris- og ydelsespunkter fra samme leverandør, og valget mellem dem ligner til forveksling den routing, mange allerede har bygget mellem forskellige modeller.
Tre ting er konkrete nok til at handle på:
- Test på low og medium før du vælger høj effort. De fleste opgaver i en virksomhed er klassificering, opsummering og udtræk. Hvis low løser dem, er der ingen grund til at betale for tænkning, ingen læser.
- Gennemgå dine
max_tokensog eventuellethinking: disabled. Begge kan fejle stille eller højlydt efter et modelskift, og begge tager få minutter at tjekke. - Mål på dine egne opgaver, ikke på benchmarks. Et fast evalueringssæt med tyve reelle opgaver fra din egen forretning fortæller mere om, hvilket effort-niveau der er rigtigt, end nogen offentlig score gør.
Lanceringen falder på et tidspunkt, hvor Anthropic forbereder børsnotering og henter omkring 80 procent af sin omsætning fra erhvervskunder. En model der markedsføres som hverdagsværktøjet til videnarbejde, til uændret pris, med en knap kunden selv kan skrue på, er ikke tilfældigt timet. Det er et forsøg på at gøre modellen til en driftsudgift, man ikke tænker over - i stedet for en post nogen skal forsvare på næste budgetmøde.
Kilder: The Verge · Anthropic - Introducing Claude Opus 5 · Claude Platform Docs


