Hopp til innhold
Skreddersy nyhetsbrev →
Skreddersy nyhetsbrev →
Avisen AI
28. JULI 2026

PersonvernVilkår
© 2026 Avisen AI
Modeller·22. april 2026·2 min lesing

Claude Opus 4.7: Anthropics nye referansemodell — og den de holder tilbake

87,6 % på SWE-bench Verified. 70 % på CursorBench. Samme pris som 4.6. Men Anthropic innrømmer selv at Opus 4.7 ikke matcher Mythos.

Av Redaksjonen
Claude Opus 4.7: Anthropics nye referansemodell — og den de holder tilbake
Illustrasjon: Warp

Begreper i denne artikkelen

BenchmarkStandardisert test for å måle og sammenligne ytelsen til AI-modeller på bestemte oppgaver.
LLMLarge Language Model — AI trent på store mengder tekst for å forstå og generere språk. GPT-5 og Claude er eksempler.
InferenceProsessen der en ferdigtrent AI-modell genererer svar basert på input. I motsetning til trening, der modellen lærer.
Context windowMengden tekst en AI-modell kan prosessere i én forespørsel. Måles i tokens.
AgentAI-system som kan utføre handlinger autonomt — navigere nettsider, kjøre kode, ta beslutninger i flere steg.
MultimodalAI som kan forstå og generere flere typer innhold — tekst, bilder, lyd, video.

Anthropic slapp Claude Opus 4.7 den 16. april. Oppgraderingen av flaggskipmodellen bringer bedre koding, skarpere visuell forståelse, og en ny evne til å kvalitetssjekke sitt eget arbeid. Modellen er tilgjengelig nå via API, Amazon Bedrock, Google Cloud Vertex AI og Microsoft Foundry.

Det viktigste: Anthropic innrømmet åpent at Opus 4.7 ikke matcher Mythos, modellen de holder tilbake fra offentlig lansering på grunn av cybersikkerhetsbekymringer. Opus 4.7 er altså den beste modellen du kan bruke — men ikke den beste Anthropic har bygget.

Benchmark-tallene

Opus 4.7 scorer 87,6 prosent på SWE-bench Verified, opp fra 80,8 prosent i Opus 4.6. Det er den høyeste publiserte scoren på denne benchmark-en per april 2026. På SWE-bench Pro, en vanskeligere variant, lander Opus 4.7 på 64,3 prosent. Opp fra 53,4 prosent, og foran GPT-5.4 på 57,7 prosent.

CursorBench, som måler autonom kodeytelse i Cursor-editoren, viser et hopp til 70 prosent fra 58 prosent. Multi-stegs agentisk resonnering er forbedret med 14 prosent, og verktøyfeil er redusert til en tredjedel.

Benchmark tall

Nye kapasiteter

Visuell forståelse: Opus 4.7 støtter bilder opptil 2 576 piksler på den lange kanten, mer enn tre ganger oppløsningsgrensen i tidligere Claude-modeller. Det betyr at skjermbilder, tekniske diagrammer og wireframes kan prosesseres i vesentlig høyere detalj — en multimodal oppgradering rettet mot utviklere og designere.

xhigh-modus: En ny innsatsnivå mellom «high» og «max» for resonnering. Gir utviklere finere kontroll over avveiningen mellom resonneringsdybde og inference-hastighet. For agent-arbeidsflyter som kjører over timer — der presisjon teller mer enn latens — er dette det mest relevante tillegget.

Selvrevisjon (/ultrareview): Opus 4.7 kan nå gjennomgå sitt eget arbeid fra forrige sesjon. Det er en funksjon som ble funnet i Claude Code-lekkasjen i mars — nå er den offisiell.

Sammenlignet med Opus 4.6

Pris og sammenligning

Prisen forblir uendret: $5 per million input-tokens og $25 per million output-tokens. Context window-et er det samme. Det betyr at oppgraderingen er ren ytelsesgevinst uten ekstra kostnad — uvanlig i en bransje der bedre modeller vanligvis betyr høyere pris.

Opus 4.7 driver nå både Claude Design (lansert 17. april) og Mythos Preview (Project Glasswing). Det plasserer modellen som Anthropics arbeidshest — kraftig nok for de fleste oppgaver, mens Mythos reserveres for cybersikkerhet.

For utviklere som allerede bruker Claude er oppgraderingen gratis og umiddelbar. SWE-bench-forbedringen fra 80,8 til 87,6 prosent er den største enkeltforbedringen mellom to Opus-versjoner, og den setter Anthropic tydelig foran GPT-5.4 og Gemini 3.1 Pro på koding.

Men Anthropics egen innrømmelse reiser et spørsmål. Hvor lenge holder en modell som referanse når selskapet som bygde den allerede har noe bedre på lager, men nekter å gi deg tilgang?


Kilder

  1. anthropic.com

Relaterte artikler

Claude Opus 5: halve prisen av Fable 5, nesten samme resultat
Modeller

Claude Opus 5: halve prisen av Fable 5, nesten samme resultat

24. juli 2026
Qwen3.8-Max: Alibabas svar på Kimi K3 kom på tre døgn
Modeller

Qwen3.8-Max: Alibabas svar på Kimi K3 kom på tre døgn

19. juli 2026
Kimi K3: verdens største åpne modell er ikke billig lenger
Modeller

Kimi K3: verdens største åpne modell er ikke billig lenger

16. juli 2026