11. SEPTEMBER 2026

Analyse·1. september 2026

Anthropic slipper Fable 5.1 og Mythos 5.1, den ene med sikkerhetsfilter.

Fable 5.1 og Mythos 5.1 er samme modell. Den ene scorer 55,8 prosent på agentisk koding, den andre 60,9. Forskjellen er filteret, og Anthropic publiserte tallet.

Av H. S. Pettersen · 4 min lesing
Anthropic slipper Fable 5.1 og Mythos 5.1, den ene med sikkerhetsfilter.
Illustrasjon: Anthropic

Begreper i denne artikkelen

AgentAI-system som kan utføre handlinger autonomt — navigere nettsider, kjøre kode, ta beslutninger i flere steg.

Anthropic slapp Claude Fable 5.1 og Claude Mythos 5.1 tirsdag. Det er samme modell. På Terminal-Bench 4.0, en test for agentisk koding, scorer Fable 5.1 55,8 prosent. Mythos 5.1 scorer 60,9.

Differansen er ikke arkitektur eller trening. Det er sikkerhetsfilteret.

Fem komma ett prosentpoeng

Anthropic forklarer gapet selv. Det gjenspeiler oppgavene der de tidligere, mindre presise cybersikkerhetsfiltrene grep inn. Fable 5.1 er versjonen alle får, med filtre som avviser eller omdirigerer forespørsler om cyberangrep og farlig biologi. Mythos 5.1 er den samme modellen med løsere filtre, forbeholdt utvalgte organisasjoner.

At tallet i det hele tatt er publisert, er uvanlig. De fleste leverandører oppgir én score per modell og sier ingenting om hva sikkerhetslaget koster i ytelse. Anthropic oppgir to, og forklarer hvorfor de er ulike.

Det er også et selvrapportert tall fra en part med interesse i saken. Fotnoten i selskapets egen tabell oppgir at Fable 5.1 ble målt med produksjonsfiltrene på, og at oppgaver der filtrene grep inn ble scoret til null på OSWorld 2.0. Det trekker modellen ned på papiret, og Anthropic sier det rett ut.

Samme modell, to scorer
Fable 5.1Mythos 5.1Opus 5GPT-5.6 Sol
Terminal-Bench 4.0 (agentisk koding)55,8 %60,9 %52,3 %37,3 %
Terminal-Bench-Science 0.152,6 %ikke oppgitt29,0 %22,4 %
Humanity's Last Exam (uten verktøy)60,9 %ikke oppgitt56,6 %ikke oppgitt
AutomationBench31,4 %ikke oppgitt26,9 %19,6 %
Tilgjengelig i NorgeJaNeiJaJa
Kilde: Anthropic, leverandørrapporterte tall

Filteret ble mer presist

Oppdateringen handler mest om filtrene. Claude Code-brukere kan vente rundt 60 prosent færre inngrep per økt fra cybersikkerhetsfiltrene enn med Fable 5. Biologifiltrene fyrer 85 prosent sjeldnere på godartede spørsmål om elementær biologi og medisin.

Én reell utvidelse: Fable 5.1 kan nå brukes til å finne sårbarheter i programvare. Den kan fortsatt ikke skrive exploits for dem. Penetrasjonstesting, exploit-generering og binærbasert sårbarhetsskanning omdirigeres fortsatt til Opus-modellene, på samme måte som biologikapasiteten ble sperret i toppmodellen i august.

Bakgrunnen er kjent. Fable 5 kom 9. juni. Tre dager senere fant Amazon-forskere en vei forbi cybersikkerhetsfilteret som fikk modellen til å finne sårbarheter og i ett tilfelle skrive kode for å utnytte en av dem. Handelsdepartementet påla Anthropic å stenge tilgangen for utenlandske statsborgere, og selskapet skrudde av begge modellene i 19 dager.

Norge får halvparten

Mythos 5.1 er fortsatt bare tilgjengelig for amerikanske organisasjoner. Anthropic skriver at de koordinerer med amerikanske myndigheter for å utvide til flere innenlandske og internasjonale partnere så raskt som mulig, uten å oppgi når.

For en norsk utvikler betyr det at den mest kapable halvparten av modellen ikke er tilgjengelig, uansett bruksområde. Livsvitenskapsprogrammet som åpner biologikapasiteten er utviklet sammen med amerikanske myndigheter og har foreløpig bare amerikanske deltakere. Det samme gjelder cyberprogrammet.

Begrensningen er ikke teknisk. Den er geografisk, og den følger et mønster: Anthropic har tidligere holdt tilbake en sterkere modell av hensyn til egen risikovurdering. Denne gangen holdes den tilbake av hensyn til hvor kunden befinner seg.

Prisen falt der den betyr noe

Grunnprisen er uendret: ti dollar per million innkommende tokens, femti per million utgående. Det som falt er cache reads, altså når modellen leser kontekst den allerede har prosessert. Der kuttet Anthropic 75 prosent, fra én dollar til 25 cent per million.

Selskapet anslår rundt 25 prosent lavere kostnad på typiske arbeidsmengder og opptil 45 prosent på agentiske, målt over fire uker med faktisk bruk i august. Det er den samme mekanismen som har avgjort hvem som vinner frontier-konkurransen det siste halvåret: ikke hvem som er smartest, men hvem som er billigst per fullførte oppgave.

For agentisk arbeid, der modellen leser den samme konteksten hundrevis av ganger i én lang kjøring, utgjør cache reads mesteparten av regningen. Det er der Fable-klassen har vært for dyr. Cognition sier de flytter Opus 5-trafikken i Devin over til Fable 5.1 på lanseringsdagen, og begrunner det med nettopp cache-prisen.

Fem komma ett prosentpoeng er ikke mye. Men det er første gang noen har satt et tall på det.