11. SEPTEMBER 2026

← Alle begreper
Hva er

Inference

Prosessen der en ferdigtrent AI-modell genererer svar basert på input. I motsetning til trening, der modellen lærer.

Hva det er

Inference er prosessen der en ferdigtrent AI-modell brukes til å generere output fra nye inputs. Det er det som skjer når du sender et spørsmål til ChatGPT eller Claude — modellen kjører inference for å produsere et svar. I motsetning til trening, der modellen lærer, bruker inference det modellen allerede har lært.

Hvordan det fungerer

Under inference prosesserer modellen input-tokens gjennom sine nevrale nettverkslag og genererer output-tokens én om gangen. Hver genererte token krever beregning gjennom hele nettverket. Derfor er lengre svar dyrere å produsere. Teknikker som KV-cache, spekulativ dekoding og kvantisering brukes for å gjøre inference raskere og billigere.

Hvorfor det er relevant i 2026

Inference-kostnader er den største utgiftsposten for AI-selskaper. OpenAIs Sora ble lagt ned fordi inference kostet 1 million dollar daglig. Priskonkurransen er intens: DeepSeek V4 tilbyr inference til 0,30 dollar per million tokens — 10-20 ganger billigere enn vestlige konkurrenter. For bedrifter som bygger AI-produkter er inference-kostnad den viktigste variabelen i forretningsmodellen.

Relaterte begreper
Artikler som bruker dette begrepet
Analyse · 8. september 2026

Mistral hentet 3 milliarder euro. Nå er suverenitet en vare.

AI-nyheter · 4. september 2026

Tre modelltilbydere falt samme morgen.

Analyse · 1. september 2026

Vektene er gratis fordi de aldri var varen

AI-nyheter · 25. august 2026

OpenAIs første brikke slår Nvidia. Den skal aldri selges.

Analyse · 24. august 2026

Nvidia og SpaceX flytter datasenteret i bane. Naboene blir borte.