11. SEPTEMBER 2026

AI-nyheter·25. august 2026

OpenAIs første brikke slår Nvidia. Den skal aldri selges.

Jalapeño leverer opptil 1,9 ganger mer arbeid per watt enn Nvidias systemer, ifølge målinger lagt frem på Hot Chips. OpenAI fortsetter å kjøpe Nvidia.

Av H. S. Pettersen · 2 min lesing
OpenAIs første brikke slår Nvidia. Den skal aldri selges.
Foto: OpenAI

Begreper i denne artikkelen

InferenceProsessen der en ferdigtrent AI-modell genererer svar basert på input. I motsetning til trening, der modellen lærer.
InferenskostnadHva det koster å kjøre en modell, ikke å trene den. Oppgis vanligvis i dollar per million tokens, med ulik pris inn og ut.
BenchmarkStandardisert test for å måle og sammenligne ytelsen til AI-modeller på bestemte oppgaver.
GPUGraphics Processing Unit — prosessorbrikke som er essensiell for å trene og kjøre AI-modeller.
TokenMinste tekst-enhet en språkmodell prosesserer — omtrent 3/4 av et ord på engelsk.

OpenAI la tirsdag frem de første måleresultatene for Jalapeño, inferensbrikken selskapet har utviklet sammen med Broadcom. Tallene ble presentert på maskinvarekonferansen Hot Chips. Jalapeño er oppgitt til 700 watt. Nvidia-systemene den sammenlignes med, GB200 og GB300, er oppgitt til henholdsvis 1 200 og 1 400.

På de tre åpne modellene GPT-OSS 120B, DeepSeek R1 670B og Kimi K2.5 1T leverte brikken 1,5 til 1,9 ganger mer arbeid per watt og 1,7 til 3,6 ganger lavere svartid enn sammenligningssystemene. For høyt interaktive arbeidslaster oppgir OpenAI mellom 2,1 og 4,1 ganger høyere ytelse.

Jalapeño mot Nvidias systemer
700 W
Effektklasse, mot 1 200 og 1 400 watt
1,5 til 1,9x
Mer arbeid per watt ved topplast
9 måneder
Fra første design til produksjonsklar brikke
Kilde: OpenAI, Jalapeños første resultater, 25. august 2026. Tallene er målt av OpenAI selv.

Kjøringene er OpenAIs egne

Testbenken er InferenceX, en offentlig målestokk fra analyseselskapet SemiAnalysis, som selv har publisert en gjennomgang der resultatene står seg. Kjøringene er likevel OpenAIs egne, og det samme er normaliseringen: tallene er regnet etter oppgitt effektklasse, ikke målt forbruk. OpenAI opplyser at brikken holdt seg under 550 watt i testene. Dette er leverandørrapporterte målinger.

Modellene designet brikken sin egen

OpenAI oppgir ni måneder fra første design til produksjonsklar brikke, og krediterer egne modeller for tempoet. Codex og GPT-Astra optimaliserte kretsene og skrev kjerner. For utvalgte blokker i GPT-OSS var KI-genererte implementasjoner 1,5 til 1,8 ganger raskere enn de menneskeskrevne. Det er marginkrigen som flytter seg ned i silisiumet, nå med modellene selv som verktøy.

Nvidia mister ikke en kunde

Brikken skal ikke selges. Den kjører inferens, ikke trening, og OpenAI sier de fortsetter å kjøpe akseleratorer fra Nvidia og andre til begge deler. Utrullingen i egne datasentre begynner før årsskiftet, generasjon to er under utvikling. Klubben er ikke lenger liten: Anthropic har egne brikkesamtaler med Samsung, og Metas Iris settes i produksjon fra september.

Resultatene kom dagen før Nvidia meldte om 96,2 milliarder dollar i kvartalsomsetning. Den største kunden bygger sin egen utvei, og betaler full pris så lenge den bygger.