Hopp til hovedinnhold
AIKI

Grok 4.6: samme intelligens til en femtedel av prisen

||4 min lesing

Kort fortalt

  • xAI lanserte Grok 4.6 onsdag 12. august 2026. Modellen scorer 61 på Artificial Analysis Intelligence Index, likt med GPT-5.6 Sol og ett poeng bak Fable 5.
  • Prisen er 2 dollar per million input-tokens og 6 dollar per million output-tokens. GPT-5.6 Sol koster 5 og 30 dollar. Claude Opus 5 koster 5 og 25 dollar.
  • Kontekstvinduet er 500 000 tokens, og modellen er tilgjengelig via xAI-konsollet, OpenRouter, Cursor, Vercel og Cloudflare.
  • xAI sier ingenting om EU- eller EØS-tilgjengelighet. Grok 4.5 var EU-blokkert i ni dager etter lansering i juli. Sjekk tilgang selv før du planlegger.
  • Grok 4.6 taper på flere kodebenchmarks mot både GPT-5.6 Sol og Fable 5. Terminal-Bench v3.0 er 26 prosent mot 34,6.

Grok 4.6: samme intelligens til en femtedel av prisen

xAI lanserte Grok 4.6 onsdag 12. august 2026 til 6 dollar per million output-tokens. GPT-5.6 Sol koster 30 for samme målte intelligens. Modellen scorer 61 på Artificial Analysis Intelligence Index, likt med GPT-5.6 Sol og ett poeng bak Anthropics Fable 5. Prislisten er: 2 dollar per million input-tokens og 6 dollar per million output-tokens, ifølge xAIs egen kunngjøring og utviklerdokumentasjonen.

Til sammenligning oppgir Artificial Analysis 5 og 30 dollar for GPT-5.6 Sol, og 5 og 25 dollar for Claude Opus 5. Samme målte intelligens, rundt en femtedel av output-prisen.

Hvorfor prisen betyr mer enn benchmarken

De fleste norske bedrifter som bruker AI i drift, betaler for output-tokens. Et kundeserviceoppsett som genererer svarutkast bruker langt flere output-tokens enn de fleste regner med når piloten settes opp. Det samme gjelder en agent som skriver møtereferater.

Regn på det. En bedrift som genererer 20 millioner output-tokens i måneden, en ganske vanlig størrelse for et kundeserviceteam på ti personer, betaler 600 dollar med GPT-5.6 Sol og 120 dollar med Grok 4.6. Over et år er det rundt 55 000 kroner i forskjell på én arbeidsflyt, med en dollarkurs på 9,50.

Modeller på øverste ytelsesnivå har vært en tung budsjettpost. Når prisen faller til dette nivået, blir flere arbeidsflyter lønnsomme å sette i produksjon.

Kontekstvinduet er 500 000 tokens, bekreftet av både xAI og OpenRouter. Det er nok til å legge inn en hel kontraktsportefølje eller et større regelverk i én forespørsel.

Hvor Grok 4.6 taper mot konkurrentene

xAI markedsfører modellen mot lange agent-kjøringer og koding. Selskapets egen benchmarktabell forteller en mer nyansert historie:

  • DeepSWE v1.1: GPT-5.6 Sol 73 prosent, Grok 4.6 65,9 prosent
  • Terminal-Bench v3.0: GPT-5.6 Sol 34,6 prosent, Fable 5 34,1 prosent, Grok 4.6 26 prosent
  • CursorBench v3.2: Fable 5 70,5 prosent, Grok 4.6 69,9 prosent
  • APEX-Agents: Fable 5 59,2 prosent, Grok 4.6 57,5 prosent

Grok 4.6 vinner klart på Harvey LAB (Vals) med 15,8 prosent mot Fable 5 sine 11,3 og GPT-5.6 Sol sine 2,5. Den benchmarken måler juridisk arbeid.

Bildet er altså at Grok 4.6 leverer omtrent samme totalscore som konkurrentene til en femtedel av output-prisen, samtidig som den taper på flere av de spesifikke kodetestene. For en bedrift som skal velge modell til en konkret oppgave, er totalscoren det minst nyttige tallet.

Det uavklarte spørsmålet: får norske bedrifter kjøpt den?

xAIs kunngjøring sier ingenting om EU eller EØS. Vi har lest den, og temaet er fraværende.

Presedensen er verdt å merke seg. Da Grok 4.5 ble lansert onsdag 8. juli 2026, var modellen blokkert i EU i alle kanaler: Grok Build, Cursor og API-konsollet. Den ble først åpnet for EU-brukere fredag 17. juli, ni dager senere. Vi skrev om dette da det skjedde, i artikkelen om Grok 4.5 og EU-blokkeringen.

Om Grok 4.6 følger samme mønster, vet vi ikke ennå. Poenget for en norsk bedrift er praktisk: test tilgang med din egen API-nøkkel før du legger modellen inn i en pilot eller et budsjett.

Datalagring er et separat spørsmål. xAI kjører i amerikanske regioner og tilbyr ikke EU-dataresidens. For personopplysninger betyr det at overføringsgrunnlag og databehandleravtale må være på plass før første kall til API-et. EU AI Act har vært i full håndheving siden søndag 2. august 2026, og Europakommisjonen har en pågående DSA-gransking mot X og xAI. Vi har skrevet mer om det praktiske rundt dette i veilederen om AI og GDPR i Norge.

Hva vi ville gjort hos en AIKI-kunde

Prisfallet er reelt, og likevel bør dere vente med å bytte modell denne uken. Slik ville vi håndtert det i en AI Partner-leveranse:

Finn den dyreste arbeidsflyten din først. De fleste bedrifter vet ikke hvilken av AI-rutinene deres som faktisk koster mest. Hent ut token-forbruk per arbeidsflyt for siste tre måneder. Som regel står én eller to rutiner for det meste av regningen. Har dere ikke oversikt i det hele tatt, er AI-modenhetstesten et greit sted å begynne.

Kjør en A/B-test på ti reelle oppgaver. Bruk faktiske saker fra egen drift framfor syntetiske eksempler. Fremgangsmåten er den samme som vi bruker i en AI-agent-pilot på fem steg. Kjør dem gjennom dagens modell og gjennom kandidaten. Sammenlign kvaliteten på svarene. Benchmarkscore er sekundært. En modell som scorer likt på Artificial Analysis kan oppføre seg tydelig dårligere på akkurat dine kontrakter, ditt fagspråk eller dine kundehenvendelser.

Bygg for å kunne bytte. Bedrifter som har lagt et tynt abstraksjonslag mellom applikasjonen og modell-API-et, kan bytte leverandør på en ettermiddag. De som har hardkodet én leverandør inn i tjue integrasjoner, kan det ikke. Med prisbevegelser i denne størrelsesordenen hvert kvartal er byttemulighet en konkret økonomisk verdi.

Hold personopplysninger utenfor til avtaleverket er på plass. Test gjerne på anonymiserte eller syntetiske data i mellomtiden. Det er en billig måte å komme i gang på uten å ta juridisk risiko.

Et praktisk eksempel: en teknisk grossist vi jobber med kjører automatisk klassifisering og førsteutkast på innkommende tilbudsforespørsler. Den rutinen bruker rundt 15 millioner output-tokens i måneden. Å teste en billigere modell på den ene arbeidsflyten, med kvalitetsmåling på ti reelle forespørsler, er en jobb på under en dag. Faller kvaliteten, beholder man dagens modell og har lært noe. Holder kvaliteten, er besparelsen målbar fra første måned.

Hos et regnskapsbyrå med 25 ansatte ville regnestykket sett annerledes ut. Der går mesteparten av token-forbruket på dokumenter som inneholder personopplysninger, og da er dataresidens og databehandleravtale viktigere enn prisen per token. Samme nyhet, motsatt konklusjon. Det er nettopp derfor svaret må hentes fra egne tall.

Åpne spørsmål etter lansering

Modellen er få timer gammel. xAI har ikke publisert noe modellkort for Grok 4.6, og selskapets påstand om "widest-ever suite of pre-deployment testing" er ikke etterprøvbar uten den dokumentasjonen. Uavhengige tester finnes ikke ennå.

Hacker News er mottakelsen todelt. Utviklere som har testet modellen, trekker frem hastighet og pris. Andre peker på at Grok 4.5 skuffet på reelle kant-tilfeller til tross for sterke benchmarks, og flere peker på personvern og eierstyring som selvstendig grunn til å avstå.

For en norsk bedrift er den nøkterne konklusjonen at prisen på frontier-intelligens faller raskt, og at det er verdt å måle hva det betyr for din egen drift. Modellvalget bør uansett styres av tall fra egen drift.

Vil du vite hvilke av arbeidsflytene deres som faktisk koster mest, og hva de ville kostet på en annen modell? Ta kontakt, så går vi gjennom token-regningen deres sammen.

Kilder

Del:LinkedInXFacebook