Velg modellen etter jobben

Du trenger ikke kunne alle modellnavnene. Du trenger tre spørsmål om jobben, og de eldes ikke. Navnene og prisene gjør det, så de står i en tabell med dato.

Magnus Gribbestad 8. oktober 2026 7 min
Figur · tre spørsmål, fire svar
Beslutningstre for valg av AI-modell Tre spørsmål i rekkefølge. Koster et feil svar mye, gir det stor modell. Må oppgaven resonneres gjennom grundig, gir det middels modell med resonnering på. Er det mye tekst eller mange kall, gir det liten modell uten resonnering. Svares nei på alle tre, er middels modell utgangspunktet. Koster et feil svar mye? JA Stor modell Du sjekker svaret Må den resonnere grundig? NEI JA Middels modell Resonnering på Mye tekst eller mange kall? NEI JA Liten modell Uten resonnering Nei til alle tre NEI Middels modell Start her
  1. Det dyreste spørsmålet først: hva koster det om svaret er feil? Tenk penger, tillit og tid.
  2. Er svaret ja, velg stor modell og la et menneske sjekke. Prisen per token er ikke problemet her. Hos Claude betyr det Opus 5.5 først. Fable 5.1 er et steg opp, til 2,5 ganger prisen.
  3. Er feil billig å rette, spør neste: må den resonnere grundig, med mange ledd som henger sammen?
  4. Ja gir middels modell med resonnering på. Gå opp først når det ikke holder.
  5. Ellers: er det mye tekst eller mange kall? Tusenvis om dagen, for eksempel.
  6. Ja gir liten modell uten resonnering. Det er slik volum blir fort og billig.
  7. Nei til alt gir middels modell. Start der, test, og flytt deg opp eller ned etter resultatet.
Kort sagt

Du velger modell etter tre ting: hva en feil koster, hvor mye tekst som skal gjennom, og om oppgaven må resonneres gjennom. Modellnavnene eldes på uker. Spørsmålene eldes ikke.

De fleste bruker samme modell til alt. Det er som å låne sportsbilen for å hente melk. Det går fint, men du betaler for noe du ikke bruker, og du venter på noe som kunne gått fortere.

Tre størrelser, tre jobber

Uansett leverandør kommer modellene i omtrent tre størrelser, og toppen kan ha to nivåer. Navnene er ulike, men inndelinga er den samme. Tabellen lenger ned viser hva størrelsene heter akkurat nå.

Liten modell

Raskest og billigst. Riktig når du skal sortere, merke, trekke ut felt eller svare på det samme spørsmålet tusen ganger. Svakest når oppgaven krever dybde eller mange ledd.

Volum

Middels modell

Der du bør starte. Skriver, koder, oppsummerer og kan jobbe som agent. Går som regel langt nok.

Utgangspunkt

Stor modell

Tregest og dyrest. Verdt det når en feil koster mer enn tokens: vanskelig analyse, kode som skal i produksjon, tekst med juridiske følger. Hos Claude er Opus 5.5 den vanlige, og Fable 5.1 er et steg opp igjen for de vanskeligste jobbene.

Dyr feil
Et bilde, ikke en fasit

Skrutrekker, drill og CNC-maskin. Alle tre skrur, og du setter ikke opp CNC-maskinen for å henge opp et bilde.

Rask eller grundig

Størrelse er én akse. Den andre er om modellen får resonnere. En modell som resonnerer skriver først et langt arbeidsnotat til seg selv, og svarer etterpå. Det gir bedre svar når oppgaven har mange ledd som henger sammen: regnestykker, planlegging, feilsøking.

Det koster to ting. Tid, fordi svaret kommer senere. Og penger, fordi arbeidsnotatet teller som tekst modellen har skrevet. Du får ikke alltid se det, men du betaler for det. Hos både Anthropic og OpenAI styrer du det med en innstilling for innsats, med nivåer fra lav til maks.

Resonnering hjelper ikke alltid. Til å sortere et skjema eller skrive en e-post er den ofte bare dyr. Test med den av, og slå den på der svaret faktisk blir bedre.

Hvor ligger dataene dine?

Modellnavnet er det minste av valgene. Det første er hvor teksten din havner, og på hvilke vilkår. For en bedrift er det tre svar, og de krever hver sitt.

Privat konto

Gratis eller privat betalt, med forbrukervilkår. Hos OpenAI kan innholdet brukes til å forbedre modellene med mindre brukeren selv slår det av. Det gjelder Free, Plus, Go og Pro per 8. oktober 2026.

Krever: ingenting av dere, og det er problemet. Ingen avtale, ingen oversikt.

Bedriftsavtale hos leverandøren

En lukket modell, via en app eller et API, med avtale. Hos OpenAI brukes ikke innhold fra Business, Enterprise eller API til opplæring som standard, per 8. oktober 2026.

Krever: en avtale, en databehandleravtale hvis det er personopplysninger, og en som eier den.

Egen drift

En åpen modell du laster ned og kjører selv. Dataene forlater ikke huset. Du betaler ikke per token, men for maskinene og folkene som driver dem.

Krever: drift, oppdateringer og folk som kan det. Jeg har ikke gått gjennom åpne modellfamilier, så de står ikke i tabellen.

Vilkårene er ulike mellom leverandørene og endres, så tallene over er et eksempel, ikke en regel. Les dem for den dere vurderer. Det er forskjellen mellom privat konto og bedriftsavtale som betyr noe, ikke hvilken modell som står i menyen.

Hva kilden faktisk sier. OpenAI-utsagnene over er lest i søkeutdrag fra OpenAIs sider, ikke på selve siden. De sier hva leverandøren skriver at de gjør som standard, ikke hva en avtale hos dere binder dem til.

Spørsmål til den som selger deg AI

Seks i kortversjon. Den fulle listen med ti spørsmål og svaret du vil ha står i Før du signerer.

Hvor lagres dataene våre, og i hvilket land?
Brukes innholdet til å trene modeller, og kan det slås av i avtalen og ikke bare i en innstilling?
Får vi en databehandleravtale, og hvem er underleverandørene?
Hva logges, og hvor lenge? Hvem hos dere kan lese det?
Hva skjer med prisen, og hva skjer når modellen vi bruker blir faset ut?
Hvordan kommer vi ut, og får vi dataene våre med oss?

Prisspørsmålet er ikke teoretisk. Gemini 3.8 Flash dobler prisen 1. januar 2027, knappe tre måneder etter at denne siden er skrevet. Budsjetter med et intervall, ikke med dagens pris.

Det som koster mest: input eller output

Du betaler for to ting: teksten du sender inn, kalt input, og teksten modellen skriver, kalt output. Output koster fem til drøyt åtte ganger mer per token hos alle ti modellene i tabellen, regnet med prisen under terskelen for høyere pris. Over terskelen er forholdet lavere hos OpenAI og hos Gemini 3.1 Pro. Likevel er det ofte input som blir størst, fordi hver forespørsel tar med instruksjoner, historikk og vedlegg. Hva som slår ut hos deg, ser du i kalkulatoren for hva AI koster.

100×
Prisforskjellen per token mellom dyreste og billigste Claude-modell, for prompter under 100 000 tokens. Over det er den 20×. Anthropic, 8. oktober 2026.
5–8×
Hvor mye mer output koster enn input per token, under terskelen for høyere pris. Leverandørenes prissider, 8. oktober 2026.
1 M
Tokens kontekstvindu hos Claude og GPT-6. Anthropic og OpenAI, 8. oktober 2026.

Kontekstvinduet skiller ikke lenger

Før var det plass som skilte modellene. Nå har alle de fire Claude-modellene og de tre GPT-6-modellene i tabellen rundt en million tokens, omtrent 555 000 ord på engelsk. Det som skiller, er hva du betaler for å fylle det. Claude Haiku 5.5 tar høyere pris for forespørsler over 100 000 tokens, alle de tre GPT-6-modellene over 272 000, og Gemini 3.1 Pro over 200 000. De tre andre Claude-modellene har samme pris hele veien. Les mer om kontekstvinduet.

Slik velger du i praksis

Modellfamiliene per 8. oktober 2026

Her er navnene og prisene slik leverandørene selv oppgir dem. Priser er i dollar per million tokens, standardpris uten rabatt. Inndelinga i liten, middels og stor er min, ikke leverandørens.

Denne tabellen eldes på uker

Nye modeller kommer og gamle forsvinner fra lista. Prisene endres. Les tabellen som et øyeblikksbilde, og sjekk leverandørens side før du budsjetterer. Alt over tabellen er skrevet for å tåle det.

Anthropic · Claude

ModellNivåInnUtMerknad
Claude Haiku 5.5Liten$0,10$0,50$0,50 / $2,50 over 100 000 tokens
Claude Sonnet 5.5Middels$2$10Resonnering tilpasser seg selv
Claude Opus 5.5Stor$4$20Resonnering alltid på
Claude Fable 5.1Størst$10$50Resonnering alltid på

OpenAI · GPT-6

ModellNivåInnUtMerknad
GPT-6 LunaLiten$0,10$0,50Resonnering kan skrus helt av. $0,20 / $0,75 over 272 000 tokens
GPT-6.1 SolMiddels$2$10Innsats fra lav til maks. $4 / $15 over 272 000 tokens
GPT-6 AstraStor$10$50Flaggskip. $20 / $75 over 272 000 tokens

OpenAIs prisside lister også «gpt-6-sol», med samme pris som GPT-6.1 Sol men høyere cachepris. Den er ikke utfaset: OpenAIs utfasingsside oppgir den som anbefalt erstatter for gpt-5.1, som stenges 1. april 2027. Den står bare ikke på modellsida, og er utelatt fra tabellen.

Google · Gemini

ModellNivåInnUtMerknad
Gemini 3.5 Flash-LiteLiten$0,30$2,50Billigste tekstmodell i 3.5-serien med tokenpris
Gemini 3.8 FlashMiddels$0,75$3,75Dobles til $1,50 / $7,50 fra 1. januar 2027
Gemini 3.1 ProStor$2$12Forhåndsversjon. $4 / $18 over 200 000 tokens

Eldes på år

  • Tre størrelser, og at du starter i midten
  • Resonnering koster tid og penger
  • Output er dyrere enn input per token
  • Feil som koster mer enn tokens

Eldes på uker

  • Modellnavn og versjonsnummer
  • Priser, også de som er «midlertidige»
  • Hvem som leder på hva
  • Hvor mye kontekst du får til hvilken pris, og terskelen der prisen går opp

La modellen hjelpe deg velge

Du kan bruke en modell til å tenke gjennom modellvalget, så lenge du selv svarer på det som koster penger.

Prompt · Velg modellnivå
Jeg skal bruke AI til [oppgaven, for eksempel: sortere 500 e-poster om dagen].
Volum: [antall ganger per dag og typisk lengde på tekst inn og ut].
Hva en feil koster: [for eksempel: en kollega retter det på ti sekunder / en kunde får feil svar].

Foreslå liten, middels eller stor modell, og om resonnering bør være av eller på.
Si hva som taler for og imot, og beskriv en liten test jeg kan kjøre for å se om billigere nivå holder.
Be om testen, ikke bare svaret. Det er testen som sparer penger.

Oppdatert oktober 2026. Modellnavn og priser er hentet 8. oktober 2026 fra Anthropics prisside og modelloversikt, OpenAIs prisside og modellside, og Googles prisside og modellside. Tabellen oppgir pris for kort kontekst. For OpenAI betyr det opptil 272 000 tokens input, og prisen over er tatt med i merknaden. Anbefalingen om å starte med Opus 5.5 står i Anthropics modelloversikt. Utsagnene om hva OpenAI gjør med innhold fra privat konto og fra Business, Enterprise og API er lest i søkeresultater fra openai.com 8. oktober 2026, og siden er ikke åpnet direkte. Åpne modellfamilier og andre leverandører er ikke sjekket. «Fem til drøyt åtte ganger» er regnet ut fra tabellen over.