Du velger modell etter tre ting: hva en feil koster, hvor mye tekst som skal gjennom, og om oppgaven må resonneres gjennom. Modellnavnene eldes på uker. Spørsmålene eldes ikke.
De fleste bruker samme modell til alt. Det er som å låne sportsbilen for å hente melk. Det går fint, men du betaler for noe du ikke bruker, og du venter på noe som kunne gått fortere.
Uansett leverandør kommer modellene i omtrent tre størrelser, og toppen kan ha to nivåer. Navnene er ulike, men inndelinga er den samme. Tabellen lenger ned viser hva størrelsene heter akkurat nå.
Raskest og billigst. Riktig når du skal sortere, merke, trekke ut felt eller svare på det samme spørsmålet tusen ganger. Svakest når oppgaven krever dybde eller mange ledd.
Der du bør starte. Skriver, koder, oppsummerer og kan jobbe som agent. Går som regel langt nok.
Tregest og dyrest. Verdt det når en feil koster mer enn tokens: vanskelig analyse, kode som skal i produksjon, tekst med juridiske følger. Hos Claude er Opus 5.5 den vanlige, og Fable 5.1 er et steg opp igjen for de vanskeligste jobbene.
Skrutrekker, drill og CNC-maskin. Alle tre skrur, og du setter ikke opp CNC-maskinen for å henge opp et bilde.
Størrelse er én akse. Den andre er om modellen får resonnere. En modell som resonnerer skriver først et langt arbeidsnotat til seg selv, og svarer etterpå. Det gir bedre svar når oppgaven har mange ledd som henger sammen: regnestykker, planlegging, feilsøking.
Det koster to ting. Tid, fordi svaret kommer senere. Og penger, fordi arbeidsnotatet teller som tekst modellen har skrevet. Du får ikke alltid se det, men du betaler for det. Hos både Anthropic og OpenAI styrer du det med en innstilling for innsats, med nivåer fra lav til maks.
Resonnering hjelper ikke alltid. Til å sortere et skjema eller skrive en e-post er den ofte bare dyr. Test med den av, og slå den på der svaret faktisk blir bedre.
Modellnavnet er det minste av valgene. Det første er hvor teksten din havner, og på hvilke vilkår. For en bedrift er det tre svar, og de krever hver sitt.
Gratis eller privat betalt, med forbrukervilkår. Hos OpenAI kan innholdet brukes til å forbedre modellene med mindre brukeren selv slår det av. Det gjelder Free, Plus, Go og Pro per 8. oktober 2026.
Krever: ingenting av dere, og det er problemet. Ingen avtale, ingen oversikt.
En lukket modell, via en app eller et API, med avtale. Hos OpenAI brukes ikke innhold fra Business, Enterprise eller API til opplæring som standard, per 8. oktober 2026.
Krever: en avtale, en databehandleravtale hvis det er personopplysninger, og en som eier den.
En åpen modell du laster ned og kjører selv. Dataene forlater ikke huset. Du betaler ikke per token, men for maskinene og folkene som driver dem.
Krever: drift, oppdateringer og folk som kan det. Jeg har ikke gått gjennom åpne modellfamilier, så de står ikke i tabellen.
Vilkårene er ulike mellom leverandørene og endres, så tallene over er et eksempel, ikke en regel. Les dem for den dere vurderer. Det er forskjellen mellom privat konto og bedriftsavtale som betyr noe, ikke hvilken modell som står i menyen.
Hva kilden faktisk sier. OpenAI-utsagnene over er lest i søkeutdrag fra OpenAIs sider, ikke på selve siden. De sier hva leverandøren skriver at de gjør som standard, ikke hva en avtale hos dere binder dem til.
Seks i kortversjon. Den fulle listen med ti spørsmål og svaret du vil ha står i Før du signerer.
Prisspørsmålet er ikke teoretisk. Gemini 3.8 Flash dobler prisen 1. januar 2027, knappe tre måneder etter at denne siden er skrevet. Budsjetter med et intervall, ikke med dagens pris.
Du betaler for to ting: teksten du sender inn, kalt input, og teksten modellen skriver, kalt output. Output koster fem til drøyt åtte ganger mer per token hos alle ti modellene i tabellen, regnet med prisen under terskelen for høyere pris. Over terskelen er forholdet lavere hos OpenAI og hos Gemini 3.1 Pro. Likevel er det ofte input som blir størst, fordi hver forespørsel tar med instruksjoner, historikk og vedlegg. Hva som slår ut hos deg, ser du i kalkulatoren for hva AI koster.
Før var det plass som skilte modellene. Nå har alle de fire Claude-modellene og de tre GPT-6-modellene i tabellen rundt en million tokens, omtrent 555 000 ord på engelsk. Det som skiller, er hva du betaler for å fylle det. Claude Haiku 5.5 tar høyere pris for forespørsler over 100 000 tokens, alle de tre GPT-6-modellene over 272 000, og Gemini 3.1 Pro over 200 000. De tre andre Claude-modellene har samme pris hele veien. Les mer om kontekstvinduet.
Her er navnene og prisene slik leverandørene selv oppgir dem. Priser er i dollar per million tokens, standardpris uten rabatt. Inndelinga i liten, middels og stor er min, ikke leverandørens.
Nye modeller kommer og gamle forsvinner fra lista. Prisene endres. Les tabellen som et øyeblikksbilde, og sjekk leverandørens side før du budsjetterer. Alt over tabellen er skrevet for å tåle det.
| Modell | Nivå | Inn | Ut | Merknad |
|---|---|---|---|---|
| Claude Haiku 5.5 | Liten | $0,10 | $0,50 | $0,50 / $2,50 over 100 000 tokens |
| Claude Sonnet 5.5 | Middels | $2 | $10 | Resonnering tilpasser seg selv |
| Claude Opus 5.5 | Stor | $4 | $20 | Resonnering alltid på |
| Claude Fable 5.1 | Størst | $10 | $50 | Resonnering alltid på |
| Modell | Nivå | Inn | Ut | Merknad |
|---|---|---|---|---|
| GPT-6 Luna | Liten | $0,10 | $0,50 | Resonnering kan skrus helt av. $0,20 / $0,75 over 272 000 tokens |
| GPT-6.1 Sol | Middels | $2 | $10 | Innsats fra lav til maks. $4 / $15 over 272 000 tokens |
| GPT-6 Astra | Stor | $10 | $50 | Flaggskip. $20 / $75 over 272 000 tokens |
OpenAIs prisside lister også «gpt-6-sol», med samme pris som GPT-6.1 Sol men høyere cachepris. Den er ikke utfaset: OpenAIs utfasingsside oppgir den som anbefalt erstatter for gpt-5.1, som stenges 1. april 2027. Den står bare ikke på modellsida, og er utelatt fra tabellen.
| Modell | Nivå | Inn | Ut | Merknad |
|---|---|---|---|---|
| Gemini 3.5 Flash-Lite | Liten | $0,30 | $2,50 | Billigste tekstmodell i 3.5-serien med tokenpris |
| Gemini 3.8 Flash | Middels | $0,75 | $3,75 | Dobles til $1,50 / $7,50 fra 1. januar 2027 |
| Gemini 3.1 Pro | Stor | $2 | $12 | Forhåndsversjon. $4 / $18 over 200 000 tokens |
Du kan bruke en modell til å tenke gjennom modellvalget, så lenge du selv svarer på det som koster penger.
Jeg skal bruke AI til [oppgaven, for eksempel: sortere 500 e-poster om dagen]. Volum: [antall ganger per dag og typisk lengde på tekst inn og ut]. Hva en feil koster: [for eksempel: en kollega retter det på ti sekunder / en kunde får feil svar]. Foreslå liten, middels eller stor modell, og om resonnering bør være av eller på. Si hva som taler for og imot, og beskriv en liten test jeg kan kjøre for å se om billigere nivå holder.
Oppdatert oktober 2026. Modellnavn og priser er hentet 8. oktober 2026 fra Anthropics prisside og modelloversikt, OpenAIs prisside og modellside, og Googles prisside og modellside. Tabellen oppgir pris for kort kontekst. For OpenAI betyr det opptil 272 000 tokens input, og prisen over er tatt med i merknaden. Anbefalingen om å starte med Opus 5.5 står i Anthropics modelloversikt. Utsagnene om hva OpenAI gjør med innhold fra privat konto og fra Business, Enterprise og API er lest i søkeresultater fra openai.com 8. oktober 2026, og siden er ikke åpnet direkte. Åpne modellfamilier og andre leverandører er ikke sjekket. «Fem til drøyt åtte ganger» er regnet ut fra tabellen over.