Nyheter
Nav

24. juli 2026

Slik tester du de fem nye Copilot-modellene uten å sprenge kvoten

Fem nye modeller er slått på i Copilot for Nav. Her er en ærlig oversikt over hva de koster og når du faktisk bør bruke dem, uten salgsprat fra leverandørene. Som en sen tilføyelse kom også Anthropics nye toppmodell Claude Opus 5 24. juli. Den er i en helt annen (og dyrere) klasse og har fått et eget avsnitt lenger ned.


Oversikt: Hva koster de, og hva er de gode for?

ModellKategoriInputOutputStyrkeBruk til
GPT-5.6 LunaLightweight$1.00$6.00Rask og billigEnkle spørsmål, boilerplate, lette tester
GPT-5.6 TerraVersatile$2.50$15.00Balansert allrounderDaglig koding, PR-beskrivelser, refaktorering
GPT-5.6 SolPowerful$5.00$30.00Dypest resonneringStore kodebaser, arkitektur, seige bugs
Kimi K2.7 CodeVersatile$0.95$4.00Kodeforståelse og visuell kodingTunge agent-looper og "mockup til kode"
Gemini 3.6 FlashVersatile$1.50$7.50Token-gjerrig agentRaske agent-oppgaver med mange verktøy
Claude Opus 5Powerful$5.00$25.00Justerbar innsats, near-frontierDyp risikovurdering, sikkerhetskritisk kode

Priser per 1M tokens i USD. Sammenlign med Claude Sonnet 4.6: $3.00 inn / $15.00 ut.

Tips: GPT-5.6 Sol og Claude Opus 5 er bare tilgjengelig for Pro+, Max, Business og Enterprise, ikke Pro.


GPT-5.6-familien: Ikke bruk Sol til alt

OpenAI lanserer én modellfamilie delt inn i tre «gir». Tanken er at du skal bytte gir etter hvor vanskelig oppgaven er, slik at du ikke kaster bort penger på unødvendig prosessering.

  • Luna (1. gir): Ekstremt rask og billig. Men: Den er ikke spesielt smart. Bruk den til rutinearbeid, enkel dokumentasjon og når du bare trenger rask autofullfør. Styr unna kompleks logikk.
  • Terra (2. gir): Standardvalget for hverdagskoding. Den klarer de fleste jobber godt nok, og erstatter typiske "velg og glem"-modeller.
  • Sol (3. gir): Modellen med tyngst resonnering, men som koster mye. Fantastisk til å beholde fokus over lang tid og til å vurdere arkitektur. Den drar også stor fordel av prompt caching, som gjør den billigere hvis du sender inn samme, store kodebase gjentatte ganger. Men: Ikke bruk den til enkle oppgaver. Den er overpriset ("overkill") for hverdagskoding.

Kimi K2.7 Code: Den tvungne tenkeren

Kimi K2.7 Code er den første open-weight-modellen i Copilots modellvelger. Den er spesielt trent for langvarige kodeprosjekter.

  • Det som fungerer: Den er veldig god på å følge lange instruksjoner og holde kontekst over mange steg. Som open-weight-modell gir den dessuten en interessant pris/ytelse-ratio i agent-løkker der mange kall kjøres i sekvens.
  • Haken: Den må alltid «tenke». Du kan ikke skru av tenkemodusen for å få et umiddelbart, lynraskt svar. Den når heller ikke helt opp til de dyreste toppmodellene på komplekse kodingstester.

Gemini 3.6 Flash: En token-gjerrig arbeidshest

Google fokuserer på effektivitet med Gemini 3.6 Flash. Dette er modellen du vil bruke til agent-arbeidsflyter (der AI-en jobber selvstendig i mange steg).

  • Det som fungerer: Den kaster bort færre tokens enn forgjengeren. Der andre modeller «kavner» (thrashing) med å prøve og feile mange ganger, treffer Gemini 3.6 Flash oftere på første eller andre forsøk. Google rapporterer høyere fullføringsgrad og bedre token-effektivitet enn 3.5 Flash på koding og agentoppgaver. Den er dessuten svært god på å bruke flere verktøy parallelt.
  • Haken: Dette er en arbeidshest, ikke et geni. Den vil slite hvis du ber den om å løse dype, arkitektoniske problemer som krever ekstrem resonnering. Den har også en tendens til å bli litt «pratsom» og overformatere svar hvis du ikke ber den være kort.

Claude Opus 5: Toppmodellen med justerbar innsats

Dette er ikke en «test uten å sprenge kvoten»-modell. Den er tvert imot Anthropics dyreste og sterkeste, og kom som en sen tilføyelse 24. juli. Men den er verdt å kjenne til, fordi den løser et velkjent problem med Opus-klassen: at du betaler toppris uansett hvor lett oppgaven er.

  • Det som fungerer: Opus 5 er «near-frontier» og ligger helt i toppsjiktet på resonnering og nyanserte vurderinger, til samme pris per token som Opus 4.8 ($5 inn / $25 ut). Det nye er justerbar innsats (effort): du kan skru innsatsen opp til nivåer som xhigh og max når oppgaven virkelig krever det, og ned igjen for enklere arbeid. Dermed betaler du for tung resonnering bare når du faktisk trenger den.
  • Når bruke den: Dyp risikovurdering og sikkerhetskritisk kode, der vi tidligere pekte på Claude Opus 4.6/4.8. Opus 5 er det nye førstevalget for slikt arbeid; 4.6/4.8 er fortsatt tilgjengelig.
  • Haken: Den er kun tilgjengelig for Pro+, Max, Business og Enterprise (ikke Pro), utrullingen er gradvis, og innebygde sikkerhetstiltak mot høyrisiko cyber-innhold kan i noen tilfeller blokkere sikkerhetsrelaterte forespørsler. Bruk den bevisst. Til rutinekoding er den kraftig overpriset.

Slik velger du modell i VS Code

  1. Åpne Copilot Chat (Ctrl+Alt+I / Cmd+Option+I)
  2. Klikk på modellnavnet øverst i chat-vinduet
  3. Velg modell fra listen

Modellvelgeren er også tilgjengelig i Copilot CLI, JetBrains, Visual Studio og GitHub.com.


Rask huskeregel

Ikke sikker på hvilken modell du skal velge?

  • Rask rutinejobb? Luna. (Eller Kimi hvis det er greit at den må tenke litt først).
  • Vanlig feature-utvikling? Terra. (Eller Auto).
  • Agent som skal rydde opp med mange verktøy? Gemini 3.6 Flash (den roter minst).
  • Kompleks arkitektur og vriene bugs i store repoer? Sol. (Men bare da).
  • Dyp risikovurdering eller sikkerhetskritisk kode? Claude Opus 5, og skru opp effort når det trengs. (Kun Pro+/Max/Business/Enterprise).

Og husk: Auto-modus velger en passende modell for deg med innebygd kostnadsrabatt. Men med disse retningslinjene vet du i alle fall hvorfor du eventuelt overstyrer den.


Kontekst: Hvordan passer de inn i resten?

Disse fem modellene er tillegg til det vi allerede har, ikke erstatninger. Det er fortsatt mange gode grunner til å bruke Anthropic- og Google-modellene du kjenner fra før.

BruksmønsterGode valgHvorfor
Norsk tekst, microcopy, PR-beskrivelserClaude Sonnet 4.6 / Sonnet 5Anthropic-modellene er best på norsk
Dyp risikovurdering, sikkerhetskritisk kodeClaude Opus 5 (Opus 4.6/4.8 fortsatt tilgjengelig)Sterkest på resonnering og nyanserte vurderinger, med justerbar effort
Research, store kodebaser med mye kontekstGemini 3.1 ProOvertar rollen etter Gemini 2.5 Pro, som utfases 31. juli
Sjekklister, templates, scaffold-promptsClaude Haiku 4.5Rask og billig for enkle strukturerte oppgaver
Daglig koding, refaktoreringTerra, Sonnet 5, AutoAlle tre er solide allroundere i samme prisklasse
Agentiske workflows med mange verktøykallGemini 3.6 Flash, SolFlash for parallelle verktøy, Sol for tung kontekst
Kostnadseffektiv agent-loopingKimi K2.7 CodeRimeligste alternativ i Versatile-kategorien

De nye GPT-5.6-modellene er et godt supplement, særlig for utviklere som allerede er vant til GPT-familien eller vil ha et OpenAI-alternativ til Sonnet-klassen. Men Claude Sonnet 5 til $2/$10 (kampanjepris til 31. august) er fortsatt et svært konkurransedyktig valg i den samme klassen. Merk at Gemini 2.5 Pro utfases 31. juli. Gemini 3.1 Pro overtar rollen for research og lange kontekstvinduer.

Se prissiden for fullstendig sammenligning av alle modeller og priser.

Alle nyheter