Prisen på AI faller som en stein. Fronten blir dyrere.
Kostnad
Det er to bevegelser i prisen på AI akkurat nå, og de går i hver sin retning. Å blande dem sammen er dyrt.
Bevegelse én: en gitt kapabilitet blir nesten gratis
Stanfords AI Index målte hva det kostet å kjøre en modell som scoret på nivå med GPT-3.5 på Et mye brukt benchmark med flervalgsspørsmål på tvers av 57 fagfelt, fra jus til fysikk.. I november 2022 kostet det 20 dollar per million Tekst delt opp i småbiter som modellen regner på. Et norsk ord er typisk ett til tre tokens. Prisen på en modell oppgis alltid per million tokens.. I oktober 2024 kostet den samme prestasjonen 0,07 dollar. Det er et fall på over 280 ganger på rundt atten måneder.
| Fra | Billigste modell tilgjengelig | Pris per mill. tokens |
|---|---|---|
| November 2021 | GPT-3 | $60 |
| Mars 2023 | GPT-3.5 Turbo | $2,00 |
| November 2023 | GPT-3.5 Turbo | $0,75 |
| Desember 2023 | Llama 2 7B | $0,20 |
| Mai 2024 | Gemini 1.5 Flash | $0,13 |
| Juli 2024 | Llama 3.1 8B | $0,10 |
Billigste modell dere kunne ringe, på 6 tidspunkter. Fra 60 dollar til 10 cent på under 3 år, altså en sekshundredel. Kilde: Epoch AI.
Epoch AI finner det samme på tvers av seks En fast prøve som modeller kjøres på, slik at resultater kan sammenlignes på tvers av modeller og over tid.: prisfall mellom 9 og 900 ganger i året, median rundt 50. De tar selv forbehold om at de raskeste fallene er nye, og kanskje ikke varer.
Det dere betaler mest for i dag, er trolig det billigste dere kjøper om halvannet år.
Bevegelse to: fronten trekker fra
Samlet sett er prisene kraftig ned. Men bryter man opp de siste tolv månedene, går segmentene hver sin vei: frontmodeller opp 36,4 prosent, mellomsjiktet ned 35,8 prosent.
Avstanden mellom det ypperste og det som er godt nok, øker altså. Kostnaden ved å velge feil nivå er større i dag enn i fjor.
Spennet er større enn folk tror
Medianen blant 143 modeller er 1 dollar per million tokens inn og 3,60 ut. Men mellom dyreste og billigste frontmodell er forskjellen 643 ganger, på modeller du kaller med nesten identiske forespørsler.
| Modell | Inn | Ut | Når den er riktig |
|---|---|---|---|
| GPT-5.5 pro | $30 | $180 | Lange resonnementer der feil er dyrt |
| Claude Fable 5 | $10 | $50 | De vanskeligste stegene i en løkke |
| GPT-5.6 Sol | $5 | $30 | Front, bredt anvendelig |
| Claude Opus 5 | $5 | $25 | Front, bredt anvendelig |
| Kimi K3 | $3 | $15 | Øvre mellomsjikt |
| GPT-5.6 Terra | $2 | $12 | Arbeidshesten i de fleste systemer |
| Gemini 3.1 Pro | $2 | $12 | Arbeidshesten, lange kontekster |
| Grok 4.5 | $2 | $6 | Mellomsjikt til lav pris |
| DeepSeek V4 Flash | $0,14 | $0,28 | Klassifisering, uttrekk, ruting |
Dollar per million tokens, hentet 7. august 2026. Vi har kryssjekket mot tre uavhengige pristrackere og tatt med modellene der minst to var enige. Prisene endres månedlig, så bruk tabellen til å forstå størrelsesordener, ikke til å budsjettere.
Legg merke til hvor arbeidshestene ligger. Et system som kjører alt på toppmodellen betaler 15 ganger prisen på et som kjører det meste på mellomsjiktet, for oppgaver der forskjellen i kvalitet ofte ikke er merkbar.
Samtidig konvergerer kvaliteten
Per mars 2026 lå Anthropic, xAI, Google, OpenAI, Alibaba og DeepSeek innenfor 25 Et rangeringstall hentet fra sjakk. Brukes til å rangere modeller ut fra hvem som vinner direkte sammenligninger.av hverandre på Arena-rangeringen. Konkurransen har flyttet seg fra kapabilitet til pris og driftssikkerhet. Samtidig har kapabiliteten flyttet seg voldsomt: på Humanity's Last Exam gikk beste resultat fra 8,8 prosent i 2025 til 38,3 prosent i april 2026.
Hva dette betyr for dere
Ikke bygg systemet rundt én modell
En arkitektur låst til én leverandør blir dyr av seg selv når prisene faller så fort. Legg modellvalget bak et lag dere kan bytte ut på en ettermiddag.
Gå gjennom systemer som er over et år gamle
Et system satt opp på fjorårets front gjør trolig en jobb mellomsjiktet nå klarer til en brøkdel. Det er ikke sikkert det er verdt å bytte, men det er verdt å regne på.
Betal for fronten der den faktisk trengs
Dette er ikke et argument for å alltid velge billigst, men for å vite hvilke få steg som krever det beste.
Uten evaluering kan dere ikke ta gevinsten
Kan dere ikke Å kjøre systemet på et sett kjente eksempler og måle hvor ofte svaret er riktig, slik at dere ser om en endring gjorde det bedre eller verre. om kvaliteten holdt seg etter et bytte, blir prisfallet noe dere leser om. Det er den vanligste grunnen til at virksomheter fortsetter å betale fjorårets pris.
Kilder
- Epoch AI, LLM inference prices have fallen rapidly but unequally across tasks
- Stanford HAI, AI Index 2025: State of AI in 10 Charts
- Stanford HAI, The 2026 AI Index Report
- IEEE Spectrum, Stanford's AI Index for 2026 Shows the State of AI
- BenchLM, LLM API Pricing Comparison
- CostGoat, LLM API Pricing Comparison
- LLM Stats, AI Trends
- Developers Digest, Frontier Model API Pricing, July 2026
Tallene er hentet i august 2026. Priser og benchmarkresultater endrer seg raskt, så sjekk kildene før dere bruker enkelttall i en beslutning.
