
Hva koster en AI-forespørsel? Vi målte ni operasjoner.
Kortversjonen: den 30. juli 2026 kjørte vi ni typer forespørsler gjennom Google Vertex AI og logget antall tokens direkte fra API-svarene. Hovedfunnet: lesing er billig for en AI, skaping er dyrt, og forskjellen er tusenfoldig. Å se en ti-minutters YouTube-video koster to cent. Å generere åtte sekunder video koster tre dollar og tjue cent. Samme teknologi, samme regning, men operasjoner av en helt annen art — og du kan ikke planlegge et budsjett uten å forstå den forskjellen.
Slik målte vi det
Ikke fra kalkulatorer på markedsføringssider og ikke fra leverandørers bloggløfter. Hver forespørsel gikk til Vertex AI på prosjektets tjenestekonto, og fra hvert svar tok vi usageMetadata-blokken — der modellen selv rapporterer hvor mange tokens inputen din kostet og hvor mange svaret kostet.
Deretter multipliserte vi med Googles publiserte priser per 30. juli 2026 for Gemini 2.5 Flash-Lite-familien: $0.10 per million input tokens (tekst, bilder, video), $0.30 per million audio input tokens og $0.40 per million output tokens. Priser for videogenerering kommer fra Veo 3.1-listen: $0.40 per sekund i standardmodus.
Metoden er viktig fordi den lar deg gjenta den: de samme tallene ligger i svaret på enhver forespørsel du gjør, hvis du ser på usageMetadata.
Tabellen: hva koster hva
| Operasjon | Hva skjer | Kostnad per kjøring |
|---|---|---|
| Et tekstspørsmål | ~300 tokens inn, ~500 ut | $0.0003 |
| Lesing av et bilde | bilde pluss et kort svar | $0.001 |
| Transkribering av 30s tale | lyd koster tre ganger tekst | $0.0008 |
| Lesing av et avsnitt høyt | talesyntese | $0.0006 |
| Se en 3-minutters video | 51k tokens | $0.006 |
| Se en 10-minutters video | 171k tokens | $0.02 |
| Generering av ett bilde | 1 290 output tokens | $0.04 |
| 8s video, rask modus | fakturert per sekund | $0.64 |
| 8s video, standard modus | fakturert per sekund | $3.20 |
Funnene: å se er billigere enn å lage
Sammenlign to rader. Å analysere andres ti-minutters video: to cent. Å generere åtte sekunder av din egen: tre dollar og tjue cent. Det er 160 ganger mer for syttifem ganger færre sekunder.
Årsaken er hvordan faktureringen fungerer. Alt du sender modellen er input tokens — det billigste på prislisten. Alt den produserer er output, og output koster flere ganger mer. Med Flash-Lite er input $0.10 per million og output er $0.40 — fire ganger. Bilde- og videogenerering faktureres separat igjen, med helt andre satser.
Derfor er regelen som sparer mest penger: forkort svaret, ikke spørsmålet. En linje som sier «svar i ett avsnitt» kutter regningen din mer enn å halvere spørsmålet ditt. Den dyreste frasen du kan skrive til en modell er «forklar i detalj, med alle eksemplene».
Video, sekund for sekund
Vi målte dette separat ved å trimme ett klipp til forskjellige lengder. Modellen teller video som 258 tokens per sekund med opptak og 25 tokens per sekund med lyd. Forholdet er strengt lineært — fem sekunder ga 1 290 tokens, ti sekunder ga nøyaktig 2 580.
| Lengde | Tokens | Kostnad å analysere |
|---|---|---|
| 5 sekunder | 1 415 | $0.0002 |
| 1 minutt | 17 000 | $0.002 |
| 5 minutter | 85 000 | $0.010 |
| 10 minutter | 171 000 | $0.020 |
Hva dette betyr i praksis: å analysere video er ikke en luksus. Å trekke ut essensen fra en timeslang forelesning koster omtrent tolv cent. Din egen tid på å formulere oppgaven vil koste mer.
Hvorfor du fortsatt må regne på det
En enkelt forespørsel koster en brøkdel av en cent, noe som skaper inntrykk av at det ikke er noe å telle. Det inntrykket er feil av to grunner.
Først: en samtale blir dyrere for hver melding. Modellen husker ikke tidligere runder — for at den skal følge konteksten, sendes hele utvekslingen på nytt med hver forespørsel. Din tiende melding drar de ni før den med seg, og alle teller som input igjen. Du fortsetter å skrive like korte svar mens regningen stiger av seg selv.
For det andre: noen språk koster omtrent dobbelt så mye som engelsk. Modellen teller verken bokstaver eller ord, men tokens — tekstbiter. Engelsk deles inn i større biter: ett token er omtrent fire tegn der, mens det i mange andre språk er nærmere to. Den samme tanken koster halvannen til to ganger mer.
Hva du kan gjøre med det
- Begrens svarlengden eksplisitt. «Tre setninger», «ett avsnitt», «en liste med fem» — det er direkte besparelser, ikke stilistisk pirk.
- Start en ny chat for en ny oppgave. En lang alt-i-ett-tråd koster mer enn en fersk chat med samme spørsmål — og fungerer bedre, fordi den utdaterte konteksten slutter å være i veien.
- Ikke generer det du kan finne. Å lese et eksisterende klipp eller dokument er nesten alltid billigere enn å lage ditt eget.
- For lange tekniske prompts, prøv engelsk. Det handler ikke bare om pris: modeller har lært mest fra engelsk tekst og følger en engelsk brief mer presist.
Forbeholdene, uten hvilke tallene lyver
Vi målte én modell — Gemini 2.5 Flash-Lite — på én sky. Kraftigere modeller koster flere ganger mer; konkurrenter har sine egne prislister. Det som gjelder overalt er størrelsesordenen og, viktigere, forholdet mellom operasjoner: input er billigere enn output, lesing er billigere enn skaping.
For det andre: tariffer endres. Våre tall er datert 30. juli 2026. Sjekk prisen på leverandørens egen prisside i stedet for i artikler — inkludert denne.
FAQ
Hva koster en enkelt ChatGPT- eller Gemini-forespørsel for en vanlig bruker?
Hvis du bruker et chat-grensesnitt med abonnement, koster det ingenting utover abonnementet — grenser der telles i forespørsler, ikke penger. Tallene i denne artikkelen gjelder for API-tilgang, der en AI er koblet til din egen programvare og du betaler per token: $0.0003 for et tekstspørsmål, $0.001 for å lese et bilde, $0.04 for et generert bilde.
Hvorfor koster det mer å generere ett bilde enn å lese ti bilder?
Fordi det er operasjoner av en annen type. Å lese et bilde betyr å sende det som input, og input tokens er det billigste på listen. Å skape et bilde betyr å produsere output, som faktureres separat og er mye dyrere. I våre målinger koster ett generert bilde $0.04, mens lesing av et bilde koster $0.001 — førti ganger mindre.
Hva koster det å få en AI til å analysere en YouTube-video?
Målt den 30. juli 2026 med Gemini 2.5 Flash-Lite: 258 tokens per sekund med opptak pluss 25 tokens per sekund med lyd. Et ti-minutters klipp kommer på omtrent 171 000 tokens, omtrent $0.02. En time video koster omtrent tolv cent.
Stemmer det at videogenerering koster dollar per sekund?
Ja. Veo 3.1 faktureres per sekund: $0.40 per sekund i standardmodus og fra $0.05 i lite-nivået. Et åtte-sekunders klipp koster $3.20 i standardmodus — mer enn å analysere hundre og femti timer av andres video.
Hvordan kutter du AI-kostnader uten å miste kvalitet?
Tre vaner gjør det meste av jobben. Først, begrens svarlengden eksplisitt, fordi output tokens koster fire ganger input. For det andre, start en ny chat for en ny oppgave — hele historikken sendes på nytt med hver melding. For det tredje, ikke generer det du kan finne og lese i stedet.
Hvorfor koster tekst på noen språk mer enn engelsk?
Modellen teller verken bokstaver eller ord, men tokens – tekstbiter. Engelsk deles inn i større biter: omtrent fire tegn per token, mot rundt to i mange andre språk. Den samme tanken krever halvannen til dobbelt så mange tokens, og koster proporsjonalt mer.
Hvor kan jeg se hvor mange tokens min egen forespørsel brukte?
API-svaret inneholder en usageMetadata-blokk der modellen rapporterer antall input- og output-tokens, fordelt etter modalitet: tekst, bilde, video, lyd. Alle tallene i denne artikkelen kom derfra, og du kan gjenta målingen på dine egne forespørsler.