Tokenpris

Beregn, hvad 10.000 chatforespørgsler koster på jeres faktura.

Opdateret 15. september 2026Læsetid 4 min.Af Brian Brandt · På engelsk: Token pricing / price per token
Indhold
  1. Hvad er et token, og hvorfor koster input og output forskelligt?
  2. Sådan regner du tokenpris på 10.000 kundehenvendelser
  3. Eksempel: IT-chefen og fakturaen før Black Friday
  4. Tokenpris versus abonnement og hvor I skal kigge
  5. Hvad du skal være opmærksom på
  6. Ofte stillede spørgsmål om Tokenpris

Tokenpris er den pris, leverandører opkræver per tekststump kaldet et token. Et token er cirka et halvt til et helt ord, og leverandører fakturerer typisk per million tokens, med forskel på input-tokens (det I sender) og output-tokens (det modellen skriver), hvor output ofte er flere gange dyrere.

Hvad er et token, og hvorfor koster input og output forskelligt?

Et token svarer ikke nødvendigvis til et helt ord: "kør" kan være et token, "kørsel" to. Når I sender en prompt, tæller leverandøren input-tokens; når modellen svarer, tæller den output-tokens. Det betyder, at en lang prompt + et langt svar giver dobbeltforbrug. Typisk er prisen sat per million tokens, og leverandører differentierer prisen mellem input og output, fordi det kræver mere beregning at generere tekst.

Modeller spænder i pris: mindre modeller kan koste under 1 dollar per million tokens, mens flagskibsmodeller kan koste 20 til 30 dollar per million tokens for output. Der findes ofte rabatter, hvis svar kan caches (gentagne forespørgsler genbruges) eller ved batchkørsel, hvor flere forespørgsler behandles samlet.

Sådan regner du tokenpris på 10.000 kundehenvendelser

Start med at estimere to ting: hvor mange tokens sender hver henvendelse (input), og hvor mange tokens svarer modellen med (output). Som tommelfingerregel kan du bruge ord-tokens i stedet for præcis tokenoptælling: ét ord ≈ 1 token for et groft skøn.

  1. Gennemsnitlig længde på kundens besked: f.eks. 20 ord → 20 input-tokens per henvendelse.
  2. Gennemsnitlig længde på AI-svar: f.eks. 120 ord → 120 output-tokens per henvendelse.
  3. Total tokens pr. henvendelse = 20 + 120 = 140 tokens.
  4. For 10.000 henvendelser = 1.400.000 tokens → 1,4 millioner tokens.
  5. Del input og output, hvis leverandøren prissætter dem forskelligt: 10.000 × 20 input = 200.000 input-tokens; 10.000 × 120 output = 1.200.000 output-tokens.

Sæt nu de priser på: hvis input koster 0,5 $ per million og output 20 $ per million, bliver regningen: input 0,5 $ × 0,2 = 0,10 $; output 20 $ × 1,2 = 24 $. Samlet ≈ 24,10 $ for måneden i brutto-token-omkostning. Husk, fakturaer afrunder ofte pr. million og kan have minimumsbeløb, så tjek leverandørens detaljer.

Eksempel: IT-chefen og fakturaen før Black Friday

IT-chefen på en mellemstor webshop åbner leverandørens prisbilag mandag morgen, tre uger før Black Friday. De har planlagt 10.000 chatbot-henvendelser om måneden i produkt-sæsonen. Første forsøg: chatprompten er lang, produkt-id, ordrestatus, tre linjer kontekst, og svarene er detaljerede, ofte 150 til 200 ord. Fakturaen ser stor ud. Modstanden: svarene var for lange og gentog information, og cache-muligheden i leverandørens dokumentation var ikke slået til. Løsningen tog en uge: IT-chefen forkortede prompten, trænede standard-svar og aktiverede caching for gentagne spørgsmål. Resultatet var lavere output-token-forbrug, men også en ekstra uge på drift og en time til at omformulere prompts pr. dag i implementeringsfasen. Læringen var klar: tokenpris måles i tal, men styring koster tid.

Tokenpris versus abonnement og hvor I skal kigge

Sammenlign pr. token med abonnementstilbud: nogle leverandører tilbyder fast pris for et sæt antal forespørgsler eller brugere, andre fakturerer udelukkende pr. token. Afhængigt af jeres volumen kan abonnement give forudsigelighed, mens forbrugsbetaling oftere er billigere ved spidsbelastninger. Kig efter: opdeling af input vs output, minimumsafregning, cache- eller batch-rabatter, og om leverandøren fakturerer per million tokens eller per 1.000.

Hvad du skal være opmærksom på

Tjek fakturaens opdeling: står input og output separat? Er der en månedlig minimumsafregning? Spørg om cache-regler og batch-rabatter, og få klarhed i, hvordan taksering håndteres ved fejl eller afbrudte svar. En billig pris per million kan blive dyr, hvis modellerne genererer lange svar eller hvis I ikke bruger caching. Og husk: tokenpris hjælper jer med at regne på omkostninger, men styringen kræver procesændring og løbende måling.

Skal flere end én i huset kunne noget med tokenpris, så se, hvordan en AI-workshop er skruet sammen. Det tunge ved tokenpris er sjældent at komme i gang, men at holde det kørende. Det er jobbet for et AI-team i huset.

Ofte stillede spørgsmål om Tokenpris

Er tokenpris det samme som et abonnement?

Nej. Tokenpris er betaling per forbrugt token (typisk per million tokens). Et abonnement er en fast pris, som kan inkludere et vist antal forespørgsler eller tokens. Valget afhænger af jeres volumen og behov for forudsigelighed.

Hvordan regner jeg tokens per besked?

Skøn ved at tælle ord: ét ord svarer groft til et token. Læg antal ord i prompt og svar sammen, gang med antallet af henvendelser, og del med en million for pris per million. For præcis optælling brug leverandørens token-tæller.

Kan jeg reducere omkostninger ved tokenpris?

Ja. Reducer prompt- og svar-længde, aktiver caching for gentagne forespørgsler, brug batchkørsel og overvej en mindre model til simple opgaver. Husk, ændringer koster tid at implementere.

Er output altid dyrere end input?

Ofte ja. Generering kræver mere beregning, så mange leverandører sætter en højere pris på output-tokens end på input-tokens. Læs leverandørens prisbilag nøje.

Brian Brandt

AI-rådgiver og underviser, grundlægger af AI Hero i Herning. Har bygget digitalt i over 20 år og hjælper danske virksomheder med at få AI i drift. Læs mere om Brian.

Relaterede ord i AI-ordbogen

Mangler der et ord, eller er der noget der er forkert?

Skriv til brian@aihero.dk eller ring på 28 35 84 54. Ordbogen bliver bedre af det.

Tilbage til ordbogen

AI, der kommer i drift. Én mail om måneden.

Brian skriver om, hvad der reelt virker med AI i danske virksomheder, set fra gulvet hos dem, der bruger det hver dag. Ingen hype, ingen nyhedsstrøm.

  • Konkrete eksempler: hvad der virkede, hvad det kostede, og hvad der gik galt
  • Værktøjer jeg selv bruger, testet i praksis, før de nævnes
  • Ét brev om måneden. Ikke mere. Afmeld når du vil.

Du får en mail, hvor du bekræfter din tilmelding. Vi deler aldrig din adresse, privatlivspolitik.