Organisation

    Din AI koster mest, når du prompter dårligt

    28. august 2026·9 min læsning

    Få styr på dine AI-tokens: hvorfor lange chats og uklare prompts gør AI dyrere, og hvordan korte svar, skarp kontekst og friske tråde sparer både penge, strøm og vand.

    > 📥 Hele guiden findes som PDF (6 sider). Download den øverst på siden — med alle råd, regneeksempler og kilder samlet ét sted.

    Jeg ramte Claude Code-loftet igen i sidste uge. Jeg vælger at se det som et tegn på produktivitet.

    Men det fik mig til at kigge på, hvad jeg egentlig betaler for. Det meste af forbruget var spild. Jeg brugte AI skødesløst: lange tråde, løse prompts, hele filer proppet ind, hvor et enkelt afsnit havde rakt.

    Da jeg skrev om det på LinkedIn, bad en masse af jer om tips. Så her er de. Teknikkerne virker på tværs af de modeller, jeg selv bruger i hverdagen: Copilot, Claude, ChatGPT, Mistral og Gemini. Prisstrukturen ligner hinanden nok til, at de samme greb sparer penge alle steder.

    > Princip. En token er et lille stykke af et ord. Du betaler per token, du sender ind, og per token, du får ud. Det lyder banalt. Det er lige præcis dér, hele pointen gemmer sig.


    1. Det du sender ind er billigt. Det du får retur er dyrt

    Hos stort set alle udbydere koster et svar mere per token end det, du spørger om.

    ModelOutputpris i forhold til input
    Claude5×
    OpenAI6×
    Gemini, afhængigt af model4–6×

    Forholdet mellem output- og inputpris. Status pr. august 2026.

    En model, der plaprer løs, koster altså et multiplum af en, der svarer stramt. Bed om det korte svar, og sæt formen: "Svar i tre punkter", "maks. 200 ord" eller "giv mig kun ændringen, ikke hele filen igen". Brug også chatbotens globale indstilling til at vælge korte og præcise svar, hvor det er muligt.

    Pas på den skjulte post: reasoning-tokens — den "tænkning", modellen laver før svaret — afregnes som output. På en tung analyse kan tænkningen alene være 70–85 procent af outputregningen. Slå dyb tænkning fra, når opgaven ikke kræver den.


    2. En lang chat er en regning, der vokser

    Her er den misforståelse, der koster flest penge: Folk tror, modellen "husker" samtalen gratis. Det gør den ikke.

    Hver gang du sender en besked, læser modellen hele samtalen igen for at kunne svare. Besked nummer 40 betaler også for besked 1–39. Derfor bliver en lang tråd dyrere per besked, jo længere den kører — selv om dine spørgsmål bliver ved med at være korte.

    Regneeksempel

    Du har været i en chat en time. Konteksten fylder nu 50.000 tokens. Du stiller et spørgsmål på 15 ord. Modellen genlæser alle 50.000 tokens for at svare. På Claude Opus-listepris er inputtet til det ene spørgsmål omkring 0,25 dollar. Og du betaler det igen ved næste spørgsmål. Det korte spørgsmål var aldrig omkostningen. Bagagen var.


    3. Den dyreste prompt er den, du skal sende tre gange

    Fordi hver tur frem og tilbage genafsender hele konteksten, er det i pingpongen, pengene brænder. Fem runder med løse spørgsmål koster mere end én skarp. Formulér opgaven og leverancen på forhånd:

    1. Rolle. Hvilken rolle AI'en skal spille.

    2. Minimal kontekst. Kun de filer og vedhæftninger, opgaven kræver.

    3. Opgaven. Forklar præcist, hvad opgaven er.

    4. Leverancen. Hvilket format, til hvem og med hvilke begrænsninger.

    Det er kedeligt at skrive den prompt. Det er dyrt at lade være. Og du behøver ikke et kursus i prompt engineering: Genlæs de fire punkter tre gange. Det er det, du skal vide.


    4. Skarp kontekst slår stor kontekst

    Mere kontekst er ikke bedre kontekst. Giv modellen præcis det, den skal bruge: den relevante fil, det relevante afsnit og de relevante tal. Ikke hele mappen. Når folk spørger mig, hvorfor Copilot kun tager 20 filer, smiler jeg og forklarer, at de skal holde sig langt under de 20.


    5. Engelsk er det billigste sprog at tale med din AI

    De store modellers tokenizer er bygget på engelsk. Engelske ord og endelser er ofte én token. Dansk bliver hakket i flere. Det samme indhold på dansk fylder derfor flere tokens. Hvor meget svinger fra model til model, men på nogle modeller kan det koste op mod 40 procent flere tokens. Æ, ø, å og lange sammensatte ord er de værste syndere.

    Dansk er stadig fint til det meste. Kører du derimod en tung, gentagen opgave, hvor sproget ikke betyder noget for resultatet — eksempelvis kode, dataudtræk eller struktureret analyse — så prøv at prompte på engelsk. Skriv "svar på dansk" til sidst, hvis leverancen skal være på dansk.


    6. Pak sammen og start forfra

    Det her er den vane, der har rykket mest for mig. Når en chat bliver lang og træg, så stop op. Bed AI'en om at lave en handover-pakke, og åbn en frisk chat med den:

    > Lav en handover-pakke: et kort resumé af, hvor langt vi er, hvad der er besluttet, og hvad næste skridt er. Skriv det som en lille tekstfil, som en ny chat kan læse og fortsætte fra.

    Du smider al den døde vægt og beholder kun det, der betyder noget. Billigere, hurtigere og med skarpere svar, fordi modellen ikke skal vade gennem 200 beskeders støj for at finde tråden.


    7. Fem greb mere, der virker alle steder

    1. Vælg den rigtige model til opgaven. Simple opgaver på den lille, hurtige model; tung analyse på den store. Det kan skære 40–60 procent på en blandet arbejdsdag.

    2. Bed altid om det korte svar. Output er den dyre ende. En længde- eller formatgrænse er den nemmeste besparelse.

    3. Sluk for thinking, når du ikke skal bruge den. Reasoning-tokens er output-tokens i forklædning.

    4. Start en ny chat til et nyt emne. Slæb ikke gårsdagens samtale med ind i en ny opgave.

    5. Hold det stabile øverst. De fleste udbydere cacher gentaget kontekst og giver op til 90 procent rabat på den. Læg det, der ikke ændrer sig, først i prompten.


    8. Der er en anden regning end pengene

    Tokens er regnekraft. Regnekraft er strøm og vand. Sam Altman har oplyst, at et gennemsnitligt ChatGPT-spørgsmål bruger omkring 0,34 watt-timer strøm og cirka en femtedel af en teske vand. Det er OpenAI's egne tal fra juni 2025, ikke uafhængigt efterprøvet, så tag dem for, hvad de er.

    Ét spørgsmål er ingenting. Millioner af skødesløse spørgsmål om dagen er noget andet. Det gode er, at det er de samme vaner. Det, der sænker din regning, sænker også dit aftryk.

    > Skarp promptning er grøn promptning.


    9. Tre spørgsmål at tage med på mandag

    1. Hvor mange af jeres AI-samtaler er lange tråde, der burde have været pakket sammen for en time siden?

    2. Hvem har lært jeres folk at bede om det korte svar?

    3. Hvad ville I spare — i kroner og i strøm — hvis I gjorde det til en vane?

    Svaret plejer at overraske. Det er den bedste anledning til at få skrevet et par enkle spilleregler for AI-brug, I nogensinde får.


    Kilder

    Priser og tal er verificeret mod disse kilder pr. august 2026:

    • Claude-priser og prompt caching: platform.claude.com/docs/about-claude/pricing
    • OpenAI-priser: cloudzero.com/blog/openai-pricing
    • Gemini-priser og thinking-tokens: cloudzero.com/blog/gemini-pricing
    • Tokenoptimering: tokenoptimize.dev
    • Strøm- og vandtal per forespørgsel: datacenterdynamics.com
    • Sprog og tokens: arxiv.org/abs/2305.15425 og promptcost.org

    Dette er generel praktisk vejledning, ikke rådgivning du skal træffe beslutninger på alene. Alle priser er oplyst i USD ekskl. moms og kan være ændret; tjek altid leverandørernes egne prissider. Tallene for strøm og vand er OpenAI's egne, oplyst af Sam Altman i juni 2025 og ikke uafhængigt verificeret. Status pr. august 2026.