Börja om mellan uppgifter
Byter du ämne? Starta en ny chatt (eller /clear i Claude Code). Gammal kontext släpas annars med i varje nytt meddelande och kostar tokens i onödan.
Guide
Tokens är Claudes valuta. Allt du skickar in och allt Claude skriver räknas. Ju mindre kontext modellen behöver släpa på, desto snabbare, billigare och skarpare blir svaren. Här är knepen som faktiskt sänker förbrukningen, från Anthropics egna kostnadsråd.
En token är ungefär tre fjärdedelar av ett ord på svenska. Allt räknas: din text, bifogade dokument och Claudes svar. I en lång chatt skickas dessutom hela historiken med i varje nytt meddelande, så samma tokens betalas om och om igen. Korta, fokuserade chattar är därför den enklaste besparingen.
Byter du ämne? Starta en ny chatt (eller /clear i Claude Code). Gammal kontext släpas annars med i varje nytt meddelande och kostar tokens i onödan.
Allt behöver inte toppintelligens. Haiku och Sonnet löser det mesta snabbare och billigare. Spara Opus till svår analys och arkitektur.
Utökat resonemang (extended thinking) räknas som output-tokens, tiotusentals per fråga. Sänk nivån för enkla uppgifter; spara djuptänket till det som kräver det.
"Förbättra koden" tvingar Claude att skanna brett. "Lägg till validering i login-funktionen i auth.ts" låter Claude jobba med minimal inläsning.
Ton, mallar och riktlinjer hör hemma i ett Project, inte inklistrat i varje prompt. Då bär ni inte samma bakgrundstext om och om igen.
Varje aktiv connector eller MCP-server kan lägga på 10 000–20 000 tokens per session bara genom att finnas där. Koppla bort det du inte behöver just nu.
Claude behöver sällan hela årsrapporten. Klistra in avsnittet frågan gäller, eller be om en sammanfattning först och ställ följdfrågorna mot den.
När tråden blivit lång: be Claude sammanfatta läget i tio rader, starta en ny chatt och klistra in sammanfattningen. Du behåller kontexten men släpper historiken.
Fyra grepp som sänker kostnaden rejält när Claude körs i era egna produkter och agenter.
Tumregel: håll kontexten liten och relevant. Det som inte behövs för uppgiften kostar bara tokens och kan dessutom dra fokus från det som faktiskt spelar roll.
Läs vidare: en prompt som träffar rätt första gången är också den billigaste, eftersom du slipper göra om. Greppen står under prompting. Går chatten i taket av ren längd är det kontextfönstret som tagit slut, inte tokenbudgeten — det reder vi ut i Claude säger att chatten nått maxlängd.