Guide

Spara tokens i Claude: tolv grepp som sänker förbrukningen

Tokens är Claudes valuta. Allt du skickar in och allt Claude skriver räknas. Ju mindre kontext modellen behöver släpa på, desto snabbare, billigare och skarpare blir svaren. Här är knepen som faktiskt sänker förbrukningen, från Anthropics egna kostnadsråd.

Senast uppdaterad · av satori.

Vad är en token?

En token är ungefär tre fjärdedelar av ett ord på svenska. Allt räknas: din text, bifogade dokument och Claudes svar. I en lång chatt skickas dessutom hela historiken med i varje nytt meddelande, så samma tokens betalas om och om igen. Korta, fokuserade chattar är därför den enklaste besparingen.

Så sparar du tokens i Claude

  1. Börja om i en ny chatt när du byter uppgift
  2. Välj rätt modell — Haiku eller Sonnet räcker för det mesta
  3. Sänk utökat tänkande för enkla frågor
  4. Var specifik i stället för bred
  5. Lägg fasta instruktioner i ett Project
  6. Stäng av connectors och MCP-servrar du inte använder
  7. Skicka utdrag i stället för hela dokument
  8. Sammanfatta långa trådar och ta med sammanfattningen till en ny chatt
01

Börja om mellan uppgifter

Byter du ämne? Starta en ny chatt (eller /clear i Claude Code). Gammal kontext släpas annars med i varje nytt meddelande och kostar tokens i onödan.

02

Välj rätt modell

Allt behöver inte toppintelligens. Haiku och Sonnet löser det mesta snabbare och billigare. Spara Opus till svår analys och arkitektur.

03

Dämpa tänkandet på enkelt

Utökat resonemang (extended thinking) räknas som output-tokens, tiotusentals per fråga. Sänk nivån för enkla uppgifter; spara djuptänket till det som kräver det.

04

Var specifik

"Förbättra koden" tvingar Claude att skanna brett. "Lägg till validering i login-funktionen i auth.ts" låter Claude jobba med minimal inläsning.

05

Lägg fasta saker i ett Project

Ton, mallar och riktlinjer hör hemma i ett Project, inte inklistrat i varje prompt. Då bär ni inte samma bakgrundstext om och om igen.

06

Stäng av det du inte använder

Varje aktiv connector eller MCP-server kan lägga på 10 000–20 000 tokens per session bara genom att finnas där. Koppla bort det du inte behöver just nu.

07

Skicka utdrag, inte hela dokument

Claude behöver sällan hela årsrapporten. Klistra in avsnittet frågan gäller, eller be om en sammanfattning först och ställ följdfrågorna mot den.

08

Sammanfatta och byt chatt

När tråden blivit lång: be Claude sammanfatta läget i tio rader, starta en ny chatt och klistra in sammanfattningen. Du behåller kontexten men släpper historiken.

För er som bygger på API:t

Fyra grepp som sänker kostnaden rejält när Claude körs i era egna produkter och agenter.

Prompt cachingÅteranvänd samma systemprompt, dokument eller verktyg och betala bara 10 % av input-priset för det cachade, upp till 90 % billigare på upprepad kontext.
BatchSkicka stora mängder förfrågningar i batch och få dem 50 % billigare när svaret inte måste komma direkt.
Lägg fasta block förstCachning sparar bara prefixet som inte ändras. Placera systemprompt, exempel och långa dokument överst, och det föränderliga sist.
Delegera tunga jobbLåt en subagent läsa loggar, köra tester eller hämta dokumentation. Då stannar den mångordiga utdatan där, och bara en sammanfattning kostar i huvudtråden.

Tumregel: håll kontexten liten och relevant. Det som inte behövs för uppgiften kostar bara tokens och kan dessutom dra fokus från det som faktiskt spelar roll.

Läs vidare: en prompt som träffar rätt första gången är också den billigaste, eftersom du slipper göra om. Greppen står under prompting. Går chatten i taket av ren längd är det kontextfönstret som tagit slut, inte tokenbudgeten — det reder vi ut i Claude säger att chatten nått maxlängd.