Här är hela listan jag lovade i videon, inklusive promptplanering och MCP. Konkreta sätt att spendera färre tokens utan att tappa kvalitet, från vilken modell du väljer till hur du sköter dina chattar. Börja uppifrån, de tre översta gör störst skillnad.
Opus 4.8 är den starkaste modellen, men den kostar mest per token. Sonnet och Haiku är billigare och räcker långt för enklare uppgifter.
Gör så härSpara Opus till det avancerade, som att bygga en sajt eller koda. Vill du slippa välja, kör /model opusplan. Då planerar Opus och Sonnet bygger, så du får Opus-kvalitet på tänket och Sonnets pris på jobbet.
Ju längre en chatt blir, desto mer historik skickas med varje gång du svarar. Det driver upp token-användningen fort.
Gör så härKör /compact för att korta ner en lång chatt, och /clear när du byter uppgift. Med /context ser du vad som tar plats just nu.
En PDF läses som bilder, sida för sida. En enda sida kan kosta runt 1500 till 2000 tokens, många gånger mer än samma innehåll som ren text.
Gör så härKlistra in texten direkt, eller spara dokumentet som .md eller .txt innan du laddar upp. Claude läser ren text och Markdown snabbast och billigast.
Mest tokens försvinner på försök som inte funkar. Låter du Claude lägga en plan först slipper du dyra omtag.
Gör så härSlå på planläget med Shift+Tab i Claude Code, eller kör /model opusplan. Läs igenom planen, ta bort onödiga steg, och låt den bygga sen.
En vag fråga får Claude att leta brett och läsa massor av filer i onödan. En tydlig fråga håller den fokuserad.
Gör så härSäg exakt vad du vill ha. "Lägg till validering i inloggningen i auth.ts" kostar mindre än "förbättra koden".
Gammalt sammanhang från en annan uppgift följer med och kostar tokens varje meddelande, även när du inte använder det.
Gör så härStarta en ny chatt eller kör /clear när du byter ämne. Varje ny chatt börjar på noll.
Varje anslutet MCP-verktyg lägger sin beskrivning i varje meddelande. Många verktyg du aldrig rör äter tokens hela tiden.
Gör så härKör /mcp, se vad som är anslutet, och koppla bort det du inte behöver just nu.
Filen CLAUDE.md laddas in i varje meddelande. En lång fil kan äta tiotusentals tokens innan du ens börjat jobba.
Gör så härTa bort allt som inte behövs varje gång. Flytta detaljerade arbetsflöden till skills, som bara laddas när de faktiskt används.
Claudes extra tänkande räknas som output-tokens. För enkla saker behövs det inte.
Gör så härKör /effort low för enkla uppgifter, och höj igen när du tar dig an något svårt.
En bild kostar tokens efter sin storlek. En stor skärmdump kostar mer än den behöver.
Gör så härSkala ner bilden till det som behöver synas tydligt. Runt 1000 px på längsta sidan räcker nästan alltid.
Prompt caching ger upp till 90% rabatt på sammanhang som upprepas, och är påslaget automatiskt i Claude Code. Bygger du egna körningar via API:t kan Batch API ge 50% rabatt på jobb som inte är brådskande.
Vill du se vad du faktiskt drar? Kör /usage så ser du din token-användning i sessionen. Då vet du vilka av tipsen ovan som ger mest för just ditt sätt att jobba.
Jag hjälper dig komma igång, från första frågan till färdig rutin. Hör av dig så tar vi reda på om och var AI passar för dig eller ditt företag.
Boka ett strategisamtal