Blyerts
MenyTeach & TalkSköt hemsidan med AILagarna kring AI och dataDet nya arbetslivetAI och samhälletAlla temanRedaktörernaKurserMetoderKontexterOrdbokenPlattformenCoWork StudioMedlemskap BasNytt och omskrivetMedlemskap Bas · gratis till nyår

Token

Textens minsta enhet; det modellen räknar och tar betalt i.

OrdbokenBegreppEtablerad kunskap

Token

Textens minsta enhet; det modellen räknar och tar betalt i.

En token är den minsta textenhet en språkmodell arbetar med — oftast ett ordfragment, ett kort helt ord eller ett skiljetecken snarare än ett helt ord. Modellen läser, resonerar och genererar en token i taget, och både kontextfönstrets storlek och prissättningen mäts i tokens, uppdelat på in-tokens (det du skickar in) och ut-tokens (det modellen genererar). En vanlig tumregel är att en token motsvarar ungefär fyra tecken eller cirka 0,75 engelska ord.

Svensk text delas typiskt upp i fler tokens än motsvarande engelsk text, eftersom de flesta tokeniserare är tränade främst på engelska. Det gör att svenska underlag både kostar mer och tar mer plats i kontextfönstret. Tokenräkning är därför grunden både för att uppskatta kostnad och för att avgöra om ett dokument ryms i modellen.

Källor

Leverantörernas tokeniserardokumentation (OpenAI, Anthropic); branschgemensam tumregel cirka 4 tecken per token (kontrollerad 2026-10-05, inga sakförändringar).

Etablerad kunskap · Ordboken kontrolleras varje natt, ett urval ord i taget

Secret Link