AI byggd för verklig användning
Tokenomics
Vad är tokenomics?
Tokenomics beskriver, i AI-sammanhang, ekonomin kring tokens – de textenheter som språkmodeller läser och genererar. Eftersom i princip alla kommersiella AI-tjänster som bygger på stora språkmodeller prissätts per token, handlar tokenomics om att förstå hur AI-kostnader uppstår, vad som driver dem och hur de kan styras.
Termen är lånad från kryptovärlden, där den ursprungligen beskriver den ekonomiska designen av kryptotokens. I takt med att organisationer börjat använda språkmodeller i stor skala har tokenomics fått en ny och alltmer etablerad betydelse: läran om tokenekonomin i AI-drift. Det är den betydelsen den här sidan fokuserar på.
Därför prissätts AI per token
När en språkmodell bearbetar text delas den upp i tokens – ord eller delar av ord. Leverantörer av AI-tjänster tar vanligtvis betalt både för de tokens som skickas in till modellen (input) och de tokens modellen genererar som svar (output). Output-tokens är i regel dyrare, eftersom generering av text kräver mer beräkningskraft än inläsning. Priset per token varierar också kraftigt mellan modeller: de mest kapabla modellerna kan kosta mångdubbelt mer per token än mindre modeller.
Vad driver tokenkostnaderna?
I praktiken avgörs en organisations AI-kostnader av några återkommande faktorer. Långa konversationer och stora dokument ökar mängden input-tokens, särskilt när tidigare meddelanden skickas med i varje anrop. Lösningar som hämtar in extern kontext, till exempel RAG, adderar ytterligare tokens per fråga. Agentiska flöden, där AI:n gör många anrop för att lösa en uppgift, kan multiplicera förbrukningen. Och valet av modell för varje uppgift påverkar priset per token direkt.
Så styr ni tokenekonomin
En genomtänkt tokenomics-strategi bygger på samma principer som annan kostnadsstyrning i IT. Mät förbrukningen per applikation, team eller användningsfall så att kostnaderna går att härleda. Sätt tokenbudgetar med tydliga ramar och larm. Använd modellstyrning så att enkla uppgifter hanteras av billigare modeller och de mest kapabla modellerna reserveras för uppgifter som kräver dem. Se över promptar och kontextlängder – onödigt långa instruktioner kostar vid varje enskilt anrop. Och utvärdera alltid kvalitet mot kostnad: den billigaste lösningen är inte billig om svaren inte håller måttet.
Vanliga frågor om tokenomics
Vad är en token i AI-sammanhang?
En token är den minsta textenhet en språkmodell arbetar med – ofta ett ord eller en del av ett ord. Svensk text kräver ofta något fler tokens än motsvarande engelsk text, eftersom de flesta modeller är tränade främst på engelska.
Varför kostar output-tokens ofta mer än input-tokens?
Att generera text kräver mer beräkningskraft än att läsa in den. Leverantörerna speglar det i prissättningen, där genererade tokens vanligtvis prissätts högre än inskickade.
Har tokenomics något med kryptovalutor att göra?
Ursprungligen, ja – termen kommer från kryptovärlden där den beskriver hur en kryptotokens ekonomi är utformad. Inom AI används ordet i en annan betydelse: ekonomin kring språkmodellernas tokenförbrukning.