Vad kostar varje chattkonversation med AI?
Av CodexierPublicerad 4 min läsning
När du kör en chattbot på en språkmodell tar leverantören betalt för användningen, inte per användare eller per månad. Därför känns driftkostnaden oförutsägbar. Det är den inte, när du väl förstår tre saker: token, modellnivåer och hur mycket text som skickas med varje meddelande. Här förklarar vi dem utan krångliga formler och visar hur du räknar utifrån din egen volym.
Det korta svaret
Token förklarat utan formelskräck
En token är en textbit som modellen läser eller skriver. På engelska är en token i snitt lite mindre än ett ord. Svenska, med sina långa sammansatta ord, kräver oftast fler token för samma innehåll. Leverantörerna anger ett pris per miljon inmatade token och ett högre pris per miljon genererade. Du behöver inte exakta siffror för att resonera om kostnaden – du behöver veta vilka delar av en konversation som blir token.
- Systeminstruktionen: dina regler, din ton och dina ramar. Skickas med varje meddelande.
- Hämtad kontext: utdrag ur dina dokument eller din webbplats som boten svarar utifrån. Skickas också varje gång.
- Konversationshistoriken: allt besökaren och boten har sagt hittills.
- Själva svaret: genererade token, som kostar mer per styck än inmatade.
Därför påverkar modellvalet kostnaden
Leverantörerna säljer modeller i olika nivåer: små och snabba, stora och mer kapabla. Prisskillnaden mellan nivåerna är stor, ofta en tiopotens. För en kundtjänstbot som svarar om öppettider, leveranstider och returer räcker oftast en liten modell med bra dokumentsökning. Komplexa resonemang, långa dokument eller uppgifter där misstag blir dyra kan motivera en större modell. Ett vanligt upplägg är styrning: en billig modell tar de flesta meddelanden och bara de svåra går vidare till den dyra.
| Val | Effekt på kostnaden | När det passar |
|---|---|---|
| Liten modell för allt | Lägst | Vanliga frågor, korta svar, tydliga källor |
| Stor modell för allt | Högst | Rådgivning där kvaliteten väger tyngre än kostnaden |
| Styrning mellan nivåer | Låg till måttlig | Blandad trafik där en minoritet av frågorna är svåra |
| Cachning av instruktioner | Lägre kostnad för upprepad text | Långa, stabila systeminstruktioner som skickas varje gång |
Kontextlängd och kostnaden för dokumentsökning
Det är i kontexten kostnaden tyst växer. Är systeminstruktionen lång och varje meddelande hämtar flera sidor ur dina dokument kan du skicka tusentals token för att få ett svar på två meningar. Och eftersom historiken skickas om kostar det tionde meddelandet i en chatt betydligt mer än det första. Praktiska åtgärder: håll instruktionen stram, hämta färre men bättre utdrag, sammanfatta lång historik och sätt ett tak för konversationens längd innan en människa tar över. Bra dokumentsökning gör också boten träffsäkrare, vilket vi förklarar i så slutar chattboten hitta på.
Räkna utifrån din egen volym
- Räkna token i systeminstruktionen och i en typisk hämtad kontext. De flesta leverantörers konsoler eller tokenräknare visar det.
- Välj en typisk konversation, till exempel fyra meddelanden från besökaren och fyra svar av normal längd.
- För varje tur: lägg ihop instruktion, kontext och historik hittills som inmatning, och svaret som generering.
- Summera turerna till token per konversation och multiplicera med leverantörens aktuella priser.
- Multiplicera med förväntat antal konversationer per månad och lägg på en buffert för längre chattar och tillväxt.
Räkna med aktuella listpriser från leverantörens prissida, eftersom de ändras ofta och överlag har sjunkit över tid. För de flesta små svenska företag blir själva modellanvändningen liten jämfört med kostnaden för att bygga och sköta boten. Vår genomgång av vad en AI-chattbot kostar visar helheten, och sidan om installation av chattbot visar vad som ingår hos oss.
Så håller du kostnaden förutsägbar
- Sätt ett månadstak och larm i leverantörens konsol.
- Begränsa svarens längd i instruktionen – långa svar kostar mer och läses mindre.
- Begränsa antalet meddelanden per besökare för att stoppa missbruk och loopar.
- Logga token per konversation så att du ser vilka frågetyper som är dyra.
- Följ upp varje månad det första kvartalet, sedan kvartalsvis.
När du inte behöver en egen bot alls: ställer besökarna en handfull återkommande frågor besvarar en välskriven FAQ-sida dem gratis. Vill du ha hjälp att räkna på din egen trafik kan du boka ett kostnadsfritt samtal.
Vanliga frågor
Är det billigare att betala per konversation eller per token?
Många chattbotsplattformar paketerar användningen i en månadsavgift med ett tak för antal konversationer. Direkt användning av API:et debiteras per token. Paket är lättare att budgetera; direkt användning blir oftast billigare i volym men kräver kostnadstak och bevakning.
Varför blir svenska dyrare än engelska?
Tokenisering tränas mest på engelsk text, så svenska ord, särskilt sammansättningar, delas upp i fler token. Samma svar på svenska använder därför något fler token. Effekten är verklig men måttlig.
Blir boten bättre av en längre systeminstruktion?
Inte nödvändigtvis. Tydliga, specifika instruktioner slår långa. Varje extra rad betalas i varje meddelande, så stryk allt som boten inte faktiskt behöver.
Vad gör vi om notan plötsligt skjuter i höjden?
Oftast är orsaken en loop, missbruk från en bot eller en ändring som drar in mycket mer kontext. Kostnadstak stoppar skadan och tokenloggning per konversation visar orsaken.
Vill du ha en uppskattning för din volym?
Ta med ungefärliga siffror på besökare och vanliga frågor. På en kvart skissar vi driftkostnaden och vilken modellnivå som passar.
Boka ett kostnadsfritt 15-minuterssamtal