codexier.

AI och automation

Vad kostar varje chattkonversation med AI?

Av CodexierPublicerad 4 min läsning

När du kör en chattbot på en språkmodell tar leverantören betalt för användningen, inte per användare eller per månad. Därför känns driftkostnaden oförutsägbar. Det är den inte, när du väl förstår tre saker: token, modellnivåer och hur mycket text som skickas med varje meddelande. Här förklarar vi dem utan krångliga formler och visar hur du räknar utifrån din egen volym.

Det korta svaret

Token förklarat utan formelskräck

En token är en textbit som modellen läser eller skriver. På engelska är en token i snitt lite mindre än ett ord. Svenska, med sina långa sammansatta ord, kräver oftast fler token för samma innehåll. Leverantörerna anger ett pris per miljon inmatade token och ett högre pris per miljon genererade. Du behöver inte exakta siffror för att resonera om kostnaden – du behöver veta vilka delar av en konversation som blir token.

  • Systeminstruktionen: dina regler, din ton och dina ramar. Skickas med varje meddelande.
  • Hämtad kontext: utdrag ur dina dokument eller din webbplats som boten svarar utifrån. Skickas också varje gång.
  • Konversationshistoriken: allt besökaren och boten har sagt hittills.
  • Själva svaret: genererade token, som kostar mer per styck än inmatade.

Därför påverkar modellvalet kostnaden

Leverantörerna säljer modeller i olika nivåer: små och snabba, stora och mer kapabla. Prisskillnaden mellan nivåerna är stor, ofta en tiopotens. För en kundtjänstbot som svarar om öppettider, leveranstider och returer räcker oftast en liten modell med bra dokumentsökning. Komplexa resonemang, långa dokument eller uppgifter där misstag blir dyra kan motivera en större modell. Ett vanligt upplägg är styrning: en billig modell tar de flesta meddelanden och bara de svåra går vidare till den dyra.

ValEffekt på kostnadenNär det passar
Liten modell för alltLägstVanliga frågor, korta svar, tydliga källor
Stor modell för alltHögstRådgivning där kvaliteten väger tyngre än kostnaden
Styrning mellan nivåerLåg till måttligBlandad trafik där en minoritet av frågorna är svåra
Cachning av instruktionerLägre kostnad för upprepad textLånga, stabila systeminstruktioner som skickas varje gång

Kontextlängd och kostnaden för dokumentsökning

Det är i kontexten kostnaden tyst växer. Är systeminstruktionen lång och varje meddelande hämtar flera sidor ur dina dokument kan du skicka tusentals token för att få ett svar på två meningar. Och eftersom historiken skickas om kostar det tionde meddelandet i en chatt betydligt mer än det första. Praktiska åtgärder: håll instruktionen stram, hämta färre men bättre utdrag, sammanfatta lång historik och sätt ett tak för konversationens längd innan en människa tar över. Bra dokumentsökning gör också boten träffsäkrare, vilket vi förklarar i så slutar chattboten hitta på.

Räkna utifrån din egen volym

  1. Räkna token i systeminstruktionen och i en typisk hämtad kontext. De flesta leverantörers konsoler eller tokenräknare visar det.
  2. Välj en typisk konversation, till exempel fyra meddelanden från besökaren och fyra svar av normal längd.
  3. För varje tur: lägg ihop instruktion, kontext och historik hittills som inmatning, och svaret som generering.
  4. Summera turerna till token per konversation och multiplicera med leverantörens aktuella priser.
  5. Multiplicera med förväntat antal konversationer per månad och lägg på en buffert för längre chattar och tillväxt.

Räkna med aktuella listpriser från leverantörens prissida, eftersom de ändras ofta och överlag har sjunkit över tid. För de flesta små svenska företag blir själva modellanvändningen liten jämfört med kostnaden för att bygga och sköta boten. Vår genomgång av vad en AI-chattbot kostar visar helheten, och sidan om installation av chattbot visar vad som ingår hos oss.

Så håller du kostnaden förutsägbar

  • Sätt ett månadstak och larm i leverantörens konsol.
  • Begränsa svarens längd i instruktionen – långa svar kostar mer och läses mindre.
  • Begränsa antalet meddelanden per besökare för att stoppa missbruk och loopar.
  • Logga token per konversation så att du ser vilka frågetyper som är dyra.
  • Följ upp varje månad det första kvartalet, sedan kvartalsvis.

När du inte behöver en egen bot alls: ställer besökarna en handfull återkommande frågor besvarar en välskriven FAQ-sida dem gratis. Vill du ha hjälp att räkna på din egen trafik kan du boka ett kostnadsfritt samtal.

Vanliga frågor

Är det billigare att betala per konversation eller per token?

Många chattbotsplattformar paketerar användningen i en månadsavgift med ett tak för antal konversationer. Direkt användning av API:et debiteras per token. Paket är lättare att budgetera; direkt användning blir oftast billigare i volym men kräver kostnadstak och bevakning.

Varför blir svenska dyrare än engelska?

Tokenisering tränas mest på engelsk text, så svenska ord, särskilt sammansättningar, delas upp i fler token. Samma svar på svenska använder därför något fler token. Effekten är verklig men måttlig.

Blir boten bättre av en längre systeminstruktion?

Inte nödvändigtvis. Tydliga, specifika instruktioner slår långa. Varje extra rad betalas i varje meddelande, så stryk allt som boten inte faktiskt behöver.

Vad gör vi om notan plötsligt skjuter i höjden?

Oftast är orsaken en loop, missbruk från en bot eller en ändring som drar in mycket mer kontext. Kostnadstak stoppar skadan och tokenloggning per konversation visar orsaken.

Vill du ha en uppskattning för din volym?

Ta med ungefärliga siffror på besökare och vanliga frågor. På en kvart skissar vi driftkostnaden och vilken modellnivå som passar.

Boka ett kostnadsfritt 15-minuterssamtal