Chatbot som svarar utifrån företagets egna dokument
Av CodexierPublicerad 6 min läsning
En chatbot som svarar utifrån era egna dokument är inte 'tränad' på dem så som uttrycket antyder. Den slår upp det relevanta stycket i samma ögonblick som frågan ställs och skriver ett svar utifrån det. Den mekanismen avgör allt: vilka dokument som fungerar, varför svar blir inaktuella och hur behörigheter måste byggas. Den här guiden förklarar det rakt på sak.
Så fungerar en chatbot som söker i dokument
Det som är värt att förstå är att boten aldrig blir bättre än stycket den hittar. Om rätt svar är utspritt över tre dokument, eller begravt i en tabell som indexeraren inte kunde läsa, får modellen fel sammanhang och svarar självsäkert utifrån det. De flesta klagomål om att 'boten hittade på' är egentligen 'boten fick fel stycke'. Det felet är ett källproblem innan det är ett modellproblem, så den här guiden fokuserar på källorna.
Vilka dokument som är bra källor
Bra källor har tre drag gemensamt: varje dokument besvarar en fråga på egen hand, de är skrivna på det språk kunderna frågar på, och de har ett datum. Svenska företag har oftast en del av båda sorterna.
| Källa | Fungerar bra för att | Se upp med |
|---|---|---|
| FAQ-sidor och hjälpartiklar | En fråga, ett svar, redan med kundens ord | Gamla svar ingen tagit bort |
| Villkor, leverans- och returpolicy | Exakta formuleringar boten kan citera | Flera versioner i omlopp |
| Produktblad och prislistor | Strukturerat och sakligt | Tabeller i PDF som indexeras dåligt; priser med och utan moms blandade |
| Interna manualer och rutiner | Högt värde för personalbotar | Skrivna för insatta, fulla av oförklarade förkortningar |
| Mejltrådar och chattloggar | Innehåller riktiga svar | Personuppgifter, motsägelser, ingen tydlig slutversion |
Tumregel: kan en nyanställd besvara frågan utifrån dokumentet kan boten det också. Skulle hen behöva fråga en kollega är dokumentet inte en källa än.
Formatet spelar mindre roll än strukturen. Ren HTML, Markdown, Word-filer och textbaserade PDF:er indexeras alla bra. Inskannade PDF:er, skärmdumpar av tabeller och bildspel där betydelsen ligger i layouten gör det inte: indexeraren ser antingen ingenting eller en röra.
Håll svaren aktuella
Eftersom inget memoreras är aktualitet ett processproblem, inte ett tekniskt. Indexet måste byggas om när dokumenten ändras, och någon måste äga dokumenten. Mönstret är förutsägbart: boten lanseras med rena källor, priserna ändras på våren, och till sommaren citerar den förra årets leveransvillkor.
- Peka indexet mot den levande källan (webbplatsen, mappen på den delade enheten) i stället för mot kopior gjorda på lanseringsdagen.
- Schemalägg omindexering, dagligen för en webbshop, veckovis för ett tjänsteföretag.
- Ge varje källdokument en ägare och ett granskningsdatum, och visa datumet i botens svar.
- För logg över frågor boten inte kunde besvara; det är den bästa listan över saknade dokument ni någonsin får.
- Ta bort källor i stället för att låta dem förfalla. Ett saknat svar är bättre än ett felaktigt.
Behörigheter för internt innehåll
En kundbot ska bara se offentliga dokument; det är den enklaste regeln och den tar bort den mesta risken. I samma stund som systemet också ska hjälpa personalen med interna manualer, lönerutiner eller kundregister måste sökningen respektera behörigheter: söksteget ska bara returnera stycken som den som frågar får läsa. Att filtrera svaret i efterhand räcker inte, för modellen har redan sett texten.
Publik bot
Indexera bara det som redan finns på webbplatsen eller i publicerade PDF:er. Inga kunduppgifter, inga interna rutiner.
Personalbot
Inloggning med företagsidentiteten (Microsoft 365, Google Workspace) och filtrering av sökningen på samma grupper som styr dokumenten.
Båda
Två separata index. Att dela ett och hoppas att prompten håller på hemligheter är ingen kontroll.
Personuppgifter i källorna aktiverar också GDPR: personuppgiftsbiträdesavtal med modelleverantören, en dokumenterad rättslig grund och en plan för raderingsbegäranden, vilket betyder att en person måste kunna tas bort ur indexet, inte bara ur källan.
Tecken på att innehållet inte är redo
Ibland är den ärliga rekommendationen att skriva först och bygga sedan. Om svaren på era vanligaste frågor bor i folks huvuden eller i mejltrådar är projektets första fas dokumentation, och en chatbot ovanpå ingenting svarar ingenting. Om två dokument motsäger varandra om leveranstider väljer boten ett på måfå. Om webbplatsen är på svenska men kunderna frågar på engelska sjunker träffsäkerheten om inte källor finns på båda språken, så planera för källor på båda språken från början.
När du inte ska köpa detta av oss: färre än en handfull återkommande frågor, eller frågor som kräver omdöme (en juridisk bedömning, ett medicinskt svar) snarare än uppslagning. Där slår en välskriven FAQ-sida och en snabb svarsrutin vilken bot som helst. När källorna är redo är vår chatbotuppsättning till fast pris, 14 990 kr, inklusive indexering, överlämningsregler och en testrunda på era riktiga frågor.
- AI-chatbot och kundtjänstagentUppsättning på era dokument, med källhänvisningar i svaren och överlämning till en människa när boten är osäker.
- PriserAlla paket, priser och leveranstider på ett ställe.
- Boka ett kostnadsfritt 15-minuterssamtalSkicka tre dokument och era tio vanligaste frågor; vi säger om de är redo att vara källa.
Vanliga frågor
Tränas chatboten på mina dokument?
Inte i betydelsen att modellen ändras. Dokumenten indexeras och genomsöks när frågan ställs, och modellen skriver ett svar utifrån det den hittar. Det är därför uppdateringar slår igenom direkt efter omindexering och därför boten kan ange källa. Att finjustera en modell på företagstext är en annan, sällan nödvändig metod.
Används mina dokument för att träna leverantörens modell?
Det beror på leverantören och avtalet. Företags- och API-planer hos de stora leverantörerna anger i regel att kunddata inte används för träning, men det ska stå i biträdesavtalet, inte antas. Fråga var indexet och loggarna lagras, och hur länge.
Hur många dokument behövs?
Färre än de flesta tror. En underhållen FAQ, era villkor och en prislista täcker ofta merparten av kundfrågorna. Mängden är inte målet; täckningen av de frågor som faktiskt ställs är det. Börja med de tjugo vanligaste frågorna från inkorgen och lägg till källor tills var och en har ett tydligt svar.
Kan den svara ur Fortnox eller vårt CRM också?
Ja, men det är en annan mekanism: en uppslagning i realtid via API i stället för ett dokumentindex, och den kräver inloggning så att boten bara hämtar uppgifter den frågande kunden har rätt till. Det är vanligt för orderstatus och fakturafrågor, och det avgränsas och prissätts separat från dokumentdelen.
Vad händer när boten inte vet?
Den ska säga det och lämna över: samla in frågan och kontaktuppgifter, eller koppla till en person. En bot som alltid svarar är en bot som ibland hittar på. Överlämningsreglerna ingår i varje seriös uppsättning, och loggen över obesvarade frågor blir er lista över dokument att skriva härnäst.
Är era dokument redo att vara källa?
Skicka några av dem och era vanligaste frågor före samtalet. På femton minuter säger vi vad som fungerar nu, vad som behöver skrivas om först och vad en uppsättning skulle kosta.
Boka ett kostnadsfritt 15-minuterssamtal