ChatLab använder Retrieval-Augmented Generation (RAG) för att leverera svar baserade på din kunskapsbas. Genom att förstå dess begränsningar kan du optimera din chattbots prestanda och sätta realistiska förväntningar.
Begränsningar i kontextfönstret
ChatLab använder AI-modeller med strikta tokengränser för att bearbeta frågor. Kontextfönstret måste rymma användarens fråga, konversationshistoriken och den inhämtade kunskapen tillsammans.
Kontextstorlekar per plan:
- Free/Basic: 8 000 tokens
- Standard: 16 000 tokens
- Premium: 32 000 tokens
Vad som händer när kontexten överskrids:
- Den inhämtade kunskapen trunkeras
- Kritiskt viktig information kan utelämnas
- Svaren kan bli ofullständiga eller missa viktiga detaljer
Lösningar:
- Ta bort överflödigt innehåll från träningsdatan
- Dela upp stora filer i mindre, ämnesfokuserade dokument
- Uppgradera din plan för att få större kontextfönster
- Använd tydliga, specifika rollinstruktioner för att styra svaren
Begränsningar för träning och innehållsextrahering
Gränser för filuppladdning
- Maximal filstorlek: 50 MB per fil
- Format som stöds: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Innehåll som inte kan extraheras
ChatLab kan inte läsa eller extrahera text från:
- Bilder och grafik - Text som är inbäddad i bilder känns inte igen
- Skannade PDF-filer - PDF-filer som innehåller bilder av text snarare än faktisk text
- Inloggningsskyddade sidor - Sidor som kräver autentisering
- Innehåll som i hög grad renderas med JavaScript - Vissa dynamiska sidor kanske inte renderas fullständigt
- Icke-textbaserad media - Ljud, video eller inbäddade filer
Begränsningar vid webbplatsskanning
- Behandlingstid: Omfattande skanningar kan ta 10-60 minuter
- Djup kapsling: Mycket djupt kapslade URL-adresser kan göra timeout
- Dynamiskt innehåll: Vissa JavaScript-ramverk förhindrar fullständig extrahering av innehåll
Utmaningar med AI-beteende
Hallucinationer
AI-modeller kan generera trovärdiga men felaktiga svar när relevant information inte finns i kunskapsbasen. AI:n kan då hämta information från sina allmänna träningsdata i stället för att medge att den inte vet.
Minska hallucinationer:
- Ställ in Creativity to 0 (Bot Settings > Conversation > AI Behavior) (Botinställningar > Konversation > AI-beteende)
- Lägg till uttryckliga instruktioner i inställningarna för Role & Behavior (Roll och beteende): "Only respond based on the provided knowledge base. If you cannot find relevant information, say 'I don't have information about that.'"
- Håll din kunskapsbas heltäckande för ditt specifika område
Medvetenhet om kunskapsbasen
ChatLab kan inte:
- Sammanfatta vad som finns i kunskapsbasen
- Lista ämnen, filer eller länder som täcks
- Rapportera hur många dokument som har tränats
- Förklara varför viss specifik information hämtades
Chattbotten hämtar relevanta textstycken för frågor, men den förstår inte strukturen eller metadata för din kunskapsbas.
Prestanda med stora kunskapsbaser
Problem med semantisk överlappning
När flera dokument innehåller liknande information kan systemet:
- Hämta mindre relevant innehåll
- Missa det mest lämpliga svaret
- Kombinera information från olika sammanhang på ett felaktigt sätt
Lösningar:
- Undvik att duplicera innehåll över flera filer
- Använd tydliga, särskiljande namn och strukturer
- Testa frågor som kan matcha flera källor
- Dela upp omfattande guider i fokuserade ämnesfiler
Prioritering vid informationshämtning
AI:n hämtar innehåll baserat på semantisk likhet med användarens fråga. Den gör inte följande:
- Föredrar nyare innehåll framför äldre
- Prioriterar specifika filtyper
- Förstår dokumenthierarki eller prioritet
Organisera din kunskapsbas med tydligt, icke-överlappande innehåll för bästa resultat.
Hastighetsbegränsningar och kvoter
Hastighetsbegränsningar för meddelanden
För att förhindra missbruk har chattbotten konfigurerbara hastighetsbegränsningar. När dessa överskrids:
- Ser användarna ett meddelande om att hastighetsbegränsningen har nåtts
- Måste de vänta innan de kan skicka fler meddelanden
- Konfigurera gränser i Bot Settings > Security (Botinställningar > Säkerhet)
Månatliga meddelandekrediter
Varje plan innehåller månatliga meddelandekrediter som återställs på ditt faktureringsdatum:
- Free: 30 meddelanden
- Basic: 2 400 meddelanden
- Standard: 11 000 meddelanden
- Premium: 50 000 meddelanden
När krediterna tar slut slutar chattbotten att svara tills krediterna återställs eller tills du aktiverar fakturering för överanvändning.
Beroenden av externa tjänster
ChatLab förlitar sig på tredjepartstjänster:
- OpenAI/Google - API:er för AI-modeller för att generera svar
- Pinecone - Vektordatabas för informationshämtning ur kunskapsbasen
- ZenRows - Extrahering av webbplatsinnehåll
Tjänsteavbrott eller hastighetsbegränsningar från dessa leverantörer kan tillfälligt påverka:
- Hastigheten för svarsgenerering
- Möjligheten att skanna webbplatser
- Precisionen vid informationshämtning ur kunskapsbasen
Dessa avbrott är sällsynta men kan orsaka korta fördröjningar eller fel under underhållsfönster.
Sammanfattning av bästa praxis
| Utmaning | Lösning |
|---|---|
| Ofullständiga svar | Minska redundans, uppgradera kontextstorleken |
| Hallucinationer | Sätt kreativitet till 0, lägg till strikta rollinstruktioner |
| Kan inte extrahera innehåll | Använd textbaserade PDF-filer, undvik bildtunga källor |
| Överlappande resultat | Organisera innehållet i tydligt avgränsade ämnen |
| Hastighetsbegränsningar nås | Justera gränserna i säkerhetsinställningarna |
| Långsam träning | Använd webbplatsskarteskanning, minska genomsökningsdjupet |
För specifika problem som inte tas upp här, kontakta supporten via Main Menu > Support Request (Huvudmeny > Supportförfrågan).