ChatLab bruker Retrieval-Augmented Generation (RAG) for å levere svar basert på kunnskapsbasen din. Når du forstår begrensningene, blir det enklere å optimalisere chatbotens ytelse og ha realistiske forventninger.
Begrensninger for kontekstvindu
ChatLab bruker AI-modeller med strenge token-grenser for behandling av forespørsler. Kontekstvinduet må ha plass til brukerspørsmålet, samtalehistorikken og den hentede kunnskapen til sammen.
Kontekststørrelser etter plan:
- FREE/BASIC: 8 000 tokens
- STANDARD: 16 000 tokens
- PREMIUM: 32 000 tokens
Hva som skjer når konteksten overskrides:
- Hentet kunnskap blir avkortet
- Kritisk informasjon kan bli utelatt
- Svar kan bli ufullstendige eller mangle viktige detaljer
Løsninger:
- Fjern overflødig innhold fra treningsdataene
- Del opp store filer i mindre dokumenter med fokus på enkelttemaer
- Oppgrader planen din for å få større kontekstvindu
- Bruk tydelige, spesifikke rolleinstruksjoner for å styre svarene
Grenser for trening og innholdsuthenting
Grenser for filopplasting
- Maksimal filstørrelse: 50 MB per fil
- Støttede formater: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Innhold som ikke kan hentes ut
ChatLab kan ikke lese eller hente ut tekst fra:
- Bilder og grafikk - Tekst innebygd i bilder blir ikke gjenkjent
- Skannede PDF-er - PDF-er som inneholder bilder av tekst i stedet for faktisk tekst
- Passordbeskyttede sider - Sider som krever innlogging
- Innhold med mye JavaScript-gjengivelse - Enkelte dynamiske sider blir kanskje ikke gjengitt fullstendig
- Mediefiler uten tekst - Lyd, video eller innebygde filer
Begrensninger ved skanning av nettsteder
- Behandlingstid: Store skanninger kan ta 10-60 minutter
- Dyp nesting: URL-er med svært dyp mappestruktur kan få tidsavbrudd
- Dynamisk innhold: Enkelte JavaScript-rammeverk forhindrer fullstendig innholdsuthenting
Utfordringer med AI-atferd
Hallusinering
AI-modeller kan generere troverdige, men feilaktige svar når relevant informasjon ikke finnes i kunnskapsbasen. AI-en kan hente informasjon fra sine generelle treningsdata i stedet for å innrømme at den ikke vet svaret.
Slik reduserer du hallusinering:
- Sett Creativity (kreativitet) til 0 (Bot Settings > Conversation > AI Behavior (Botinnstillinger > Samtale > AI-atferd))
- Legg til eksplisitte instruksjoner i innstillingene for Role & Behavior (Rolle og atferd): "Svar kun basert på den oppgitte kunnskapsbasen. Hvis du ikke finner relevant informasjon, skal du svare 'Jeg har dessverre ikke informasjon om dette.'"
- Sørg for at kunnskapsbasen er utfyllende for fagområdet ditt
Bevissthet om kunnskapsbasen
ChatLab kan ikke:
- Oppsummere hva som finnes i kunnskapsbasen
- Liste opp temaer, filer eller land som dekkes
- Rapportere hvor mange dokumenter som er trent
- Forklare hvorfor spesifikk informasjon ble hentet ut
Chatboten henter ut relevante deler for forespørsler, men forstår ikke strukturen eller metadataene til kunnskapsbasen din.
Ytelse ved store kunnskapsbaser
Problemer med semantisk overlapp
Når flere dokumenter inneholder lignende informasjon, kan systemet:
- Hente mindre relevant innhold
- Gå glipp av det mest passende svaret
- Kombinere informasjon fra ulike kontekster på feil måte
Løsninger:
- Unngå duplisering av innhold på tvers av filer
- Bruk tydelig og distinkt navngiving og struktur
- Test forespørsler som kan treffe flere kilder
- Del opp omfattende veiledninger i mer spissede temafiler
Prioritering ved gjenfinning
AI-en henter innhold basert på semantisk likhet med brukerspørsmålet. Den gjør ikke følgende:
- Foretrekker nyere innhold fremfor eldre
- Prioriterer bestemte filtyper
- Forstår dokumenthierarki eller viktighet
For best resultat bør du organisere kunnskapsbasen med tydelig innhold som ikke overlapper.
Grenser for meldingsfrekvens og kvoter
Grenser for meldingsfrekvens
For å forhindre misbruk har chatboter konfigurerbare frekvensgrenser. Når disse overskrides:
- Ser brukerne en melding om hastighetsbegrensning
- Må de vente før de kan sende flere meldinger
- Konfigurer grensene i Bot Settings > Security (Botinnstillinger > Sikkerhet)
Månedlige meldings-credits
Hver plan inkluderer månedlige meldings-credits som tilbakestilles på fakturadatoen din:
- FREE: 30 meldinger
- BASIC: 2 400 meldinger
- STANDARD: 11 000 meldinger
- PREMIUM: 50 000 meldinger
Når dine credits er brukt opp, slutter chatboten å svare frem til de tilbakestilles eller du aktiverer fakturering for overforbruk.
Eksterne tjenesteavhengigheter
ChatLab er avhengig av tredjepartstjenester:
- OpenAI/Google - API-er for AI-modeller til svargenerering
- Pinecone - Vektordatabase for gjenfinning av kunnskap
- ZenRows - Innholdsuthenting fra nettsteder
Tjenesteavbrudd eller hastighetsgrenser fra disse leverandørene kan midlertidig påvirke:
- Hastigheten på svargenereringen
- Evnen til å skanne nettsteder
- Nøyaktigheten ved kunnskapshenting
Slike avbrudd er sjeldne, men kan føre til korte forsinkelser eller feil under vedlikeholdsvinduer.
Oppsummering av beste praksis
| Utfordring | Løsning |
|---|---|
| Ufullstendige svar | Reduser overflødig innhold, oppgrader kontekststørrelse |
| Hallusinering | Sett kreativitet til 0, legg til strenge rolleinstruksjoner |
| Kan ikke hente innhold | Bruk tekstbaserte PDF-er, unngå bildekilder |
| Overlappende resultater | Organiser innhold i distinkte temaer |
| Frekvensgrenser nådd | Juster grensene i Security-innstillingene |
| Treg trening | Bruk sitemap-skanning, reduser gjennomsøkingsdybden |
For spesifikke problemer som ikke er dekket her, kontakt brukerstøtte via Main Menu > Support Request (Hovedmeny > Kundestøtteforespørsel).