ChatLab kasutab RAG-tehnoloogiat (Retrieval-Augmented Generation), et pakkuda vastuseid teie teadmusbaasi põhjal. Selle piirangute mõistmine aitab teil optimeerida oma chatboti tööd ja seada realistlikke ootusi.
Kontekstiakna piirangud
ChatLab kasutab tehisintellekti mudeleid, millel on päringute töötlemiseks ranged tokenite limiidid. Kontekstiaken peab mahutama kasutaja küsimuse, vestluse ajaloo ja leitud teadmised korraga.
Konteksti suurused pakettide kaupa:
- FREE/BASIC: 8 000 tokenit
- STANDARD: 16 000 tokenit
- PREMIUM: 32 000 tokenit
Mis juhtub konteksti ületamisel:
- Leitud teadmisi kärbitakse
- Oluline teave võib välja jääda
- Vastused võivad olla puudulikud või neist võivad puududa tähtsad detailid
Lahendused:
- Eemaldage treeningandmetest liigne ja korduv sisu
- Jagage suured failid väiksemateks, teemapõhisteks dokumentideks
- Suurema kontekstiakna saamiseks uuendage oma paketti
- Kasutage vastuste suunamiseks selgeid ja konkreetseid rollijuhiseid
Treenimise ja sisu hankimise piirangud
Failide üleslaadimise limiidid
- Maksimaalne faili suurus: 50 MB faili kohta
- Toetatud vormingud: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Sisu, mida ei saa hankida
ChatLab ei saa lugeda ega hankida teksti järgmistest allikatest:
- Pildid ja graafika - piltidesse põimitud teksti ei tuvastata
- Skannitud PDF-id - PDF-failid, mis sisaldavad tegeliku teksti asemel tekstipilte
- Sisselogimisega kaitstud lehed - autentimist nõudvad lehed
- Tugevalt JavaScripti abil renderdatav sisu - mõned dünaamilised lehed ei pruugi täielikult renderduda
- Mittetekstiline meedia - audio, video või manustatud failid
Veebisaidi skannimise kitsaskohad
- Töötlemisaeg: mahukad skannimised võivad kesta 10-60 minutit
- Sügav pesastatus: väga sügava struktuuriga URL-ide puhul võib tekkida ajalõpp
- Dünaamiline sisu: mõned JavaScripti raamistikud takistavad sisu täielikku hankimist
Tehisintellekti käitumuslikud väljakutsed
Hallutsinatsioonid
Tehisintellekti mudelid võivad luua usutavaid, kuid ebaõigeid vastuseid, kui teadmusbaasist ei leita asjakohast teavet. Tehisintellekt võib selle asemel, et tunnistada teadmise puudumist, võtta andmeid oma üldistest treeningandmetest.
Hallutsinatsioonide vähendamine:
- Määrake väärtuseks Creativity to 0 (Bot Settings (Roboti seaded) > Conversation (Vestlus) > AI Behavior (Tehisintellekti käitumine))
- Lisage jaotises Role & Behavior (Roll ja käitumine) selged juhised: "Only respond based on the provided knowledge base. If you cannot find relevant information, say 'I don't have information about that.'"
- Hoidke oma teadmusbaas oma konkreetse valdkonna jaoks võimalikult põhjalik
Teadlikkus teadmusbaasist
ChatLab ei suuda:
- teha kokkuvõtet sellest, mida teadmusbaas sisaldab
- loetleda kaetud teemasid, faile või riike
- anda ülevaadet sellest, kui palju dokumente on treenitud
- selgitada, miks konkreetne teave leiti
Chatbot otsib päringutele asjakohaseid tekstiosi, kuid ei mõista teie teadmusbaasi struktuuri ega metaandmeid.
Jõudlus suurte teadmusbaasidega
Semantilise kattuvuse probleemid
Kui mitu dokumenti sisaldavad sarnast teavet, võib süsteem:
- leida vähem asjakohast sisu
- jätta kõige sobivama vastuse leidmata
- kombineerida erinevate kontekstide teavet valesti
Lahendused:
- Vältige sisu dubleerimist eri failides
- Kasutage selget ja eristuvat struktuuri ning failinimesid
- Katsetage päringuid, mis võivad sobida mitme allikaga
- Jagage mahukad juhendid kitsamateks teemafailideks
Teabe leidmise prioritiseerimine
Tehisintellekt otsib sisu lähtuvalt selle semantilisest sarnasusest kasutaja küsimusega. See ei:
- eelista uuemat sisu vanemale
- sea konkreetseid failitüüpe esikohale
- mõista dokumentide hierarhiat ega olulisust
Parimate tulemuste saavutamiseks korraldage oma teadmusbaas selge ja mittekattuva sisuga.
Päringulimiidid ja kvoodid
Sõnumite limiidid (rate limits)
Kuritarvitamise vältimiseks on chatbotidel seadistatavad sõnumilimiidid. Kui limiit ületatakse:
- näevad kasutajad teadet limiidi ületamise kohta
- peavad nad enne uute sõnumite saatmist ootama
- seadistage limiite jaotises Bot Settings > Security (Turvalisus)
Igakuised sõnumikrediidid
Iga pakett sisaldab igakuiseid sõnumikrediite, mis lähtestatakse teie arvelduskuupäeval:
- FREE: 30 sõnumit
- BASIC: 2 400 sõnumit
- STANDARD: 11 000 sõnumit
- PREMIUM: 50 000 sõnumit
Kui krediidid saavad otsa, lakkab chatbot vastamast seni, kuni krediidid lähtestatakse või te võtate kasutusele lisamahu arvelduse.
Sõltuvused välistest teenustest
ChatLab toetub kolmandate osapoolte teenustele:
- OpenAI/Google - tehisintellekti mudelite API-d vastuste genereerimiseks
- Pinecone - vektorteadmusbaas teadmiste otsimiseks
- ZenRows - veebisaitidelt sisu hankimine
Nende pakkujate teenusekatkestused või limiidid võivad ajutiselt mõjutada järgmist:
- vastuste genereerimise kiirus
- veebisaidi skannimise võimekus
- teadmiste otsimise täpsus
Selliseid katkestusi esineb harva, kuid need võivad hooldusakende ajal põhjustada lühiajalisi viivitusi või tõrkeid.
Parimate tavade kokkuvõte
| Väljakutse | Lahendus |
|---|---|
| Puudulikud vastused | Vähendage korduvusi, võtke kasutusele suurema kontekstiga pakett |
| Hallutsinatsioonid | Määrake loovus väärtusele 0, lisage ranged rollijuhised |
| Sisu ei õnnestu hankida | Kasutage tekstipõhiseid PDF-e, vältige pildirohkeid allikaid |
| Kattuvad tulemused | Jaotage sisu selgelt eristuvateks teemadeks |
| Limiitide täitumine | Kohandage limiite seadetes Security |
| Aeglane treenimine | Kasutage sisukaardi skannimist, vähendage läbimise sügavust |
Täpsemate küsimuste korral, mida siin ei käsitletud, võtke ühendust kasutajatoega menüüst Main Menu (Peamenüü) > Support Request (Tugipäring).