ChatLab využíva Retrieval-Augmented Generation (RAG) na poskytovanie odpovedí na základe vašej bázy znalostí. Pochopenie jeho obmedzení vám pomôže optimalizovať výkon vášho chatbota a nastaviť realistické očakávania.
Obmedzenia kontextového okna
ChatLab využíva AI modely s prísnymi limitmi tokenov na spracovanie dopytov. Do kontextového okna sa musí zmestiť otázka používateľa, história konverzácie a vyhľadané znalosti dokopy.
Veľkosti kontextu podľa plánu:
- FREE/BASIC: 8 000 tokenov
- STANDARD: 16 000 tokenov
- PREMIUM: 32 000 tokenov
Čo sa stane pri prekročení kontextu:
- Vyhľadané znalosti sa skrátia
- Kritické informácie môžu byť vynechané
- Odpovede môžu byť neúplné alebo v nich môžu chýbať dôležité podrobnosti
Riešenia:
- Odstráňte nadbytočný obsah z trénovacích údajov
- Rozdeľte veľké súbory na menšie dokumenty zamerané na konkrétne témy
- Prejdite na vyšší plán pre väčšie kontextové okná
- Používajte jasné, špecifické inštrukcie pre rolu na usmernenie odpovedí
Limity trénovania a extrakcie obsahu
Limity nahrávania súborov
- Maximálna veľkosť súboru: 50 MB na súbor
- Podporované formáty: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Obsah, ktorý nie je možné extrahovať
ChatLab nedokáže čítať ani extrahovať text z týchto zdrojov:
- Obrázky a grafika - text vložený v obrázkoch sa nerozpozná
- Naskenované PDF súbory - PDF súbory obsahujúce obrázky textu namiesto skutočného textu
- Stránky chránené prihlásením - stránky vyžadujúce overenie totožnosti
- Obsah výrazne renderovaný cez JavaScript - niektoré dynamické stránky sa nemusia vykresliť úplne
- Netextové médiá - zvuk, video alebo vložené súbory
Obmedzenia skenovania webových stránok
- Čas spracovania: Veľké skenovania môžu trvať 10-60 minút
- Hlboké zanorenie: Pri veľmi hlboko zanorených URL adresách môže vypršať časový limit
- Dynamický obsah: Niektoré javascriptové frameworky bránia úplnej extrakcii obsahu
Úskalia v správaní AI
Halucinácie
AI modely môžu vygenerovať zdanlivo vierohodné, ale nesprávne odpovede, ak sa v báze znalostí nenájdu relevantné informácie. Namiesto priznania, že odpoveď nepozná, môže AI čerpať zo svojich všeobecných trénovacích údajov.
Ako obmedziť halucinácie:
- Nastavte Creativity to 0 (Kreativita na 0) v ponuke Bot Settings > Conversation > AI Behavior (Nastavenia bota > Konverzácia > Správanie AI)
- Pridajte explicitné inštrukcie v nastaveniach Role & Behavior (Rola a správanie): "Odpovedajte výhradne na základe poskytnutej bázy znalostí. Ak nemôžete nájsť relevantné informácie, povedzte 'O tejto téme nemám dostatok informácií.'"
- Udržujte svoju bázu znalostí komplexnú pre vaše špecifické odvetvie
Povedomie o báze znalostí
ChatLab nedokáže:
- Zhrnúť, čo presne sa nachádza v báze znalostí
- Poskytnúť zoznam pokrytých tém, súborov či krajín
- Podať prehľad o tom, koľko dokumentov je natrénovaných
- Vysvetliť, prečo boli vyhľadané konkrétne informácie
Chatbot vyhľadáva relevantné úryvky pre dopyty, ale nerozumie štruktúre ani metadátam vašej bázy znalostí.
Výkon pri veľkých bázach znalostí
Problémy so sémantickým prekrývaním
Keď viacero dokumentov obsahuje podobné informácie, systém môže:
- Vyhľadať menej relevantný obsah
- Prehliadnuť najvhodnejšiu odpoveď
- Nesprávne spojiť informácie z rôznych kontextov
Riešenia:
- Vyhnite sa duplicitnému obsahu naprieč súbormi
- Používajte jasné, odlíšiteľné pomenovania a štruktúru
- Otestujte dopyty, ktoré by sa mohli zhodovať s viacerými zdrojmi
- Rozdeľte obsiahle príručky na súbory zamerané na konkrétne témy
Prioritizácia vyhľadávania
AI vyhľadáva obsah na základe sémantickej podobnosti s otázkou používateľa. Systém:
- Neuprednostňuje novší obsah pred starším
- Nedáva prednosť konkrétnym typom súborov
- Nerozumie hierarchii ani dôležitosti dokumentov
Pre dosiahnutie najlepších výsledkov usporiadajte svoju bázu znalostí do odlíšiteľného, neprekrývajúceho sa obsahu.
Limity frekvencie dopytov a kvóty
Limity frekvencie správ
Na zabránenie zneužitiu majú chatboty konfigurovateľné limity frekvencie (rate limits). Po ich prekročení:
- Používateľom sa zobrazí správa o dosiahnutí limitu
- Pred odoslaním ďalších správ musia počkať
- Limity môžete nakonfigurovať v ponuke Bot Settings > Security (Nastavenia bota > Zabezpečenie)
Mesačné kredity na správy
Každý plán zahŕňa mesačné kredity (Credits) na správy, ktoré sa obnovujú k vášmu dátumu zúčtovania:
- FREE: 30 správ
- BASIC: 2 400 správ
- STANDARD: 11 000 správ
- PREMIUM: 50 000 správ
Po vyčerpaní kreditov chatbot prestane odpovedať, kým sa kredity neobnovia alebo kým nepovolíte účtovanie nadlimitných správ (overage).
Závislosti od externých služieb
ChatLab sa spolieha na služby tretích strán:
- OpenAI/Google - API rozhrania AI modelov na generovanie odpovedí
- Pinecone - vektorová databáza na vyhľadávanie znalostí
- ZenRows - extrakcia obsahu webových stránok
Výpadky služieb alebo limity frekvencie u týchto poskytovateľov môžu dočasne ovplyvniť:
- Rýchlosť generovania odpovedí
- Schopnosť skenovania webových stránok
- Presnosť vyhľadávania v znalostiach
Tieto výpadky sú zriedkavé, no počas servisných okien môžu spôsobiť krátke oneskorenia alebo chyby.
Prehľad osvedčených postupov
| Problém | Riešenie |
|---|---|
| Neúplné odpovede | Znížte duplicitu, prejdite na väčšiu veľkosť kontextu |
| Halucinácie | Nastavte kreativitu na 0, pridajte prísne inštrukcie pre rolu |
| Obsah sa nedá extrahovať | Používajte textové PDF súbory, vyhnite sa zdrojom s prevahou obrázkov |
| Prekrývajúce sa výsledky | Usporiadajte obsah do odlíšiteľných tém |
| Dosiahnuté limity frekvencie | Upravte limity v nastaveniach Security |
| Pomalé trénovanie | Použite skenovanie sitemapu, znížte hĺbku prechádzania |
V prípade špecifických problémov, ktoré tu nie sú uvedené, kontaktujte podporu cez Main Menu > Support Request (Hlavná ponuka > Žiadosť o podporu).