ChatLab utilizează tehnologia Retrieval-Augmented Generation (RAG) pentru a oferi răspunsuri bazate pe baza dumneavoastră de cunoștințe. Înțelegerea limitărilor acesteia vă ajută să optimizați performanța chatbotului și să stabiliți așteptări realiste.
Limitări ale ferestrei de context
ChatLab folosește modele AI cu limite stricte de tokenuri pentru procesarea solicitărilor. Fereastra de context trebuie să cuprindă simultan întrebarea utilizatorului, istoricul conversației și informațiile extrase din baza de cunoștințe.
Dimensiunile contextului în funcție de plan:
- FREE/BASIC: 8.000 de tokenuri
- STANDARD: 16.000 de tokenuri
- PREMIUM: 32.000 de tokenuri
Ce se întâmplă când contextul este depășit:
- Cunoștințele extrase sunt trunchiate
- Informațiile critice pot fi omise
- Răspunsurile pot fi incomplete sau pot omite detalii importante
Soluții:
- Eliminați conținutul redundant din datele de antrenare
- Împărțiți fișierele mari în documente mai mici, axate pe subiecte specifice
- Faceți upgrade la planul dumneavoastră pentru ferestre de context mai mari
- Folosiți instrucțiuni de rol clare și specifice pentru a ghida răspunsurile
Limite de antrenare și de extragere a conținutului
Limite pentru încărcarea fișierelor
- Dimensiunea maximă a fișierului: 50MB per fișier
- Formate acceptate: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Conținut care nu poate fi extras
ChatLab nu poate citi sau extrage text din:
- Imagini și elemente grafice - Textul integrat în imagini nu este recunoscut
- PDF-uri scanate - PDF-uri care conțin imagini ale textului și nu text propriu-zis
- Pagini protejate prin autentificare - Pagini care necesită date de conectare
- Conținut randat masiv prin JavaScript - Este posibil ca unele pagini dinamice să nu se randeze complet
- Elemente media non-text - Fișiere audio, video sau fișiere încorporate
Constrângeri la scanarea site-urilor web
- Timp de procesare: Scanările mari pot dura între 10 și 60 de minute
- Structură de adâncime: URL-urile imbricate foarte profund pot genera o eroare de timeout
- Conținut dinamic: Unele framework-uri JavaScript împiedică extragerea completă a conținutului
Provocări legate de comportamentul AI
Halucinații
Modelele AI pot genera răspunsuri plauzibile, dar incorecte, atunci când informațiile relevante nu se găsesc în baza de cunoștințe. În loc să admită că nu știe răspunsul, AI-ul poate recurge la datele sale generale de antrenare.
Reduceți halucinațiile:
- Setați Creativity (Creativitate) la 0 (Bot Settings (Setări bot) > Conversation (Conversație) > AI Behavior (Comportament AI))
- Adăugați instrucțiuni explicite în setările Role & Behavior (Rol și comportament): „Răspundeți exclusiv pe baza bazei de cunoștințe furnizate. Dacă nu găsiți informații relevante, spuneți «Nu dețin informații despre acest subiect».”
- Mențineți baza de cunoștințe completă pentru domeniul dumneavoastră specific
Conștientizarea conținutului bazei de cunoștințe
ChatLab nu poate să:
- Rezume ceea ce se află în baza de cunoștințe
- Listeze subiectele, fișierele sau țările acoperite
- Raporteze câte documente au fost antrenate
- Explice de ce au fost extrase anumite informații specifice
Chatbotul extrage fragmente relevante pentru fiecare solicitare, dar nu înțelege structura sau metadatele bazei dumneavoastră de cunoștințe.
Performanța în cazul bazelor de cunoștințe extinse
Probleme legate de suprapunerea semantică
Atunci când mai multe documente conțin informații similare, sistemul poate:
- Extrage conținut mai puțin relevant
- Omite cel mai potrivit răspuns
- Combina incorect informații din contexte diferite
Soluții:
- Evitați duplicarea conținutului în mai multe fișiere
- Folosiți o structură și denumiri clare și distincte
- Testați solicitări care s-ar putea potrivi cu mai multe surse
- Împărțiți ghidurile cuprinzătoare în fișiere axate pe teme exacte
Prioritizarea extragerii de informații
AI-ul extrage conținut pe baza similitudinii semantice cu întrebarea utilizatorului. Acesta nu:
- Preferă conținutul mai nou în detrimentul celui mai vechi
- Prioritizează anumite tipuri de fișiere
- Înțelege ierarhia sau importanța documentelor
Pentru cele mai bune rezultate, organizați baza de cunoștințe cu un conținut distinct, care nu se suprapune.
Limite de frecvență și cote
Limite de frecvență pentru mesaje
Pentru a preveni abuzurile, chatboturile au limite de frecvență configurabile. Când acestea sunt depășite:
- Utilizatorii văd un mesaj de limitare a frecvenței
- Aceștia trebuie să aștepte înainte de a trimite alte mesaje
- Configurați limitele în Bot Settings (Setări bot) > Security (Securitate)
Credite lunare pentru mesaje
Fiecare plan include credite lunare pentru mesaje, care se resetează la data de facturare:
- FREE: 30 de mesaje
- BASIC: 2.400 de mesaje
- STANDARD: 11.000 de mesaje
- PREMIUM: 50.000 de mesaje
Când creditele se epuizează, chatbotul nu mai răspunde până la resetarea acestora sau până când activați facturarea pentru consum suplimentar.
Dependențe de servicii externe
ChatLab se bazează pe servicii terțe:
- OpenAI/Google - API-uri ale modelelor AI pentru generarea răspunsurilor
- Pinecone - Bază de date vectorială pentru regăsirea informațiilor
- ZenRows - Extragerea conținutului de pe site-urile web
Întreruperile de serviciu sau limitele de frecvență ale acestor furnizori pot afecta temporar:
- Viteza de generare a răspunsurilor
- Capacitatea de scanare a site-urilor web
- Acuratețea regăsirii informațiilor
Aceste întreruperi sunt rare, dar pot provoca scurte întârzieri sau erori în timpul perioadelor de mentenanță.
Rezumat al bunelor practici
| Problemă | Soluție |
|---|---|
| Răspunsuri incomplete | Reduceți redundanța, măriți dimensiunea contextului prin upgrade |
| Halucinații | Setați creativitatea la 0, adăugați instrucțiuni stricte de rol |
| Conținutul nu poate fi extras | Folosiți PDF-uri bazate pe text, evitați sursele încărcate cu imagini |
| Rezultate care se suprapun | Organizați conținutul în subiecte distincte |
| Atingerea limitelor de frecvență | Ajustați limitele din setările de securitate |
| Antrenare lentă | Utilizați scanarea prin sitemap, reduceți adâncimea de accesare (crawl depth) |
Pentru probleme specifice care nu sunt abordate aici, contactați echipa de asistență prin Main Menu (Meniu principal) > Support Request (Solicitare de asistență).