ChatLab käyttää RAG-menetelmää (Retrieval-Augmented Generation) tarjotakseen vastauksia tietopohjasi perusteella. Sen rajoitusten ymmärtäminen auttaa sinua optimoimaan chatbotisi suorituskyvyn ja asettamaan realistisia odotuksia.
Konteksti-ikkunan rajoitukset
ChatLab käyttää tekoälymalleja, joilla on tiukat token-rajat kyselyiden käsittelyyn. Konteksti-ikkunaan on mahduttava käyttäjän kysymys, keskusteluhistoria ja haettu tieto yhdessä.
Kontekstin koot tilauksen mukaan:
- FREE/BASIC: 8 000 tokenia
- STANDARD: 16 000 tokenia
- PREMIUM: 32 000 tokenia
Mitä tapahtuu, kun konteksti ylittyy:
- Haettua tietoa lyhennetään
- Kriittisiä tietoja saattaa jäädä pois
- Vastaukset voivat olla epätäydellisiä tai niistä saattaa puuttua tärkeitä yksityiskohtia
Ratkaisut:
- Poista päällekkäinen sisältö koulutusdatasta
- Jaa suuret tiedostot pienempiin, aihekohtaisiin dokumentteihin
- Päivitä tilauksesi suurempia konteksti-ikkunoita varten
- Käytä selkeitä, tarkkoja rooliohjeita ohjaamaan vastauksia
Koulutuksen ja sisällön poiminnan rajat
Tiedostojen latausrajat
- Tiedoston enimmäiskoko: 50 Mt per tiedosto
- Tuetut tiedostomuodot: PDF, DOC, DOCX, TXT, CSV, XLS, XLSX
Sisältö, jota ei voida poimia
ChatLab ei voi lukea tai poimia tekstiä seuraavista kohteista:
- Kuvat ja grafiikka - Kuviin upotettua tekstiä ei tunnisteta
- Skannatut PDF-tiedostot - PDF-tiedostot, jotka sisältävät kuvia tekstistä varsinaisen tekstin sijaan
- Kirjautumisen takana olevat sivut - Sivut, jotka vaativat todennuksen
- Voimakkaasti JavaScriptillä renderöity sisältö - Jotkin dynaamiset sivut eivät välttämättä renderöidy kokonaan
- Ei-tekstimuotoinen media - Ääni, video tai upotetut tiedostot
Verkkosivuston skannauksen rajoitukset
- Käsittelyaika: Suuret skannaukset voivat kestää 10-60 minuuttia
- Syvä hierarkia: Erittäin syvällä hierarkiassa olevat URL-osoitteet voivat aikakatkaista
- Dynaaminen sisältö: Jotkin JavaScript-sovelluskehykset estävät sisällön täydellisen poiminnan
Tekoälyn käyttäytymisen haasteet
Hallusinointi
Tekoälymallit voivat luoda uskottavia mutta virheellisiä vastauksia, kun asiaankuuluvaa tietoa ei löydy tietopohjasta. Tekoäly voi hyödyntää yleistä koulutusdataansa sen sijaan, että se myöntäisi, ettei tiedä vastausta.
Vähennä hallusinointia:
- Aseta Creativity to 0 (Luovuus arvoon 0) kohdassa Bot Settings > Conversation > AI Behavior (Botin asetukset > Keskustelu > Tekoälyn käyttäytyminen)
- Lisää selkeät ohjeet asetuksissa Role & Behavior (Rooli ja käyttäytyminen): "Vastaa vain annetun tietopohjan perusteella. Jos et löydä asiaankuuluvaa tietoa, sano 'Minulla ei ole tietoa tästä asiasta.'"
- Pidä tietopohjasi kattavana oman toimialasi osalta
Tietoisuus tietopohjasta
ChatLab ei voi:
- Tiivistää, mitä tietopohja sisältää
- Luetella käsiteltyjä aiheita, tiedostoja tai maita
- Kertoa, kuinka monta dokumenttia on koulutettu
- Selittää, miksi tietty tieto haettiin
Chatbot hakee kyselyihin asiaankuuluvia osia, mutta se ei ymmärrä tietopohjasi rakennetta tai metatietoja.
Suorituskyky suurten tietopohjien kanssa
Semanttisen päällekkäisyyden ongelmat
Kun useat dokumentit sisältävät samankaltaista tietoa, järjestelmä saattaa:
- Hakea vähemmän olennaista sisältöä
- Ohittaa sopivimman vastauksen
- Yhdistää tietoja eri konteksteista virheellisesti
Ratkaisut:
- Vältä sisällön monistamista useisiin tiedostoihin
- Käytä selkeää, erottuvaa nimeämistä ja rakennetta
- Testaa kyselyitä, jotka saattavat vastata useita lähteitä
- Jaa laajat oppaat kohdennettuihin aihetiedostoihin
Tiedonhaun priorisointi
Tekoäly hakee sisältöä käyttäjän kysymyksen semanttisen samankaltaisuuden perusteella. Se ei:
- Suosi uudempaa sisältöä vanhemman sijaan
- Priorisoi tiettyjä tiedostotyyppejä
- Ymmärrä dokumenttien hierarkiaa tai tärkeyttä
Järjestä tietopohjasi selkeäksi ilman päällekkäistä sisältöä parhaiden tulosten saavuttamiseksi.
Nopeusrajoitukset ja kiintiöt
Viestien nopeusrajoitukset
Väärinkäytön estämiseksi chatboteilla on määritettävissä olevat nopeusrajoitukset. Kun raja ylittyy:
- Käyttäjät näkevät nopeusrajoitusta koskevan viestin
- Heidän on odotettava ennen uusien viestien lähettämistä
- Määritä rajat kohdassa Bot Settings > Security (Botin asetukset > Turvallisuus)
Kuukausittaiset viestipisteet
Jokainen tilaus sisältää kuukausittaiset viestipisteet (Credits), jotka nollautuvat laskutuspäivänäsi:
- FREE: 30 viestiä
- BASIC: 2 400 viestiä
- STANDARD: 11 000 viestiä
- PREMIUM: 50 000 viestiä
Kun pisteet loppuvat, chatbot lakkaa vastaamasta, kunnes pisteet nollautuvat tai otat käyttöön lisälaskutuksen rajan ylityksistä.
Ulkoiset palveluriippuvuudet
ChatLab tukeutuu kolmannen osapuolen palveluihin:
- OpenAI/Google - Tekoälymallien API-rajapinnat vastausten luomiseen
- Pinecone - Vektoritietokanta tiedonhakua varten
- ZenRows - Verkkosivuston sisällön poiminta
Näiden palveluntarjoajien käyttökatkot tai nopeusrajoitukset voivat tilapäisesti vaikuttaa seuraaviin:
- Vastausten luontinopeus
- Verkkosivuston skannauskyky
- Tiedonhaun tarkkuus
Nämä katkokset ovat harvinaisia, mutta ne voivat aiheuttaa lyhyitä viiveitä tai virheitä huoltoikkunoiden aikana.
Parhaiden käytäntöjen yhteenveto
| Haaste | Ratkaisu |
|---|---|
| Epätäydelliset vastaukset | Vähennä päällekkäisyyttä, päivitä suurempaan kontekstin kokoon |
| Hallusinointi | Aseta luovuus arvoon 0, lisää tiukat rooliohjeet |
| Sisältöä ei voida poimia | Käytä tekstipohjaisia PDF-tiedostoja, vältä runsaasti kuvia sisältäviä lähteitä |
| Päällekkäiset tulokset | Järjestä sisältö erillisiin aiheisiin |
| Nopeusrajat täyttyvät | Säädä rajoja Security-asetuksissa |
| Hidas koulutus | Käytä sivukartan skannausta, vähennä läpikäyntisyvyyttä |
Jos sinulla on erityisiä ongelmia, joita ei käsitellä tässä, ota yhteyttä tukeen kohdasta Main Menu > Support Request (Päävalikko > Tukipyyntö).