Centru de ajutor
Trenarea chatbotului dumneavoastră

Adăugarea unor surse noi de tip website

Ultima actualizare:

Adăugarea surselor de tip website permite chatbotului dumneavoastră să învețe direct din conținutul site-ului dumneavoastră. Fie că este vorba despre detalii despre produse, secțiuni de întrebări frecvente (FAQ) sau articole de blog, scanarea site-ului dumneavoastră web asigură faptul că chatbotul poate oferi răspunsuri precise și actualizate, bazate pe conținutul real al site-ului.

Unde găsiți antrenarea pe baza site-ului web

Selectați chatbotul dumneavoastră, apoi navigați la fila Training (Antrenare). În bara laterală din stânga, alegeți Links (Linkuri). Aici gestionați toate sursele de antrenare bazate pe site-uri web.

Faceți clic pe Add New Training: Website (Adăugare antrenare nouă: Website) pentru a deschide formularul de antrenare.

Lista de linkuri pentru antrenare cu butonul Add New Training evidențiat

Opțiuni de scanare

Formularul de antrenare vă oferă două modalități de a adăuga conținut de pe site-ul web, separate printr-un separator OR (SAU).

Scan website contents (Scanare conținut site web) - Introduceți un URL în câmpul Address (Adresă) și alegeți între:

  • Whole website (Întregul site web) - Explorează toate paginile identificabile pornind de la URL-ul pe care îl furnizați
  • Single address (Adresă unică) - Scanează doar pagina specifică pe care o introduceți

Use sitemap (Utilizare sitemap) - Introduceți URL-ul sitemap-ului dumneavoastră (de exemplu, https://www.yourdomain.com/sitemap.xml) în câmpul Sitemap. Această opțiune scanează doar paginile listate în fișierul dumneavoastră sitemap.

Când utilizați un sitemap, câmpul Address este dezactivat automat (și invers), deoarece puteți utiliza o singură metodă pentru fiecare sarcină de antrenare.

Fereastra modală pentru antrenare nouă care afișează câmpul Address, meniul derulant pentru modul de scanare și opțiunea de sitemap

Antrenare pe întregul site web

  1. Introduceți URL-ul rădăcină al site-ului dumneavoastră în câmpul Address (de exemplu, https://www.yourdomain.com)
  2. Selectați Whole website din meniul derulant de sub câmpul pentru adresă
  3. Faceți clic pe Start scanning the website (Începe scanarea site-ului web)

Sistemul va explora site-ul dumneavoastră web, urmărind linkurile pentru a descoperi toate paginile. Puteți monitoriza progresul în fila Trainings (Antrenări), unde veți vedea numărul de linkuri scanate și caracterele de antrenare colectate în timp real.

Fereastra modală pentru antrenare nouă cu butonul Start scanning the website evidențiat

Antrenare pe o singură pagină

  1. Introduceți URL-ul paginii specifice în câmpul Address (de exemplu, https://www.yourdomain.com/pricing)
  2. Selectați Single address din meniul derulant
  3. Faceți clic pe Start scanning the website

Acest lucru este util atunci când trebuie doar să adăugați o anumită pagină în baza de cunoștințe a chatbotului, de exemplu un articol nou publicat sau o pagină de întrebări frecvente actualizată.

Antrenare pe baza sitemap-ului

  1. Introduceți URL-ul sitemap-ului dumneavoastră în câmpul Sitemap (de exemplu, https://www.yourdomain.com/sitemap.xml)
  2. Faceți clic pe Start scanning the website

Scanarea prin sitemap vă oferă un control precis asupra paginilor incluse, deoarece procesează doar URL-urile listate în fișierul dumneavoastră sitemap.

Selectarea paginilor individuale pentru antrenare

Înainte de a începe o scanare, puteți activa comutatorul I want to select individual urls for training after scanning the website (Doresc să selectez URL-uri individuale pentru antrenare după scanarea site-ului web). Această opțiune este disponibilă doar atunci când scanați un site web întreg (nu și pentru modul de adresă unică).

Când este activat:

  1. Sistemul scanează site-ul dumneavoastră web și descoperă toate paginile
  2. După finalizarea scanării, veți vedea o structură arborescentă a tuturor paginilor descoperite, împreună cu numărul lor de caractere
  3. Bifați sau debifați paginile pentru a le include sau exclude din antrenare
  4. Faceți clic pe Start the Training (Începe antrenarea) pentru a începe antrenarea pe baza paginilor selectate

Acest lucru este util atunci când site-ul dumneavoastră conține pagini din care nu doriți ca chatbotul să învețe, cum ar fi paginile de autentificare, zonele de administrare sau secțiunile irelevante.

Scanarea limbilor site-ului web

Dacă site-ul dumneavoastră este publicat în mai multe limbi, ChatLab detectează limbile disponibile în timpul scanării și vă permite să decideți pe care dintre acestea să le includeți în baza de cunoștințe a chatbotului. Veți găsi aceste setări în secțiunea Languages (Limbi) a formularului de antrenare, chiar deasupra Advanced settings (Setări avansate).

Secțiunea Languages din formularul de antrenare care arată opțiunile pentru aria lingvistică și metoda de detectare

Aria lingvistică

Meniul derulant Language scope (Arie lingvistică) controlează cât din conținutul unui site multilingv este scanat:

  • Main website language (recommended) (Limba principală a site-ului - recomandat) - opțiunea implicită. Este scanată doar limba principală a site-ului. Celelalte versiuni lingvistice sunt omise. Acest lucru vă menține datele de antrenare clare și concentrate, utilizând mai puțin din capacitatea dumneavoastră de antrenare.
  • All languages (Toate limbile) - scanează fiecare versiune lingvistică a site-ului. Această opțiune preia toate paginile dumneavoastră localizate, dar colectează mai mult conținut și utilizează mai mult din capacitatea dumneavoastră de antrenare.
  • Selected language (Limba selectată) - scanează o singură limbă pe care o alegeți dintre cele detectate pe site.

ChatLab detectează automat limba principală a site-ului dumneavoastră și o utilizează ca opțiune implicită. Când alegeți Selected language, limba principală detectată este preselectată automat și marcată ca „main” în listă. O puteți schimba cu oricare altă limbă detectată.

Detectarea limbii este disponibilă pentru fiecare plan, inclusiv pentru planul FREE. În planul FREE, limba paginii este detectată în continuare și este scanată doar limba principală, cu excepția cazului în care comutați aria lingvistică la All languages.

Metoda de detectare a limbii

Când aria este setată la Main website language sau Selected language, puteți alege modul în care ChatLab recunoaște versiunile lingvistice de pe site-ul dumneavoastră din meniul derulant Language detection method (Metodă de detectare a limbii):

  • Hreflang attributes (recommended) (Atribute hreflang - recomandat) - opțiunea implicită. Utilizează marcajul hreflang și lang pe care majoritatea site-urilor multilingve îl oferă deja pentru a interconecta versiunile lingvistice.
  • URL path prefix (/en/, /de/, ...) (Prefix cale URL) - pentru site-urile care păstrează fiecare limbă într-un segment de cale precum /en/, /de/ sau /fr/, fără niciun marcaj hreflang.

Dacă ChatLab nu poate detecta automat limbile, puteți scana în continuare limba principală sau toate limbile. Când alegeți Selected language, introduceți mai întâi adresa site-ului dumneavoastră în câmpurile de mai sus, apoi alegeți din nou opțiunea pentru ca site-ul să poată fi analizat.

Pentru o prezentare generală a modului în care chatbotul dumneavoastră folosește aceste versiuni de limbă atunci când răspunde, consultați Multilingual chatbots și Chatbot language setup. Modurile lingvistice ale bazei de cunoștințe descrise acolo se bazează pe surse care au fost scanate cu detectarea limbii activată, astfel încât sursele mai vechi ar putea necesita o reantrenare pentru a beneficia pe deplin de acestea.

Setări avansate

Faceți clic pe butonul Advanced settings din formularul de antrenare pentru a accesa opțiuni detaliate de scanare.

Fereastra modală pentru antrenare nouă cu panoul Advanced settings evidențiat

Setările avansate sunt organizate în patru secțiuni:

URL Filtering (Filtrare URL-uri)

  • Include only URLs that contain (Include doar URL-urile care conțin) - Scanează doar URL-urile care se potrivesc cu aceste tipare (separate prin punct și virgulă, de exemplu /en;/help)
  • Exclude URLs that contain (Exclude URL-urile care conțin) - Omite URL-urile care se potrivesc cu aceste tipare (de exemplu /news;/pictures). Tiparele comune precum /wp-admin/, /feed/ și paginile de coș sunt excluse în mod implicit

Query Parameters (Parametri de interogare)

  • Ignore all query parameters (Ignoră toți parametrii de interogare) - Tratează URL-urile cu parametri de interogare diferiți ca fiind aceeași pagină (de exemplu, /page?id=1 și /page?id=2 devin ambele /page)
  • Ignore specific query parameters (Ignoră anumiți parametri de interogare) - Ignoră doar anumiți parametri (parametrii comuni de urmărire precum utm_source, fbclid, gclid sunt ignorați automat)

Content Filtering (Filtrare conținut)

  • Include element IDs (Include ID-uri de elemente) - Extrage conținut doar din elemente HTML specifice (folosiți #id pentru ID-uri, .classname pentru clase, [data-id="82874db"] pentru elemente cu un anumit atribut, separate prin punct și virgulă)
  • Exclude element IDs (Exclude ID-uri de elemente) - Omite conținutul din elemente HTML specifice (de exemplu, footer;header;#navigation;[data-nosnippet])
  • Când sunt setate elementele de includere/excludere, apar comutatoare condiționale care vă permit să controlați dacă crawlerul urmărește linkurile găsite în cadrul acelor elemente

Scraping Behavior (Comportament de extragere a datelor)

  • Scrape documents (Extrage documente) - Extrage conținut și din fișierele PDF găsite pe site-ul web
  • Exclude image links (Exclude linkurile imaginilor) - Omite URL-urile imaginilor din setul de date de antrenare
  • Scrape hidden contents (Extrage conținutul ascuns) - Include conținutul din elementele HTML ascunse (activat în mod implicit)
  • Delay between pages (Întârziere între pagini) - Adaugă o întârziere în secunde între solicitările de pagini pentru a reduce încărcarea serverului
  • Country code (Cod de țară) - Direcționează extragerea de date printr-un server proxy dintr-o anumită țară (cod de două litere, de exemplu us)

Notificări prin e-mail

Comutatorul Email me when training is finished or needs my attention (Trimite-mi un e-mail când antrenarea este finalizată sau necesită atenția mea) este activat în mod implicit. Când este activ, primiți o notificare prin e-mail atunci când:

  • Antrenarea se finalizează cu succes
  • Sistemul are nevoie de intervenția dumneavoastră (de exemplu, selectarea paginilor după o scanare)
  • Apar probleme în timpul antrenării

Puteți modifica adresa de e-mail pentru notificări în câmpul de lângă comutator.

Monitorizarea progresului antrenării

După începerea unei scanări, comutați la fila Trainings pentru a monitoriza progresul. Fiecare sarcină de antrenare afișează:

  • URL-ul sursă
  • Starea curentă (Scanning links, Awaiting links selection, Training, Training completed)
  • O bară de progres în timpul scanării sau antrenării active
  • Data ultimei actualizări

Fila Trainings afișând o sarcină de antrenare finalizată, cu fila Trainings evidențiată

Faceți clic pe More details (Mai multe detalii) pentru a vedea toți parametrii utilizați pentru o anumită sarcină de antrenare, inclusiv setările avansate care au fost configurate.

Detalii despre antrenare extinse, afișând toți parametrii

Gestionarea linkurilor antrenate

După finalizarea antrenării, toate paginile scanate apar în fila Links. Fiecare link afișează:

  • Titlul paginii și URL-ul
  • Numărul de caractere (dimensiunea datelor de antrenare)
  • Starea antrenării
  • Data ultimei actualizări

Pentru fiecare link puteți alege:

  • Retrain (Reantrenează) - Rescanează și actualizează conținutul pentru această pagină specifică
  • View (Vizualizare) - Vizualizați conținutul exact care a fost extras din pagină
  • Delete (Șterge) - Eliminați această pagină din baza de cunoștințe a chatbotului

Utilizați caseta de selectare Select all (Selectează tot) și butoanele de acțiuni în masă pentru a reantrena sau șterge mai multe linkuri simultan.

Vizualizarea conținutului scanat

Faceți clic pe butonul View de lângă orice link antrenat pentru a vedea exact ce conținut a fost extras din acea pagină.

Lista de linkuri cu butonul View evidențiat

Fereastra modală de vizualizare a sursei afișează titlul paginii, URL-ul, numărul de caractere, data ultimei actualizări și conținutul text complet pe baza căruia a fost antrenat chatbotul dumneavoastră. Acest lucru vă ajută să verificați dacă a fost preluat conținutul corect și să înțelegeți baza de cunoștințe a chatbotului.

Fereastra modală de vizualizare a sursei afișând conținutul extras al paginii

Articole conexe