Abikeskus
Oma chatboti treenimine

Uute veebisaidi allikate lisamine

Viimati uuendatud:

Veebisaidi allikate lisamine võimaldab teie vestlusrobotil õppida otse teie veebisaidi sisust. Olgu need tooteandmed, KKK-d või ajaveebipostitused - veebisaidi skannimine tagab, et vestlusrobot suudab pakkuda täpseid ja ajakohaseid vastuseid, mis põhinevad teie lehe tegelikul sisul.

Kust leida veebisaidi treenimine

Valige oma vestlusrobot ja liikuge seejärel vahekaardile Training (Treenimine). Valige vasakpoolsel külgribal Links (Lingid). Siin saate hallata kõiki veebisaidipõhiseid treenimisallikaid.

Treenimisvormi avamiseks klõpsake nupul Add New Training: Website (Lisa uus treenimine: veebisait).

Treenimise linkide loend esiletõstetud nupuga Add New Training

Skannimisvalikud

Treenimisvorm pakub veebisaidi sisu lisamiseks kahte võimalust, mida eraldab jaotur OR (VÕI).

Scan website contents (Skanni veebisaidi sisu) - sisestage URL väljale Address (Aadress) ja valige järgmiste suvandite vahel:

  • Whole website (Kogu veebisait) - roomab läbi kõik leitavad lehed, alustades teie sisestatud URL-ist
  • Single address (Üksik aadress) - skannib ainult teie sisestatud konkreetset lehte

Use sitemap (Kasuta sisukaarti) - sisestage oma sisukaardi URL (nt https://www.yourdomain.com/sitemap.xml) väljale Sitemap (Sisukaart). See skannib ainult lehti, mis on loetletud teie sisukaardifailis.

Sisukaardi kasutamisel lülitatakse aadressiväli automaatselt välja (ja vastupidi), kuna ühe treenimistöö kohta saab kasutada ainult ühte meetodit.

Uue treenimise aken, kus on näha väli Address, skannimisrežiimi rippmenüü ja sisukaardi valik

Treenimine kogu veebisaidi põhjal

  1. Sisestage oma veebisaidi juur-URL väljale Address (nt https://www.yourdomain.com)
  2. Valige aadressivälja all olevast rippmenüüst Whole website
  3. Klõpsake nupul Start scanning the website (Alusta veebisaidi skannimist)

Süsteem roomab läbi teie veebisaidi, järgides linke kõigi lehtede leidmiseks. Saate jälgida edenemist vahekaardil Trainings (Treenimised), kus näete reaalajas skannitud linkide arvu ja kogutud treenimismärke.

Uue treenimise aken esiletõstetud nupuga Start scanning the website

Treenimine üksiku lehe põhjal

  1. Sisestage konkreetse lehe URL väljale Address (nt https://www.yourdomain.com/pricing)
  2. Valige rippmenüüst Single address
  3. Klõpsake nupul Start scanning the website

See on kasulik juhul, kui peate oma vestlusroboti teadmusbaasi lisama ainult ühe konkreetse lehe, näiteks värskelt avaldatud artikli või uuendatud KKK lehe.

Treenimine sisukaardi põhjal

  1. Sisestage oma sisukaardi URL väljale Sitemap (nt https://www.yourdomain.com/sitemap.xml)
  2. Klõpsake nupul Start scanning the website

Sisukaardi skannimine tagab teile täpse kontrolli selle üle, millised lehed kaasatakse, kuna see töötleb ainult sisukaardifailis loetletud URL-e.

Üksikute lehtede valimine treenimiseks

Enne skannimise alustamist saate sisse lülitada valiku I want to select individual urls for training after scanning the website (Soovin pärast veebisaidi skannimist valida treenimiseks konkreetsed URL-id). See suvand on saadaval ainult kogu veebisaidi skannimisel (mitte üksiku aadressi režiimis).

Kui see on sisse lülitatud:

  1. Süsteem skannib teie veebisaiti ja tuvastab kõik lehed
  2. Pärast skannimise lõppemist näete puuvaadet kõigist leitud lehtedest koos nende märkide arvuga
  3. Märkige ruudud või tühjendage need, et lehti treenimisse kaasata või sellest välja jätta
  4. Klõpsake nupul Start the Training (Alusta treenimist), et alustada treenimist valitud lehtede põhjal

See on abiks siis, kui teie veebisait sisaldab lehti, mille põhjal te ei soovi vestlusrobotit treenida, näiteks sisselogimislehed, haldusalad või asjakohatud jaotised.

Veebisaidi keelte skannimine

Kui teie veebisait on avaldatud rohkem kui ühes keeles, tuvastab ChatLab skannimise ajal saadaolevad keeled ja võimaldab teil otsustada, millised neist kaasata oma vestlusroboti teadmusbaasi. Need juhtelemendid leiate treenimisvormi jaotisest Languages (Keeled), vahetult enne jaotist Advanced settings (Täpsemad seaded).

Treenimisvormi jaotis Languages, mis näitab keeleulatuse ja tuvastusmeetodi valikuid

Keeleulatus

Rippmenüü Language scope (Keeleulatus) määrab, kui suurt osa mitmekeelsest lehest skannitakse:

  • Main website language (recommended) (Veebisaidi põhikeel (soovitatav)) - vaikevalik. Skannitakse ainult lehe põhikeelt. Muud keeleversioonid jäetakse vahele. See hoiab teie treenimisandmed kompaktsed ning asjakohased ja kulutab vähem teie treenimismahtu.
  • All languages (Kõik keeled) - skannib lehe kõiki keeleversioone. See hõlmab kõiki teie lokaliseeritud lehti, kuid kogub rohkem sisu ja kulutab rohkem teie treenimismahtu.
  • Selected language (Valitud keel) - skannib ühteainsat keelt, mille valite saidil tuvastatud keelte hulgast.

ChatLab tuvastab teie veebisaidi põhikeele automaatselt ja kasutab seda vaikimisi. Kui valite Selected language, on tuvastatud põhikeel teie eest eelvalitud ja nimekirjas märgitud kui "main". Saate selle vahetada mis tahes muu tuvastatud keele vastu.

Keeletuvastus on saadaval kõigis pakettides, sealhulgas tasuta paketis. Tasuta paketis tuvastatakse lehe keel endiselt ning skannitakse ainult põhikeelt, välja arvatud juhul, kui lülitate ulatuseks All languages.

Keele tuvastamise meetod

Kui ulatuseks on seatud Main website language või Selected language, saate rippmenüüst Language detection method (Keele tuvastamise meetod) valida, kuidas ChatLab teie saidi keeleversioone tuvastab:

  • Hreflang attributes (recommended) (Hreflang-atribuudid (soovitatav)) - vaikevalik. Kasutab hreflang- ja lang-märgistust, mida enamik mitmekeelseid lehti juba kasutab oma keeleversioonide omavaheliseks sidumiseks.
  • URL path prefix (/en/, /de/, ...) (URL-i tee eesliide (/en/, /de/, ...)) - saitidele, mis hoiavad iga keelt eraldi teelõigus (nt /en/, /de/ või /fr/) ilma hreflang-märgistuseta.

Kui ChatLab ei suuda keeli automaatselt tuvastada, saate siiski skannida põhikeelt või kõiki keeli. Kui valite Selected language, sisestage esmalt oma veebisaidi aadress ülaltoodud väljadele ja valige see suvand seejärel uuesti, et lehte saaks analüüsida.

Ülevaate saamiseks sellest, kuidas teie vestlusrobot neid keeleversioone vastamisel kasutab, vaadake artikleid Mitmekeelsed vestlusrobotid ja Vestlusroboti keele seadistamine. Seal kirjeldatud teadmusbaasi keelerežiimid tuginevad allikatele, mida skanniti koos keeletuvastusega, mistõttu võib nende täielikuks ärakasutamiseks olla vaja vanemaid allikaid uuesti treenida.

Täpsemad seaded

Skannimise peenhäälestuse juhtelementidele ligipääsemiseks klõpsake treenimisvormil nupul Advanced settings.

Uue treenimise aken esiletõstetud paneeliga Advanced settings

Täpsemad seaded on jaotatud nelja ossa:

URL Filtering (URL-ide filtreerimine)

  • Include only URLs that contain (Kaasa ainult URL-id, mis sisaldavad) - skannige ainult nendele mustritele vastavaid URL-e (semikooloniga eraldatud, nt /en;/help)
  • Exclude URLs that contain (Välista URL-id, mis sisaldavad) - jätke vahele nendele mustritele vastavad URL-id (nt /news;/pictures). Tavalised mustrid, nagu /wp-admin/, /feed/ ja ostukorvilehed, on vaikimisi välistatud

Query Parameters (Päringuparameetrid)

  • Ignore all query parameters (Ignoreeri kõiki päringuparameetreid) - käsitlege erinevate päringuparameetritega URL-e sama lehena (nt /page?id=1 ja /page?id=2 muutuvad mõlemad väärtuseks /page)
  • Ignore specific query parameters (Ignoreeri konkreetseid päringuparameetreid) - ignoreerige ainult teatud parameetreid (tavalisi jälgimisparameetreid, nagu utm_source, fbclid, gclid, ignoreeritakse automaatselt)

Content Filtering (Sisu filtreerimine)

  • Include element IDs (Kaasa elementide ID-d) - eraldage sisu ainult konkreetsetest HTML-elementidest (kasutage ID-de jaoks #id, klasside jaoks .classname, määratud atribuudiga elementide jaoks [data-id="82874db"], eraldatuna semikoolonitega)
  • Exclude element IDs (Välista elementide ID-d) - jätke välja sisu konkreetsetest HTML-elementidest (nt footer;header;#navigation;[data-nosnippet])
  • Kaasamise/välistamise elementide määramisel ilmuvad tingimuslikud lülitid, mis võimaldavad teil kontrollida, kas roomaja järgib nendes elementides leiduvaid linke

Scraping Behavior (Kraapimiskäitumine)

  • Scrape documents (Kraabi dokumente) - eraldage sisu ka veebisaidilt leitud PDF-failidest
  • Exclude image links (Välista pildilingid) - jätke piltide URL-id treenimisandmestikust välja
  • Scrape hidden contents (Kraabi peidetud sisu) - kaasake sisu peidetud HTML-elementidest (vaikimisi lubatud)
  • Delay between pages (Viivitus lehtede vahel) - lisage lehepäringute vahele viivitus sekundites, et vähendada serveri koormust
  • Country code (Riigikood) - suunake kraapimine läbi konkreetse riigi puhverserveri (kahetäheline kood, nt us)

E-posti teavitused

Lüliti Email me when training is finished or needs my attention (Saada mulle e-kiri, kui treenimine on lõppenud või vajab minu tähelepanu) on vaikimisi sisse lülitatud. Kui see on aktiivne, saate e-posti teavituse, kui:

  • treenimine lõpeb edukalt
  • süsteem vajab teiepoolset tegevust (nt lehtede valimine pärast skannimist)
  • treenimise ajal tekib probleeme

Teavituste e-posti aadressi saate muuta lüliti kõrval oleval väljal.

Treenimise edenemise jälgimine

Pärast skannimise alustamist minge edenemise jälgimiseks vahekaardile Trainings. Iga treenimistöö näitab järgmist:

  • lähte-URL
  • hetkeseisund (Scanning links, Awaiting links selection, Training, Training completed)
  • edenemisriba aktiivse skannimise või treenimise ajal
  • viimase värskenduse kuupäev

Vahekaart Trainings, mis näitab lõpetatud treenimistööd koos esiletõstetud vahekaardiga Trainings

Klõpsake nupul More details (Rohkem üksikasju), et näha kõiki konkreetse treenimistöö jaoks kasutatud parameetreid, sealhulgas kõiki konfigureeritud täpsemaid seadeid.

Laiendatud treenimise üksikasjad, mis näitavad kõiki parameetreid

Treenitud linkide haldamine

Pärast treenimise lõppemist ilmuvad kõik skannitud lehed vahekaardile Links. Iga link näitab järgmist:

  • lehe pealkiri ja URL
  • märkide arv (treenimisandmete maht)
  • treenimisolek
  • viimase värskenduse kuupäev

Iga lingi puhul saate teha järgmist:

  • Retrain (Treeni uuesti) - skannige see konkreetne leht uuesti ja värskendage selle sisu
  • View (Kuva) - vaadake täpset sisu, mis lehelt eraldati
  • Delete (Kustuta) - eemaldage see leht oma vestlusroboti teadmusbaasist

Mitme lingi korraga uuesti treenimiseks või kustutamiseks kasutage märkeruutu Select all (Vali kõik) ja hulgitoimingute nuppe.

Skannitud sisu vaatamine

Klõpsake mis tahes treenitud lingi kõrval nuppu View, et näha täpselt, milline sisu sellelt lehelt eraldati.

Linkide loend esiletõstetud nupuga View

Allika vaatamise aken näitab lehe pealkirja, URL-i, märkide arvu, viimase värskenduse kuupäeva ja täielikku tekstisisu, mille põhjal teie vestlusrobotit treeniti. See aitab teil veenduda, et hõivati õige sisu, ja mõista oma vestlusroboti teadmusbaasi.

Allika vaatamise aken, mis näitab lehelt eraldatud sisu

Seotud artiklid