Veebisaidi allikate lisamine võimaldab teie vestlusrobotil õppida otse teie veebisaidi sisust. Olgu need tooteandmed, KKK-d või ajaveebipostitused - veebisaidi skannimine tagab, et vestlusrobot suudab pakkuda täpseid ja ajakohaseid vastuseid, mis põhinevad teie lehe tegelikul sisul.
Kust leida veebisaidi treenimine
Valige oma vestlusrobot ja liikuge seejärel vahekaardile Training (Treenimine). Valige vasakpoolsel külgribal Links (Lingid). Siin saate hallata kõiki veebisaidipõhiseid treenimisallikaid.
Treenimisvormi avamiseks klõpsake nupul Add New Training: Website (Lisa uus treenimine: veebisait).
Skannimisvalikud
Treenimisvorm pakub veebisaidi sisu lisamiseks kahte võimalust, mida eraldab jaotur OR (VÕI).
Scan website contents (Skanni veebisaidi sisu) - sisestage URL väljale Address (Aadress) ja valige järgmiste suvandite vahel:
- Whole website (Kogu veebisait) - roomab läbi kõik leitavad lehed, alustades teie sisestatud URL-ist
- Single address (Üksik aadress) - skannib ainult teie sisestatud konkreetset lehte
Use sitemap (Kasuta sisukaarti) - sisestage oma sisukaardi URL (nt https://www.yourdomain.com/sitemap.xml) väljale Sitemap (Sisukaart). See skannib ainult lehti, mis on loetletud teie sisukaardifailis.
Sisukaardi kasutamisel lülitatakse aadressiväli automaatselt välja (ja vastupidi), kuna ühe treenimistöö kohta saab kasutada ainult ühte meetodit.
Treenimine kogu veebisaidi põhjal
- Sisestage oma veebisaidi juur-URL väljale Address (nt
https://www.yourdomain.com) - Valige aadressivälja all olevast rippmenüüst Whole website
- Klõpsake nupul Start scanning the website (Alusta veebisaidi skannimist)
Süsteem roomab läbi teie veebisaidi, järgides linke kõigi lehtede leidmiseks. Saate jälgida edenemist vahekaardil Trainings (Treenimised), kus näete reaalajas skannitud linkide arvu ja kogutud treenimismärke.
Treenimine üksiku lehe põhjal
- Sisestage konkreetse lehe URL väljale Address (nt
https://www.yourdomain.com/pricing) - Valige rippmenüüst Single address
- Klõpsake nupul Start scanning the website
See on kasulik juhul, kui peate oma vestlusroboti teadmusbaasi lisama ainult ühe konkreetse lehe, näiteks värskelt avaldatud artikli või uuendatud KKK lehe.
Treenimine sisukaardi põhjal
- Sisestage oma sisukaardi URL väljale Sitemap (nt
https://www.yourdomain.com/sitemap.xml) - Klõpsake nupul Start scanning the website
Sisukaardi skannimine tagab teile täpse kontrolli selle üle, millised lehed kaasatakse, kuna see töötleb ainult sisukaardifailis loetletud URL-e.
Üksikute lehtede valimine treenimiseks
Enne skannimise alustamist saate sisse lülitada valiku I want to select individual urls for training after scanning the website (Soovin pärast veebisaidi skannimist valida treenimiseks konkreetsed URL-id). See suvand on saadaval ainult kogu veebisaidi skannimisel (mitte üksiku aadressi režiimis).
Kui see on sisse lülitatud:
- Süsteem skannib teie veebisaiti ja tuvastab kõik lehed
- Pärast skannimise lõppemist näete puuvaadet kõigist leitud lehtedest koos nende märkide arvuga
- Märkige ruudud või tühjendage need, et lehti treenimisse kaasata või sellest välja jätta
- Klõpsake nupul Start the Training (Alusta treenimist), et alustada treenimist valitud lehtede põhjal
See on abiks siis, kui teie veebisait sisaldab lehti, mille põhjal te ei soovi vestlusrobotit treenida, näiteks sisselogimislehed, haldusalad või asjakohatud jaotised.
Veebisaidi keelte skannimine
Kui teie veebisait on avaldatud rohkem kui ühes keeles, tuvastab ChatLab skannimise ajal saadaolevad keeled ja võimaldab teil otsustada, millised neist kaasata oma vestlusroboti teadmusbaasi. Need juhtelemendid leiate treenimisvormi jaotisest Languages (Keeled), vahetult enne jaotist Advanced settings (Täpsemad seaded).
Keeleulatus
Rippmenüü Language scope (Keeleulatus) määrab, kui suurt osa mitmekeelsest lehest skannitakse:
- Main website language (recommended) (Veebisaidi põhikeel (soovitatav)) - vaikevalik. Skannitakse ainult lehe põhikeelt. Muud keeleversioonid jäetakse vahele. See hoiab teie treenimisandmed kompaktsed ning asjakohased ja kulutab vähem teie treenimismahtu.
- All languages (Kõik keeled) - skannib lehe kõiki keeleversioone. See hõlmab kõiki teie lokaliseeritud lehti, kuid kogub rohkem sisu ja kulutab rohkem teie treenimismahtu.
- Selected language (Valitud keel) - skannib ühteainsat keelt, mille valite saidil tuvastatud keelte hulgast.
ChatLab tuvastab teie veebisaidi põhikeele automaatselt ja kasutab seda vaikimisi. Kui valite Selected language, on tuvastatud põhikeel teie eest eelvalitud ja nimekirjas märgitud kui "main". Saate selle vahetada mis tahes muu tuvastatud keele vastu.
Keeletuvastus on saadaval kõigis pakettides, sealhulgas tasuta paketis. Tasuta paketis tuvastatakse lehe keel endiselt ning skannitakse ainult põhikeelt, välja arvatud juhul, kui lülitate ulatuseks All languages.
Keele tuvastamise meetod
Kui ulatuseks on seatud Main website language või Selected language, saate rippmenüüst Language detection method (Keele tuvastamise meetod) valida, kuidas ChatLab teie saidi keeleversioone tuvastab:
- Hreflang attributes (recommended) (Hreflang-atribuudid (soovitatav)) - vaikevalik. Kasutab
hreflang- jalang-märgistust, mida enamik mitmekeelseid lehti juba kasutab oma keeleversioonide omavaheliseks sidumiseks. - URL path prefix (/en/, /de/, ...) (URL-i tee eesliide (/en/, /de/, ...)) - saitidele, mis hoiavad iga keelt eraldi teelõigus (nt
/en/,/de/või/fr/) ilmahreflang-märgistuseta.
Kui ChatLab ei suuda keeli automaatselt tuvastada, saate siiski skannida põhikeelt või kõiki keeli. Kui valite Selected language, sisestage esmalt oma veebisaidi aadress ülaltoodud väljadele ja valige see suvand seejärel uuesti, et lehte saaks analüüsida.
Ülevaate saamiseks sellest, kuidas teie vestlusrobot neid keeleversioone vastamisel kasutab, vaadake artikleid Mitmekeelsed vestlusrobotid ja Vestlusroboti keele seadistamine. Seal kirjeldatud teadmusbaasi keelerežiimid tuginevad allikatele, mida skanniti koos keeletuvastusega, mistõttu võib nende täielikuks ärakasutamiseks olla vaja vanemaid allikaid uuesti treenida.
Täpsemad seaded
Skannimise peenhäälestuse juhtelementidele ligipääsemiseks klõpsake treenimisvormil nupul Advanced settings.
Täpsemad seaded on jaotatud nelja ossa:
URL Filtering (URL-ide filtreerimine)
- Include only URLs that contain (Kaasa ainult URL-id, mis sisaldavad) - skannige ainult nendele mustritele vastavaid URL-e (semikooloniga eraldatud, nt
/en;/help) - Exclude URLs that contain (Välista URL-id, mis sisaldavad) - jätke vahele nendele mustritele vastavad URL-id (nt
/news;/pictures). Tavalised mustrid, nagu/wp-admin/,/feed/ja ostukorvilehed, on vaikimisi välistatud
Query Parameters (Päringuparameetrid)
- Ignore all query parameters (Ignoreeri kõiki päringuparameetreid) - käsitlege erinevate päringuparameetritega URL-e sama lehena (nt
/page?id=1ja/page?id=2muutuvad mõlemad väärtuseks/page) - Ignore specific query parameters (Ignoreeri konkreetseid päringuparameetreid) - ignoreerige ainult teatud parameetreid (tavalisi jälgimisparameetreid, nagu
utm_source,fbclid,gclid, ignoreeritakse automaatselt)
Content Filtering (Sisu filtreerimine)
- Include element IDs (Kaasa elementide ID-d) - eraldage sisu ainult konkreetsetest HTML-elementidest (kasutage ID-de jaoks
#id, klasside jaoks.classname, määratud atribuudiga elementide jaoks[data-id="82874db"], eraldatuna semikoolonitega) - Exclude element IDs (Välista elementide ID-d) - jätke välja sisu konkreetsetest HTML-elementidest (nt
footer;header;#navigation;[data-nosnippet]) - Kaasamise/välistamise elementide määramisel ilmuvad tingimuslikud lülitid, mis võimaldavad teil kontrollida, kas roomaja järgib nendes elementides leiduvaid linke
Scraping Behavior (Kraapimiskäitumine)
- Scrape documents (Kraabi dokumente) - eraldage sisu ka veebisaidilt leitud PDF-failidest
- Exclude image links (Välista pildilingid) - jätke piltide URL-id treenimisandmestikust välja
- Scrape hidden contents (Kraabi peidetud sisu) - kaasake sisu peidetud HTML-elementidest (vaikimisi lubatud)
- Delay between pages (Viivitus lehtede vahel) - lisage lehepäringute vahele viivitus sekundites, et vähendada serveri koormust
- Country code (Riigikood) - suunake kraapimine läbi konkreetse riigi puhverserveri (kahetäheline kood, nt
us)
E-posti teavitused
Lüliti Email me when training is finished or needs my attention (Saada mulle e-kiri, kui treenimine on lõppenud või vajab minu tähelepanu) on vaikimisi sisse lülitatud. Kui see on aktiivne, saate e-posti teavituse, kui:
- treenimine lõpeb edukalt
- süsteem vajab teiepoolset tegevust (nt lehtede valimine pärast skannimist)
- treenimise ajal tekib probleeme
Teavituste e-posti aadressi saate muuta lüliti kõrval oleval väljal.
Treenimise edenemise jälgimine
Pärast skannimise alustamist minge edenemise jälgimiseks vahekaardile Trainings. Iga treenimistöö näitab järgmist:
- lähte-URL
- hetkeseisund (Scanning links, Awaiting links selection, Training, Training completed)
- edenemisriba aktiivse skannimise või treenimise ajal
- viimase värskenduse kuupäev
Klõpsake nupul More details (Rohkem üksikasju), et näha kõiki konkreetse treenimistöö jaoks kasutatud parameetreid, sealhulgas kõiki konfigureeritud täpsemaid seadeid.
Treenitud linkide haldamine
Pärast treenimise lõppemist ilmuvad kõik skannitud lehed vahekaardile Links. Iga link näitab järgmist:
- lehe pealkiri ja URL
- märkide arv (treenimisandmete maht)
- treenimisolek
- viimase värskenduse kuupäev
Iga lingi puhul saate teha järgmist:
- Retrain (Treeni uuesti) - skannige see konkreetne leht uuesti ja värskendage selle sisu
- View (Kuva) - vaadake täpset sisu, mis lehelt eraldati
- Delete (Kustuta) - eemaldage see leht oma vestlusroboti teadmusbaasist
Mitme lingi korraga uuesti treenimiseks või kustutamiseks kasutage märkeruutu Select all (Vali kõik) ja hulgitoimingute nuppe.
Skannitud sisu vaatamine
Klõpsake mis tahes treenitud lingi kõrval nuppu View, et näha täpselt, milline sisu sellelt lehelt eraldati.
Allika vaatamise aken näitab lehe pealkirja, URL-i, märkide arvu, viimase värskenduse kuupäeva ja täielikku tekstisisu, mille põhjal teie vestlusrobotit treeniti. See aitab teil veenduda, et hõivati õige sisu, ja mõista oma vestlusroboti teadmusbaasi.
Seotud artiklid
- Treenimine taustal - vaadake, kuidas treenimine taustal toimib
- Vestlusroboti uuesti treenimine - kuidas värskendada oma vestlusrobotit uue sisuga
- Kuidas vähendada treenimismärkide arvu veebisaidi skannimisel - näpunäited treenimisandmete mahu optimeerimiseks
- Vestlusroboti treenimine: põhitõed ja piirangud - ülevaade treenimisandmete piirangutest