Hjælpecenter
Træning af din chatbot

Tilføjelse af nye hjemmesidekilder

Sidst opdateret:

Når du tilføjer hjemmesidekilder, kan din chatbot lære direkte fra indholdet på dit websted. Uanset om det drejer sig om produktoplysninger, ofte stillede spørgsmål eller blogindlæg, sikrer en scanning af dit website, at chatbitten kan give præcise og opdaterede svar baseret på dit faktiske indhold.

Her finder du træning fra hjemmeside

Vælg din chatbot, og gå derefter til fanen Training (Træning). Vælg Links i venstre sidepanel. Her administrerer du alle hjemmesidebaserede træningskilder.

Klik på Add New Training: Website (Tilføj ny træning: Hjemmeside) for at åbne træningsformularen.

Liste over træningslinks med knappen Add New Training fremhævet

Scanningsmuligheder

Træningsformularen giver dig to måder at tilføje hjemmesideindhold på, adskilt af en OR-opdeling (ELLER).

Scan website contents (Scan hjemmesideindhold) - Indtast en URL i feltet Address (Adresse), og vælg mellem:

  • Whole website (Hele hjemmesiden) - Crawler alle sider, der kan findes, med udgangspunkt i den URL, du angiver
  • Single address (Enkelt adresse) - Scanner kun den specifikke side, du indtaster

Use sitemap (Brug sitemap) - Indtast URL'en til dit sitemap (f.eks. https://www.ditdomaene.dk/sitemap.xml) i feltet Sitemap. Dette scanner kun de sider, der er angivet i din sitemap-fil.

Når du bruger et sitemap, deaktiveres adressefeltet automatisk (og omvendt), da du kun kan bruge én metode pr. træningsjob.

Modalvinduet til ny træning, der viser adressefeltet, rullemenuen for scanningstilstand og sitemap-indstillingen

Træn på hele hjemmesiden

  1. Indtast rod-URL'en til din hjemmeside i feltet Address (f.eks. https://www.ditdomaene.dk)
  2. Vælg Whole website i rullemenuen under adressefeltet
  3. Klik på Start scanning the website (Start scanning af hjemmesiden)

Systemet crawler din hjemmeside og følger links for at finde alle sider. Du kan følge forløbet på fanen Trainings (Træninger), hvor du i realtid kan se antallet af scannede links og indsamlede træningstegn.

Modalvinduet til ny træning med knappen Start scanning the website fremhævet

Træn på en enkelt side

  1. Indtast den specifikke sides URL i feltet Address (f.eks. https://www.ditdomaene.dk/priser)
  2. Vælg Single address i rullemenuen
  3. Klik på Start scanning the website

Dette er nyttigt, hvis du kun behøver at tilføje en enkelt bestemt side til din chatbots videnbase, f.eks. en nyudgivet artikel eller en opdateret FAQ-side.

Træn på sitemap

  1. Indtast URL'en til dit sitemap i feltet Sitemap (f.eks. https://www.ditdomaene.dk/sitemap.xml)
  2. Klik på Start scanning the website

Scanning via sitemap giver dig præcis kontrol over, hvilke sider der medtages, da den udelukkende behandler URL'er, der fremgår af din sitemap-fil.

Valg af individuelle sider til træning

Før du starter en scanning, kan du aktivere indstillingen I want to select individual urls for training after scanning the website (Jeg vil vælge individuelle webadresser til træning efter scanning af hjemmesiden). Denne mulighed er kun tilgængelig, når du scanner en hel hjemmeside (ikke ved tilstanden for enkelt adresse).

Når den er aktiveret:

  1. Scanner systemet din hjemmeside og finder alle sider
  2. Vises der efter afsluttet scanning en trævisning over alle fundne sider inklusive deres tegnantal
  3. Markerer eller fjerner du markeringen ved sider for at inkludere eller udelukke dem fra træningen
  4. Klikker du på Start the Training (Start træningen) for at påbegynde træningen på de valgte sider

Dette er praktisk, hvis dit websted indeholder sider, du ikke ønsker, at chatbitten skal lære fra, såsom login-sider, administrationsområder eller irrelevante sektioner.

Scanning af sprog på hjemmesiden

Hvis din hjemmeside findes på flere sprog, registrerer ChatLab automatisk de tilgængelige sprog under scanningen og lader dig vælge, hvilke der skal medtages i din chatbots videnbase. Du finder disse indstillinger i sektionen Languages (Sprog) i træningsformularen lige over Advanced settings (Avancerede indstillinger).

Sektionen Languages i træningsformularen, der viser sprogomfang og indstillinger for registreringsmetode

Sprogvalg

Rullemenuen Language scope (Sprogvalg) styrer, hvor meget af et flersproget websted der scannes:

  • Main website language (recommended) (Hjemmesidens primære sprog (anbefales)) - standardindstillingen. Kun websitets hovedsprog scannes. Øvrige sprogversioner springes over. Dette holder dine træningsdata enkle og fokuserede og bruger mindre af din træningskapacitet.
  • All languages (Alle sprog) - scanner alle sprogversioner af hjemmesiden. Dette medtager alle dine lokaliserede sider, men indsamler mere indhold og bruger mere af din træningskapacitet.
  • Selected language (Valgt sprog) - scanner et enkelt sprog, som du vælger blandt dem, der blev fundet på siden.

ChatLab registrerer automatisk det primære sprog på din hjemmeside og bruger det som standard. Når du vælger Selected language, er det registrerede hovedsprog forudvalgt for dig og markeret som "main" på listen. Du kan ændre det til ethvert andet fundet sprog.

Sprogregistrering er tilgængelig i alle planer, også i den gratis version. I den gratis plan registreres sidens sprog stadig, og kun hovedsproget scannes, medmindre du ændrer omfanget til All languages.

Metode til sprogregistrering

Når omfanget er indstillet til Main website language eller Selected language, kan du vælge, hvordan ChatLab genkender sprogversionerne på dit website, via rullemenuen Language detection method (Metode til sprogregistrering):

  • Hreflang attributes (recommended) (Hreflang-attributter (anbefales)) - standardindstillingen. Benytter den hreflang- og lang-opmærkning, som de fleste flersprogede sites allerede indeholder til at kæde sprogversionerne sammen.
  • URL path prefix (/en/, /de/, ...) (URL-stipræfiks (/en/, /de/, ...)) - til websteder, der placerer hvert sprog under et stisegment som f.eks. /en/, /de/ eller /fr/ uden hreflang-opmærkning.

Hvis ChatLab ikke kan registrere sprogene automatisk, kan du stadig scanne hovedsproget eller alle sprog. Vælger du Selected language, skal du først indtaste din hjemmesideadresse i felterne ovenfor og derefter vælge indstillingen igen, så sitet kan blive analyseret.

For et overblik over, hvordan din chatbot efterfølgende anvender disse sprogversioner i sine svar, kan du læse Flersprogede chatbots og Opsætning af sprog til chatbot. De funktioner til videnbasens sprog, der beskrives der, afhænger af kilder, der er scannet med sprogregistrering slået til, så ældre kilder skal muligvis genoptrænes for at udnytte mulighederne fuldt ud.

Avancerede indstillinger

Klik på knappen Advanced settings i træningsformularen for at få adgang til detaljerede scanningsparametre.

Modalvinduet til ny træning med panelet Advanced settings fremhævet

De avancerede indstillinger er opdelt i fire sektioner:

URL Filtering (URL-filtrering)

  • Include only URLs that contain (Inkluder kun URL'er, der indeholder) - Scan kun webadresser, der matcher disse mønstre (adskilt med semikolon, f.eks. /da;/help)
  • Exclude URLs that contain (Ekskluder URL'er, der indeholder) - Spring webadresser over, der matcher disse mønstre (f.eks. /nyheder;/billeder). Almindelige mønstre såsom /wp-admin/, /feed/ og kurvsider udelukkes som standard

Query Parameters (Forespørgselsparametre)

  • Ignore all query parameters (Ignorer alle forespørgselsparametre) - Behandl webadresser med forskellige URL-parametre som den samme side (f.eks. bliver både /side?id=1 og /side?id=2 til /side)
  • Ignore specific query parameters (Ignorer specifikke forespørgselsparametre) - Ignorer kun bestemte parametre (almindelige sporingsparametre som utm_source, fbclid og gclid ignoreres automatisk)

Content Filtering (Indholdsfiltrering)

  • Include element IDs (Inkluder element-id'er) - Udtræk kun indhold fra specifikke HTML-elementer (brug #id for id'er, .klassenavn for klasser, [data-id="82874db"] for elementer med en bestemt attribut, adskilt med semikolon)
  • Exclude element IDs (Ekskluder element-id'er) - Spring indhold over fra specifikke HTML-elementer (f.eks. footer;header;#navigation;[data-nosnippet])
  • Der vises betingede knapper, når inkluderings- eller ekskluderingselementer er angivet, så du kan bestemme, om crawleren skal følge links, der findes inden i disse elementer

Scraping Behavior (Scraping-adfærd)

  • Scrape documents (Scrap dokumenter) - Udtræk også indhold fra PDF-filer, der findes på hjemmesiden
  • Exclude image links (Ekskluder billedlinks) - Udelad billed-URL'er fra træningsdatasættet
  • Scrape hidden contents (Scrap skjult indhold) - Inkluder indhold fra skjulte HTML-elementer (aktiveret som standard)
  • Delay between pages (Forsinkelse mellem sider) - Tilføj en forsinkelse i sekunder mellem sideanmodninger for at reducere serverbelastningen
  • Country code (Landekode) - Rute scraping gennem en proxyserver i et bestemt land (landekode med to bogstaver, f.eks. dk eller us)

E-mailnotifikationer

Knappen Email me when training is finished or needs my attention (Send mig en e-mail, når træningen er færdig eller kræver min opmærksomhed) er aktiveret som standard. Når den er aktiv, modtager du en e-mailbesked, når:

  • Træningen er fuldført uden fejl
  • Systemet har brug for dit input (f.eks. valg af sider efter en scanning)
  • Der opstår problemer under træningen

Du kan ændre e-mailadressen til notifikationer i feltet ved siden af knappen.

Hold øje med træningsforløbet

Når du har startet en scanning, kan du skifte til fanen Trainings for at følge status. Hvert træningsjob viser:

  • Kilde-URL'en
  • Nuværende status (Scanning links, Awaiting links selection, Training, Training completed)
  • EnStatuslinje under aktiv scanning eller træning
  • Datoen for den seneste opdatering

Fanen Trainings, der viser et gennemført træningsjob med fanen Trainings fremhævet

Klik på More details (Flere detaljer) for at se alle parametre, der blev brugt til et bestemt træningsjob, herunder eventuelle avancerede indstillinger, der blev konfigureret.

Udvidede træningsdetaljer, der viser alle parametre

Håndtering af trænede links

Når træningen er færdig, vises alle scannede sider på fanen Links. Hvert link viser:

  • Sidetitel og URL
  • Tegnantal (træningsdataenes størrelse)
  • Træningsstatus
  • Dato for seneste opdatering

For hvert link kan du:

  • Retrain (Gentæn) - Genscan og opdater indholdet for denne specifikke side
  • View (Vis) - Se det præcise indhold, der blev udtrukket fra siden
  • Delete (Slet) - Fjern denne side fra din chatbots videnbase

Brug afkrydsningsfeltet Select all (Vælg alle) og knapperne til massehandlinger for at genoptræne eller slette flere links på én gang.

Visning af scannet indhold

Klik på knappen View ud for et trænet link for at se præcist, hvilket indhold der blev udtrukket fra den pågældende side.

Linkliste med knappen View fremhævet

Kildevisningsvinduet viser sidens titel, URL, tegnantal, dato for seneste opdatering samt hele den tekst, som din chatbot blev trænet på. Dette hjælper dig med at bekræfte, at det korrekte indhold blev hentet, og giver indsigt i din chatbots videnbase.

Kildevisningsmodal, der viser udtrukket sideindhold

Relaterede artikler