Centre d'aide
Entraîner votre chatbot

Entraîner un bot sur une boutique e-commerce sans intégration

Dernière mise à jour:

Vous n'avez pas besoin d'une intégration native pour entraîner un chatbot performant pour votre boutique en ligne. Avec le seul scraping de site web - correctement configuré - ChatLab peut répondre à des questions détaillées sur vos produits, la livraison, les retours et vos politiques.

Ce guide présente la configuration recommandée : deux entraînements distincts (les pages d'information et votre base de données produits) ainsi que les deux niveaux de filtrage qui permettent de garder chacun d'eux propre.

Intégration vs scraping - ce que chacun vous apporte

  • Scraping (sans intégration) - un instantané statique de vos pages. Idéal pour les descriptions de produits, les spécifications, les FAQ, les politiques de livraison et de retour, ainsi que les informations générales sur la boutique. Il ne connaît pas l'état des stocks en direct ni le statut des commandes.
  • Intégration - interroge votre boutique en temps réel : recherche de produits dans votre catalogue actuel, prix et disponibilités à jour, et consultation du statut des commandes.

Les meilleurs résultats s'obtiennent en combinant les deux. Si vous ne pouvez pas activer d'intégration, un scraping bien configuré constitue une excellente base.

Si votre boutique se connecte ultérieurement à une intégration e-commerce prise en charge (WooCommerce, Shopify, PrestaShop et d'autres), son catalogue en direct apparaît séparément sous Training > E-commerce catalog (Entraînement > Catalogue e-commerce), sur les onglets Products (Produits) et Categories (Catégories). Ce catalogue est synchronisé depuis l'intégration - il n'est pas identique aux pages scrapées décrites ici, qui restent un instantané statique.

Où trouver les paramètres de filtrage

Accédez à Training > Links (Entraînement > Liens), cliquez sur Add New Training: Website (Ajouter un nouvel entraînement : Site web), puis développez Advanced settings (Paramètres avancés). Vous y trouverez les sections accordéon utilisées tout au long de ce guide : URL Filtering (Filtrage des URL : Include only URLs that contain / Exclude URLs that contain), Query Parameters, Content Filtering (Filtrage du contenu) et Scraping Behavior.

Paramètres avancés dans la modale d'entraînement de site web

Les deux niveaux de filtrage (le concept clé)

ChatLab vous offre deux niveaux de contrôle indépendants dans les paramètres avancés d'un entraînement de site web. Ils sont faciles à confondre, veillez donc à bien les distinguer :

Section URL Filtering mise en évidence dans les paramètres avancés

  1. Filtrage des URL - quelles pages entrent dans l'entraînement. Détermine quelles adresses le crawler conserve. Défini avec Include only URLs that contain (Inclure uniquement les URL qui contiennent) et Exclude URLs that contain (Exclure les URL qui contiennent) (sous-chaînes d'URL, séparées par des points-virgules, par ex. /product;/produkt).
  2. Filtrage des éléments - quelles parties de chaque page conservée deviennent du contenu. Appliqué après le filtrage des URL, uniquement aux pages qui l'ont franchi. Défini avec Include element IDs (Inclure les identifiants d'éléments) et Exclude element IDs (Exclure les identifiants d'éléments) (sélecteurs CSS : #id pour les identifiants, .classname pour les classes, [data-hook="description"] pour les attributs, séparés par des points-virgules, par ex. .product-description;#tab-description).

Voyez cela comme un entonnoir : le filtrage des URL sélectionne les pages, puis le filtrage des éléments réduit chaque page à son contenu utile.

Conserver moins de contenu, mais de meilleure qualité

Les chatbots RAG fonctionnent mieux lorsque chaque segment entraîné est ciblé. Sur une page produit, la description propre au produit a de la valeur - les menus environnants, les pieds de page, les « produits associés » et les blocs de vente incitative constituent du bruit qui dilue la recherche et consomme inutilement des caractères d'entraînement. Entraînez le modèle uniquement sur le contenu du produit.

Mettre en place deux entraînements distincts

Diviser votre boutique en deux sources de sites web permet de garder chacune propre et facile à ajuster. Chaque entraînement utilise son propre filtrage d'URL (niveau 1) et filtrage d'éléments (niveau 2).

1. Pages d'information

Objectif : conserver les pages qui présentent votre activité (À propos, Contact, Livraison, Expédition, Retours, Garantie, Paiement, Confidentialité, FAQ).

  • Niveau 1 - filtrage des URL : dans Exclude URLs that contain, listez les structures d'URL de vos produits et catégories, par ex. /product;/products;/shop;/category;/collections. Cela évite d'inclure les pages produits dans cet entraînement.
  • Niveau 2 - filtrage des éléments : généralement léger ici. Vous pouvez éventuellement utiliser Exclude element IDs pour retirer l'en-tête et le pied de page globaux, par ex. header;footer;#navigation.
  • Privilégiez un entraînement à partir de votre sitemap pour une couverture prévisible.

2. Base de données produits

Objectif : un entraînement ciblé sur les pages produits, ne reprenant que le contenu propre à chaque produit.

  • Niveau 1 - filtrage des URL : dans Include only URLs that contain, listez uniquement les structures d'URL de vos produits, par ex. /product;/products. Tout le reste est ignoré.
  • Niveau 2 - filtrage des éléments : c'est ici que vous ne conservez que le contenu du produit. Utilisez Include element IDs pour capturer le bloc d'informations sur le produit, et/ou Exclude element IDs pour supprimer les éléments structurels de la boutique (en-tête, pied de page, navigation, produits associés, ventes incitatives, barres latérales). Consultez les sélecteurs par plateforme ci-dessous.

Identifiants d'éléments par plateforme (niveau 2 - points de départ)

Voici des valeurs pour les champs Include element IDs et Exclude element IDs (niveau 2). Il s'agit de sélecteurs CSS, séparés par des points-virgules. Les sélecteurs varient selon le thème - vérifiez sur votre propre boutique et ajustez-les. Le principe reste toujours le même : inclure le bloc d'informations sur le produit, exclure les éléments de structure globaux et les blocs de vente croisée.

WooCommerce

  • Include element IDs : .summary.entry-summary;.woocommerce-product-details__short-description;#tab-description
  • Exclude element IDs : header;footer;.related.products;.up-sells;.cross-sells;#secondary

Shopify

  • Include element IDs : .product__info;.product-single__description;.rte
  • Exclude element IDs : header;footer;.announcement-bar;.product-recommendations

PrestaShop

  • Include element IDs : .product-information;.product-description;#description
  • Exclude element IDs : #header;#footer;#_desktop_top_menu;.block-categories;.featured-products;#search_filters

Magento / Adobe Commerce

  • Include element IDs : .product-info-main;.product.attribute.description;#description
  • Exclude element IDs : .page-header;.page-footer;.nav-sections;.block.related;.block.upsell;.sidebar

Shoper

  • Include element IDs : .productfull;.productfull__description;#product-description
  • Exclude element IDs : .header;.footer;.navbar;.mainmenu;.product-suggested;.basket

CS-Cart

  • Include element IDs : .ty-product-block;.ty-product-feature;.ty-wysiwyg-content
  • Exclude element IDs : .ty-header;.ty-footer;.ty-menu;.ty-product-block__advanced-list;.ty-mainbox-title

IdoSell / IAI

  • Include element IDs : #projector_longDescription;.product_description;#detail_atributes
  • Exclude element IDs : #header;#footer;#menu;.suggestedProducts;.breadcrumb

OpenCart

  • Include element IDs : #tab-description;#product .description;.product-description
  • Exclude element IDs : #header;#footer;#menu;#column-left;#column-right;.related

BigCommerce

  • Include element IDs : .productView-description;.productView-details;#tab-description
  • Exclude element IDs : .header;.footer;.navPages;.productCarousel;.sidebar

Shopware

  • Include element IDs : .product-detail-name;.product-detail-description;.product-detail-description-text
  • Exclude element IDs : .header-main;.footer-main;.nav-main;.product-detail-cross-selling;.cms-element-product-slider

Wix Stores

  • Include element IDs : [data-hook="description"];[data-hook="product-description"];[data-hook="info-section"]
  • Exclude element IDs : header;footer;[data-hook="header"];[data-hook="related-products"]

Autres plateformes (osCommerce, Abicart, Selly, RedCart, AtomStore et autres)

Le même principe s'applique : ouvrez une page produit, trouvez le conteneur regroupant le nom du produit, sa description et ses attributs, placez-le dans Include element IDs, puis indiquez l'en-tête global, le pied de page, les menus de navigation, les barres latérales et les blocs « vous aimerez aussi » dans Exclude element IDs.

Conseils

  • Choisissez un modèle d'IA adapté au raisonnement e-commerce dans les paramètres du bot.
  • Réentraînez régulièrement pour que les descriptions restent à jour (le scraping est un instantané statique).
  • Séparez bien les entraînements informationnels et produits afin de pouvoir ajuster les filtres d'URL et d'éléments de chacun sans impacter l'autre.

Articles connexes