# robots.txt — ccl.fr # # Les pages publiques (accueil, categories, fiches produit) sont indexables. # Les pages internes a faible valeur SEO (recherche, espace client, comparateur) # ne sont PAS bloquees ici : elles renvoient l'en-tete `X-Robots-Tag: noindex` # afin que Google les crawle puis les retire de l'index. On ne bloque au crawl # que les sections strictement privees / transactionnelles ci-dessous. User-agent: * Disallow: /admin Disallow: /checkout Disallow: /cart # Comptage des clics sur les bannieres promo : redirection pure, sans contenu. # Un crawler qui la suivrait gonflerait les compteurs du back-office. Disallow: /promo/ # Idem pour les clics sur les catalogues papier. Motif avec joker plutot que # « Disallow: /catalogues/ » : la page de liste /catalogues est un contenu # indexable, et on prefere qu'un crawler au prefixe approximatif la crawle # quand meme plutot que de risquer de la bloquer pour proteger un compteur. Disallow: /catalogues/*/clic # Sitemap — ADAPTER le domaine de production (www.ccl.fr vs ccl.fr) si besoin. Sitemap: https://www.ccl.fr/sitemap.xml