Robots.txt Shopify : le guide pour contrôler l’exploration de ta boutique

: le guide pour contrôler l’exploration de ta boutique

Le fichier robots.txt Shopify indique aux robots d’exploration les URL qu’ils peuvent consulter. Il contrôle l’exploration de ta boutique, mais ne sert pas à supprimer une page des résultats Google. Voici comment il fonctionne, ce que Shopify configure par défaut et quand il vaut vraiment la peine d’y toucher.

Qu’est-ce que le fichier robots.txt et pourquoi il existe

Le fichier robots.txt est un fichier texte placé à la racine du domaine principal de ta boutique. Il contient des règles destinées aux robots d’exploration des moteurs de recherche, comme Googlebot.

Son rôle est de gérer l’accès des robots à certaines URL. Google précise que cet outil sert principalement à éviter une surcharge de demandes sur le site et à contrôler l’exploration de pages similaires ou peu importantes (documentation Google sur robots.txt).

Toutes les boutiques Shopify disposent d’un fichier robots.txt par défaut. Shopify indique qu’il est optimisé pour le référencement naturel et qu’il convient à la plupart des boutiques (aide Shopify : robots.txt par défaut). Il empêche par exemple l’exploration de zones techniques comme le panier, le paiement ou la recherche interne, pour que les moteurs se concentrent sur les pages utiles.

Le fichier ne remplace pas le sitemap, qui sert à faire découvrir les URL importantes aux moteurs. C’est le sujet du guide sitemap Shopify, qui traite la découverte et la soumission. Ici, on parle de ce qui limite l’exploration.

Exploration et indexation, deux processus différents

L’exploration, c’est le moment où un robot consulte le contenu et le code d’une page. L’indexation, c’est l’enregistrement de cette page pour qu’elle puisse apparaître dans les résultats de recherche.

Les deux sont liés mais pas identiques. Un moteur peut découvrir et indexer une URL sans avoir exploré son contenu, par exemple si d’autres pages ou d’autres sites la référencent. C’est pour ça que robots.txt ne sert pas à désindexer une page. Pour empêcher une page d’apparaître dans Google, Google recommande une instruction noindex, une protection par mot de passe ou la suppression de la page (recommandation de Google).

Une URL bloquée par robots.txt peut donc rester visible dans Google. Le moteur peut l’avoir découverte par un lien et afficher son adresse, même sans avoir pu lire le contenu.

Choisis l’outil selon ton objectif : robots.txt pour réduire l’exploration d’une zone technique, un mécanisme d’indexation adapté pour empêcher l’affichage d’une page.

Le fichier robots.txt par défaut de Shopify

Le fichier est accessible à la racine du domaine principal de ta boutique, à une adresse de ce type :

https://exemple.com/robots.txt

Shopify fournit plusieurs règles par défaut, notamment sur ces chemins :

Disallow: /admin
Disallow: /cart
Disallow: /checkout
Disallow: /collections/*+*
Disallow: /search
Disallow: /policies/

Chaque règle a une raison d’être. /admin protège l’administration, inaccessible aux robots de toute façon. /cart et /checkout concernent le panier et le paiement, des pages propres à chaque session sans intérêt d’indexation. /collections/*+* bloque les collections filtrées, qui peuvent générer des URL dupliquées. /search couvre les résultats de recherche internes. Enfin, /policies/ concerne les pages de politiques générées automatiquement, similaires d’une boutique à l’autre (aide Shopify : règles par défaut).

Tu n’as donc pas besoin de modifier ces règles par principe. Avant toute intervention, vérifie quelle URL tu veux réellement contrôler et pourquoi.

Personnaliser robots.txt avec robots.txt.liquid

Shopify recommande de personnaliser le fichier avec un modèle nommé robots.txt.liquid, ajouté dans le dossier templates du thème. Le chemin : Boutique en ligne, Thèmes, menu …, Modifier le code, puis Ajouter un nouveau modèle et choisir robots.

Tu peux ensuite utiliser Liquid pour ajouter ou supprimer des directives : autoriser ou interdire l’exploration de certaines URL, ajouter des délais d’exploration, bloquer certains robots. Cette méthode est recommandée parce qu’elle laisse Shopify maintenir le fichier à jour automatiquement lors des évolutions futures (aide Shopify : modèle robots.txt.liquid).

Je te déconseille de modifier ce fichier sans comprendre chaque règle. Shopify recommande de travailler avec un Partenaire Shopify ou de disposer d’une expertise en code et en référencement. Évite aussi de remplacer le modèle par du texte brut : Shopify le déconseille fortement, car les règles deviennent obsolètes et les bonnes pratiques futures ne sont plus appliquées automatiquement.

Si une solution tierce comme Cloudflare a servi à contourner le fonctionnement Shopify, supprime-la avant de personnaliser. Plusieurs couches de règles rendent le diagnostic inutilement complexe.

Comprendre le message « Indexée, mais bloquée par robots.txt »

Le rapport de Google Search Console peut afficher « Indexée, mais bloquée par robots.txt ». Ce statut n’est pas automatiquement une erreur.

Google peut connaître une URL sans pouvoir l’explorer, par exemple quand elle est découverte par un lien puis bloquée par une règle. Shopify précise que ce comportement est généralement normal pour les pages volontairement bloquées, comme le panier ou la recherche interne (aide Shopify : pages indexées mais bloquées).

Si le message concerne une page normale, comme l’accueil, les données de Google sont probablement juste en retard : Shopify indique que Google peut mettre des jours, des semaines, voire des mois à actualiser sa base après une modification. Vérifie d’abord le fichier réellement accessible sur ton domaine. Si l’accueil ou une fiche produit importante est vraiment bloquée, cherche une personnalisation de robots.txt.liquid ou une règle venue d’une solution tierce. Sinon, ne supprime pas une règle par défaut uniquement parce qu’elle apparaît dans un rapport.

Robots d’exploration IA et couche réseau

Shopify distingue deux couches de contrôle pour les robots d’exploration IA.

La couche réseau, d’abord. Shopify la gère directement pour les boutiques hébergées chez lui : tu n’as aucune mesure à prendre. L’entreprise ne recommande d’ailleurs pas de configurer un proxy en amont (aide Shopify : contrôle des robots).

La couche /robots.txt, ensuite. Tu peux y autoriser ou bloquer certains robots en personnalisant robots.txt.liquid. Ces règles restent directionnelles et consultatives : rien ne garantit que tous les robots les respectent.

Point important : Shopify Catalog fonctionne indépendamment du fichier /robots.txt. Si tu actives des boutiques en ligne agentiques, tes données produits peuvent être transmises par Shopify Catalog, sans dépendre de l’accès d’un robot sur le Web ouvert. Bloquer un robot IA dans robots.txt ne bloque donc pas l’envoi de tes données vers ces canaux. Les deux sujets se traitent séparément.

Les erreurs à éviter

Utiliser robots.txt pour masquer une page dans Google est l’erreur la plus courante. Une page bloquée peut encore être indexée si Google la découvre par d’autres moyens. Pour empêcher son affichage, utilise noindex, une protection par mot de passe ou supprime la page.

Croire que tous les robots appliqueront tes règles est la deuxième. Le fichier est consultatif et certains robots peuvent ignorer les directives.

La troisième, c’est de bloquer une URL sans savoir pourquoi. Une règle trop large peut empêcher l’exploration d’une catégorie, d’une fiche produit ou d’une ressource utile au rendu.

La quatrième, c’est de confondre exploration et classement. Modifier robots.txt ne fait pas monter une page dans Google. Le fichier gère l’accès des robots, pas la position d’une page.

Enfin, ne traite pas systématiquement « Indexée, mais bloquée » comme une anomalie. Vérifie l’URL concernée, sa fonction et la règle qui la bloque. Pour élargir le diagnostic, je t’invite à lire ces erreurs SEO Shopify.

Tester et supprimer tes personnalisations

Après une modification, vérifie le contenu du fichier à la racine de ton domaine. Les changements sont instantanés, mais les robots ne réagissent pas toujours immédiatement. Pour tester une règle, Shopify renvoie vers l’outil Google robots.txt Tester, qui indique si une URL est autorisée ou bloquée.

Si tu veux revenir au fichier par défaut, supprime le modèle robots.txt.liquid dans l’éditeur de code (Boutique en ligne, Thèmes, Modifier le code, suppression définitive). Shopify réutilisera alors son fichier par défaut, et tu pourras toujours recréer une personnalisation plus tard.

Avant d’ajouter ou de supprimer une règle, conserve une copie de ta version actuelle et note l’objectif de chaque directive. Ça facilite le retour en arrière. Si tu débutes avec Shopify, commence par ce guide pour créer une boutique Shopify. Pour une boutique existante qui cumule les problèmes techniques, un audit de boutique Shopify examine l’ensemble du diagnostic, pas un seul fichier.

FAQ

Comment modifier le fichier robots.txt sur Shopify ?

Ajoute un modèle robots.txt.liquid dans le dossier templates de ton thème, depuis Boutique en ligne, Thèmes, puis Modifier le code. Shopify recommande cette méthode plutôt qu’un remplacement permanent par du texte brut.

Pourquoi ma page est « Indexée, mais bloquée par robots.txt » dans Google Search Console ?

Google a pu découvrir l’URL sans pouvoir l’explorer. C’est généralement normal pour les pages volontairement bloquées. Pour une page importante, vérifie la règle active et l’actualisation des données Google.

Le fichier robots.txt peut-il empêcher l’indexation d’une page ?

Non, pas de manière fiable. Une URL bloquée peut encore être indexée si elle est découverte ailleurs. Pour empêcher son affichage dans Google, utilise noindex, une protection par mot de passe ou supprime la page.

Quelles sont les règles par défaut du robots.txt Shopify ?

Les règles principales bloquent /admin, /cart, /checkout, /collections/*+*, /search et /policies/. Shopify les utilise pour limiter l’exploration des zones administratives, variables, dupliquées ou sans intérêt SEO prioritaire.

Comment bloquer les robots d’exploration IA sur ma boutique Shopify ?

Tu peux ajouter des règles ciblant certains user agents dans robots.txt.liquid. Ces règles sont consultatives et ne seront pas forcément respectées par tous les robots. Elles ne contrôlent pas les données transmises par Shopify Catalog.

Où se trouve le fichier robots.txt de ma boutique Shopify ?

À la racine du domaine principal. Si ton domaine est exemple.com, l’adresse est exemple.com/robots.txt.


Le fichier robots.txt n’est qu’une pièce du référencement technique. Si tu veux un diagnostic complet de ta boutique, Ecom.AI réalise des audits Shopify : Ecom Future Lab