Réponse rapide : llms.txt et ai.txt sont des fichiers différents. llms.txt est une carte en Markdown qui indique aux assistants IA ce qu'est votre site et quelles pages sont importantes, pour citation et compréhension. ai.txt est une norme proposée pour contrôler si les modèles IA peuvent s'entraîner sur votre contenu — plus proche de l'esprit de robots.txt. Pour que votre boutique Shopify soit citée par ChatGPT, Claude et Perplexity, llms.txt est celui qui compte.

ai.txt vs llms.txt est un véritable point de confusion, car les deux fichiers semblent interchangeables et se trouvent tous deux à la racine d'un domaine parlant aux systèmes IA. Ils ont des fonctions opposées. L'un est un fichier de permissions qui indique aux systèmes IA ce qu'ils peuvent faire avec votre contenu ; l'autre est un index de contenu qui leur dit ce qu'est votre contenu. Si vous gérez une boutique en ligne, vous avez presque certainement besoin de l'un d'eux, et vous n'avez peut-être pas besoin de l'autre du tout.

Qu'est-ce que ai.txt

ai.txt est une convention proposée — popularisée par Spawning et adoptée de manière fragmentaire — pour déclarer si les systèmes IA peuvent utiliser le contenu de votre site pour l'entraînement de modèles. Il se lit comme un robots.txt pour l'apprentissage machine : des directives d'autorisation ou d'interdiction, parfois par type de média (texte, images, audio), destinées aux crawlers qui collectent des données d'entraînement. Son esprit est l'opt-out : il existe principalement pour les éditeurs et créateurs qui ne veulent pas que leur travail soit absorbé dans des modèles.

Deux mises en garde pratiques définissent son poids réel. Premièrement, l'adoption est incohérente — ai.txt n'est pas une norme appliquée, et il n'y a aucune garantie qu'un crawler donné le lise. Deuxièmement, les entreprises IA qui offrent des opt-outs les implémentent principalement via des agents utilisateurs robots.txt (GPTBot, ClaudeBot, Google-Extended, CCBot), ce qui signifie que robots.txt reste le mécanisme de permissions réellement efficace. Si votre objectif est de restreindre l'utilisation IA de votre contenu, le guide Shopify robots.txt couvre les directives réellement respectées.

Qu'est-ce que llms.txt

llms.txt vient d'une direction totalement différente. Défini par la proposition llmstxt.org, c'est un index en Markdown de vos pages les plus importantes — le résumé de votre boutique, des faits citables, et des liens groupés avec des descriptions en une ligne — écrit pour qu'un modèle de langage puisse comprendre rapidement votre site et citer les bonnes URL. Il ne s'agit pas de permission ; il suppose que vous voulez que les moteurs IA vous lisent et leur offre une visite guidée.

Pour une boutique en ligne, cette différence est cruciale. Lorsqu'un acheteur demande à ChatGPT ou Perplexity une recommandation de produit, les moteurs qui connaissent votre catalogue, vos conditions d'expédition et vos meilleurs guides peuvent vous nommer et vous citer. llms.txt est le signal le moins coûteux qui leur fournit exactement cela, c'est pourquoi il figure en bonne place dans chaque liste de contrôle d'optimisation pour les moteurs de réponse.

La comparaison, côte à côte

Aspect ai.txt llms.txt
Fonction ai.txt définit les permissions pour l'entraînement IA. llms.txt organise le contenu pour la consommation et la citation IA.
Direction ai.txt est défensif (exclure l'IA, ou définir des conditions). llms.txt est offensif (aider l'IA à entrer, selon vos conditions).
Format ai.txt utilise des directives d'autorisation/interdiction de style robots. llms.txt utilise du Markdown lisible par l'homme avec des liens et des descriptions.
Application ai.txt est un signal de courtoisie avec une adoption inégale ; les règles d'agent utilisateur robots.txt sont la version exécutoire de son intention. llms.txt n'a pas besoin d'application — il fonctionne en étant utile à tout modèle qui le lit.
Qui en a besoin ai.txt convient aux éditeurs protégeant le travail original. llms.txt convient à toute entreprise qui bénéficie d'être trouvée et recommandée par l'IA — ce qui est essentiellement chaque boutique.
  • Fonction : ai.txt définit les permissions pour l'entraînement IA. llms.txt organise le contenu pour la consommation et la citation IA.
  • Direction : ai.txt est défensif (exclure l'IA, ou définir des conditions). llms.txt est offensif (aider l'IA à entrer, selon vos conditions).
  • Format : ai.txt utilise des directives d'autorisation/interdiction de style robots. llms.txt utilise du Markdown lisible par l'homme avec des liens et des descriptions.
  • Application : ai.txt est un signal de courtoisie avec une adoption inégale ; les règles d'agent utilisateur robots.txt sont la version exécutoire de son intention. llms.txt n'a pas besoin d'application — il fonctionne en étant utile à tout modèle qui le lit.
  • Qui en a besoin : ai.txt convient aux éditeurs protégeant le travail original. llms.txt convient à toute entreprise qui bénéficie d'être trouvée et recommandée par l'IA — ce qui est essentiellement chaque boutique.

Les deux ne sont pas rivaux et peuvent coexister : un site d'actualités pourrait utiliser les deux (permissions resserrées, explications clés indexées), et une boutique pourrait utiliser uniquement llms.txt avec des règles robots permissives.

Ce qu'une boutique en ligne devrait réellement faire

Pour une boutique, l'arbre de décision est court. Vous voulez que les moteurs IA connaissent vos produits, répètent correctement vos faits d'expédition et de retour, et citent vos pages dans les réponses d'achat — donc expédiez un llms.txt, gardez les crawlers IA autorisés dans robots.txt, et évitez complètement les fichiers orientés blocage. Bloquer GPTBot pour "protéger" les descriptions de produits protège surtout la visibilité de vos concurrents : le moteur répond toujours à la question de l'acheteur, mais avec la boutique de quelqu'un d'autre. Ce compromis, et le détail crawler par crawler, est couvert dans les meilleures pratiques AEO pour Shopify.

Sur Shopify spécifiquement, aucun fichier ne peut être déposé à la racine via l'admin — Shopify possède la racine de la vitrine. llms.txt est servi via un proxy d'application ou un edge worker (le générateur llms.txt s'occupe de créer un fichier valide), et les permissions d'entraînement appartiennent à robots.txt.liquid, que Shopify vous permet de modifier. Une fois servi, vérifiez que le fichier renvoie bien 200 en ouvrant votre-boutique.com/llms.txt — puis vérifiez si les moteurs vous captent avec une sonde de visibilité IA.

RankEngine génère et sert llms.txt pour les boutiques Shopify, le garde synchronisé avec le catalogue en direct, et expédie les règles robots pour crawlers IA avec — la moitié offensive de cette comparaison, automatisée et vérifiée.