Être lisible par ChatGPT, Perplexity et les moteurs de réponse : ce qui se vérifie, ce qui ne se garantit pas

Par Jean-Michel, fondateur de Structure Web · mis à jour le

En résumé

Un assistant comme ChatGPT, Perplexity ou Copilot ne peut recommander une entreprise que s'il a pu lire son site et comprendre, sans ambiguïté, qui elle est, ce qu'elle vend et à quel prix. Quatre réglages le permettent et se vérifient en quelques minutes : laisser entrer les robots des IA, déclarer son identité et ses offres en données structurées, publier un plan du site à jour et prévenir les moteurs à chaque changement. Aucun de ces réglages ne garantit d'être cité : ils garantissent seulement de ne pas être écarté faute d'avoir été lu.

Premier contrôle : les robots des IA peuvent-ils entrer ?

Les assistants envoient leurs propres robots : GPTBot et OAI-SearchBot pour OpenAI, ClaudeBot pour Anthropic, PerplexityBot pour Perplexity, entre autres. Le fichier robots.txt de votre site peut les autoriser nommément ; c'est une bonne pratique, parce qu'une autorisation nominative survit au jour où quelqu'un durcira la règle générale.

Mais le fichier ne fait pas tout. Certains hébergeurs et pare-feu bloquent ces robots par défaut, avant même qu'ils lisent robots.txt : le site écrit « entrez » sur la porte en la tenant fermée. Nous l'avons constaté sur notre propre site produit — un réglage activé d'office sur une nouvelle zone du pare-feu. La seule vérification fiable consiste à demander une page en se présentant comme ces robots et à regarder ce qui revient : une vraie page, ou un refus.

Deuxième contrôle : votre site dit-il clairement qui vous êtes ?

Un assistant ne lit pas une page comme un humain. Il cherche d'abord ce qui est déclaré : les données structurées au format schema.org, insérées dans le code de la page. Pour une entreprise locale, cela veut dire au minimum l'organisation (nom, logo, adresse, téléphone), le type d'activité, les services proposés et la foire aux questions. Pour un logiciel, le type « application » et ses offres, avec leur prix.

Ces déclarations doivent être vraies et identiques partout : même nom, même adresse, même téléphone que sur votre fiche Google et vos annuaires. Le lien « sameAs » relie votre site à vos profils publics (fiche Google, réseaux, annuaires professionnels) : c'est ainsi qu'un moteur comprend que toutes ces pages parlent de la même entreprise. Google publie un outil de test des résultats enrichis qui montre ce qu'il a compris de chaque page ; la Search Console signale ensuite les champs manquants.

Troisième contrôle : les moteurs savent-ils que vous avez changé ?

Un plan du site (sitemap.xml) annoncé dans robots.txt dit aux moteurs quelles pages existent. Chaque adresse qu'il contient doit répondre normalement : un plan qui annonce des pages mortes est pire qu'un plan absent.

Autoriser les moteurs à venir ne dit pas quand ils viendront. Le protocole IndexNow permet de prévenir Bing, Yandex et d'autres dès qu'une page est publiée ou modifiée. C'est utile au-delà de Bing lui-même : son index est l'une des sources sur lesquelles s'appuient plusieurs assistants pour leurs recherches en ligne. Côté Google, la Search Console permet de demander l'indexation d'une page précise.

Le fichier llms.txt, enfin, est une proposition récente : un résumé en texte simple, à la racine du site, de ce que fait l'entreprise et de ses pages importantes. Il ne remplace rien de ce qui précède et aucun moteur ne s'engage à le lire ; il coûte peu et il aide les outils qui le consultent.

Écrire pour être repris : la réponse avant le reste

Les assistants reprennent volontiers les passages qui répondent seuls à une question : un résumé de deux ou trois phrases en tête de page, une liste de points à retenir, des questions fréquentes avec des réponses courtes. Une page qui fait attendre la réponse derrière trois paragraphes d'introduction a moins de chances d'être citée qu'une page qui la donne d'emblée.

Les chiffres comptent, à condition d'être vérifiables : un prix « à partir de », un délai, une date de mise à jour. Un chiffre inventé se repère, et il coûte plus en crédibilité qu'il ne rapporte en visibilité. Enfin, ce qui se dit de vous ailleurs — avis clients authentiques, annuaires professionnels, articles qui vous citent — pèse autant que ce que vous dites de vous-même.

Ce qui ne se garantit pas, et ce que nous faisons

Aucun prestataire ne contrôle les réponses d'un assistant. Elles dépendent de la question posée, de l'outil, du moment et de ce que le modèle a lu ailleurs. Promettre « vous serez recommandé par ChatGPT » revient à promettre un résultat que personne ne maîtrise. Ce qui se promet honnêtement, c'est un site lisible, vérifié, et une présence cohérente partout où l'on vous cherche.

Sur chaque site que nous livrons, comme sur les nôtres, nous vérifions ces quatre points par des contrôles automatiques : robots des IA réellement admis, données structurées présentes et complètes, plan du site sans page morte, moteurs prévenus à chaque publication. Le back-office Structure Hub fournit au site la matière que ces données réclament — horaires, logo, coordonnées, comptes publics — pour qu'elle reste juste sans intervention technique.

Envie d'aller plus loin ?

Structure Web crée votre site sur-mesure, rapide et bien référencé, puis vous le pilotez en autonomie avec Structure Hub.

Le back-office dont parle ce guide, nous l'éditons

Structure Hub est notre logiciel de back-office e-commerce : commandes, factures électroniques, expéditions, encaissement et remboursements au même endroit. Il se branche sur le site que vous avez déjà, quel qu'en soit l'auteur — vous n'avez pas besoin de nous confier votre site pour l'utiliser. Version gratuite sans limite de durée, ou 59 € HT/mois pour la version complète — un mois d'essai sans carte bancaire.

Questions fréquentes

Vos questions sur : être lisible par les ia (chatgpt, perplexity…).

Faut-il autoriser les robots des IA sur son site ?

Si vous voulez qu'un assistant puisse parler de vous, oui : un robot refusé ne lit rien, et un assistant ne recommande pas ce qu'il n'a pas pu lire. Vérifiez aussi que votre hébergeur ou votre pare-feu ne les bloque pas par défaut.

Le fichier llms.txt est-il obligatoire ?

Non. C'est une proposition récente qu'aucun moteur ne s'engage à lire. Il est utile en complément, jamais à la place des données structurées et du plan du site.

Peut-on garantir d'être cité par ChatGPT ou Perplexity ?

Non. Personne ne contrôle les réponses d'un assistant. On peut en revanche garantir que le site est lisible, que ses informations sont exactes et cohérentes partout, et que les moteurs sont prévenus de chaque changement.

Comment savoir ce que Google a compris de ma page ?

L'outil de test des résultats enrichis de Google affiche les données structurées lues sur une page, et la Search Console signale les champs manquants ou erronés pour tout le site.

Une question que ce guide ne règle pas ?

Trente minutes en visio, ou un quart d'heure au téléphone, pour en parler dans votre cas précis. Vous choisissez le créneau, vous recevez la confirmation aussitôt.

Sans engagement · aucun compte à créer · annulable en un clic