Votre site est-il lisible par ChatGPT, Claude, Perplexity et Gemini ?
Vingt-et-une vérifications à faire vous-même, avec votre navigateur
et les outils de Google. Je ne mesure rien : chaque point porte sa source
officielle, et vous constatez par vous-même.
Pourquoi je ne mesure pas à votre place. Parce que vous n'auriez aucune
raison de me croire. Les vingt-et-un points ci-dessous se vérifient dans votre navigateur ou dans
vos propres comptes Google. Vous n'avez besoin de personne — et surtout pas
de moi — pour constater ce qui manque.
Comment lire cette page
Quatre catégories, dans cet ordre. Si un mur est fermé, les trois autres
catégories ne servent à rien : commencez par les murs.
Catégorie
Ce qui se passe
Nombre
● LES MURS
L'IA ne peut pas lire votre site
7
● LES FREINS
Elle peut lire, mais elle abandonne ou coupe
2
● LES SIGNAUX
Elle lit, mais comprend mal qui vous êtes
6
● LES AGENTS
Elle vous comprend, mais ne peut pas agir — remplir votre devis
6
Les 7 murs
À vérifier en premier. Un seul suffit à rendre tout le reste inutile.
MUR 1
Votre fichier robots.txt interdit-il les robots d'IA ?
À faire : tapez votresite.fr/robots.txt dans votre
navigateur. Cherchez une ligne Disallow: / placée sous un nom de robot comme
GPTBot, ClaudeBot ou PerplexityBot.
Si vous la trouvez, votre site demande à ce robot de ne pas entrer. Beaucoup
d'extensions de site l'ajoutent par défaut, sans que le propriétaire le sache.
Nuance honnête : le robots.txt est une
demande, pas une barrière technique. La plupart des robots l'honorent, mais
les robots déclenchés par un utilisateur — ChatGPT-User,
Perplexity-User — sont documentés par leurs opérateurs comme pouvant l'ignorer.
Votre hébergeur ou CDN bloque-t-il les robots d'IA ?
À faire : si vous êtes sur Cloudflare, ouvrez votre panneau →
section « AI Crawl Control ». Sinon, demandez à votre hébergeur :
« bloquons-nous GPTBot, ClaudeBot ou PerplexityBot ? »
Ce blocage n'apparaît nulle part dans votre site. Votre
robots.txt peut être parfait et les robots être arrêtés avant même de le lire.
Le cas qui prouve que personne ne regarde : le 4 octobre 2026, j'ai
audité neuf outils spécialisés dans la visibilité IA. Trois d'entre eux ont un
robots.txt exemplaire — l'un écrit même en commentaire
« AI-friendly crawling policy » et liste les robots en
« Tier 1: Critical AI Search Crawlers ». Les trois sont quand même signalés
bloqués par leur CDN.
Des spécialistes du sujet ne le voient pas sur leur propre site. C'est le contrôle que
personne ne fait.
Sources :blog.cloudflare.com, 15 et 30 septembre 2026 ·
documentation Cloudflare « AI Crawl Control » · mesure du 4 octobre 2026 avec
geo-optimizer (licence MIT)
MUR 3
Votre serveur bloque-t-il par adresse IP ?
À faire : seul votre hébergeur peut répondre. Demandez-lui si un
pare-feu applicatif filtre les robots par adresse IP ou par empreinte de connexion.
C'est le seul blocage vraiment technique — celui qu'un robot ne peut pas
contourner, même s'il voulait. Et il est invisible partout ailleurs.
Source : documentations des opérateurs de robots d'IA, qui
recommandent ce niveau pour un blocage garanti
MUR 4
Votre contenu s'affiche-t-il sans JavaScript ?
À faire : clic droit sur votre page d'accueil →
« Afficher le code source de la page ». Cherchez (Ctrl+F) une phrase visible de votre
page. Si vous ne la trouvez pas dans ce code, les robots d'IA ne la voient pas non plus.
Attention au piège : utilisez bien « Afficher le code
source », et PAS l'inspecteur « Éléments ». L'inspecteur montre la page
après exécution du JavaScript — il vous donnera une fausse réassurance.
Le robot
Exécute le JavaScript ?
GPTBot · OAI-SearchBot (ChatGPT)
Non
ClaudeBot · Claude-SearchBot
Non
PerplexityBot
Non
Googlebot
Oui
Le robot de Gemini
Oui — il hérite du rendu de Googlebot
Sources : Google — « Google est capable de traiter le contenu
dans le JavaScript », guide officiel d'optimisation pour les fonctionnalités IA, mis à
jour le 10 juillet 2026 · étude Vercel/MERJ sur les robots d'IA
MUR 5
Une balise « nosnippet » vous exclut-elle des réponses IA de Google ?
À faire : dans le code source, cherchez nosnippet ou
max-snippet.
Si l'une des deux est présente, vous êtes exclu des Aperçus IA et du Mode IA de
Google : une page doit être éligible à un extrait classique pour apparaître dans
les fonctionnalités IA.
Et c'est une double perte : cette balise retire aussi la
description de votre fiche dans les résultats Google normaux. Il ne reste que le titre et
l'adresse.
Source : Google — developers.google.com/search/docs/appearance/ai-features
MUR 6
Une partie de votre page est-elle exclue par « data-nosnippet » ?
À faire : dans le code source, cherchez
data-nosnippet.
Cette variante n'exclut pas la page entière, seulement les blocs qui la portent.
Si elle se trouve sur vos tarifs, vos services ou vos coordonnées, ce sont précisément les
informations que l'IA ne reprendra jamais.
Source : Google — même page officielle sur les fonctionnalités IA
MUR 7
Votre site est-il inclus dans les fonctionnalités IA de Google ?
À faire : ouvrez votre Search Console → le réglage
d'inclusion dans les fonctionnalités génératives.
Google l'écrit noir sur blanc : en plus des exigences techniques, un site doit
être inclus dans les fonctionnalités génératives pour être éligible à l'affichage.
Si ce réglage est désactivé, rien d'autre ne servira.
Source : Google — guide officiel d'optimisation ·
support.google.com/webmasters/answer/16908024
Les 2 freins
L'IA peut lire, mais elle coupe ou elle abandonne.
FREIN 1
Votre page d'accueil pèse-t-elle plus de 200 Ko de code ?
À faire : clic droit → code source → sélectionnez tout
(Ctrl+A), copiez, et collez dans un éditeur de texte qui affiche le nombre de caractères.
Au-delà de ~200 000, c'est trop.
Un code trop lourd ralentit l'analyse par le robot et peut être tronqué :
la réponse à la question de votre acheteur existe peut-être sur la page, mais elle est enterrée
trop profond pour entrer dans la fenêtre de lecture du modèle.
Sources :geo-optimizer (licence MIT, 971 ★) — seuil
annoncé : moins de 200 Ko · travaux universitaires sur les échecs de citation
(arXiv 2603.09296) — mode de panne « troncature de fenêtre »
FREIN 2
Votre serveur répond-il en moins d'une demi-seconde ?
À faire : testez votre adresse sur
PageSpeed Insights de Google et regardez le temps de réponse du serveur.
Objectif : moins de 500 ms, idéalement moins de 200 ms. Un robot qui
attend peut abandonner avant d'avoir lu.
L'IA lit votre site, mais elle ne sait pas de façon fiable qui vous êtes.
SIGNAL 1
Vos données structurées sont-elles présentes et valides ?
À faire : collez votre adresse dans le
test de résultats enrichis de Google — search.google.com/test/rich-results
Sans elles, l'IA doit deviner votre raison sociale, votre adresse, votre activité et votre
dirigeant à partir du texte. Et quand elle devine, elle se trompe parfois — en
affirmant.
Honnêteté : Google précise que les données structurées
« ne sont pas requises » pour les fonctionnalités IA. Ce n'est donc pas un mur :
c'est un signal de désambiguïsation. Mais c'est le plus utile des six.
Sources :search.google.com/test/rich-results (Google) ·
guide officiel Google sur les fonctionnalités IA · schema.org
SIGNAL 2
Votre site déclare-t-il qu'il est en français ?
À faire : code source → cherchez <html lang=.
Vous devez y lire lang="fr".
C'est une ligne de code. Sans elle, rien n'indique explicitement la langue
de votre contenu.
Source : spécification HTML du W3C · recommandation
d'accessibilité WCAG
SIGNAL 3
Votre page d'accueil a-t-elle un titre principal ?
À faire : code source → cherchez <h1.
Il doit y en avoir un, et un seul.
C'est la seule phrase qui dit explicitement de quoi parle la page. Les travaux universitaires
sur la citation montrent que placer la réponse dans les 150 premiers caractères après
chaque titre augmente nettement les chances d'être repris.
Sources : travaux sur la structure et la citation
(arXiv 2603.29979) · AutoGEO, conférence ICLR 2026 — réponse en premier : +25 %
SIGNAL 4
Vos images ont-elles une description ?
À faire : code source → comptez les <img, puis
comptez ceux qui ont un alt="..." rempli.
Les IA capables de lire des images — Gemini, GPT-4o — ne voient pas vos visuels :
elles lisent leur description textuelle. Sans elle, vos photos de réalisations
n'existent pas.
Source : Google — « nos fonctionnalités de recherche
générative peuvent faire remonter des images et des vidéos pertinentes », guide officiel
SIGNAL 5
Vos vidéos ont-elles une transcription ?
À faire : regardez si vos vidéos proposent des sous-titres ou un
texte de transcription sur la page.
Les moteurs d'IA indexent la transcription, pas les images. Une vidéo sans
texte ne contribue en rien à votre visibilité.
Sources : Google — guide officiel sur les fonctionnalités IA ·
spécification VideoObject de schema.org
SIGNAL 6
Avez-vous un robots.txt, et contient-il la ligne Sitemap ?
À faire : tapez votresite.fr/robots.txt. Si une page
d'erreur s'affiche, le fichier n'existe pas.
Et je préfère vous le dire : ne pas avoir de robots.txt N'EST PAS bloquant.
Google l'écrit lui-même : « un code 404 pour un robots.txt signifie que l'exploration
est autorisée… ne pas en avoir est parfaitement acceptable. »
Ce que vous perdez est plus modeste : la ligne Sitemap: qui aide les robots
à trouver toutes vos pages, et la possibilité de refuser l'entraînement des modèles
tout en autorisant la citation — deux robots différents, deux réglages distincts.
Source : Google — support.google.com/webmasters/answer/6062598
(rapport robots.txt de la Search Console) et spécification officielle
Les 6 contrôles « agents »
Les quinze points précédents servent à ce que l'IA parle de vous.
Ces six-là servent à ce qu'elle puisse agir sur votre site : remplir
votre formulaire, demander un devis, prendre un rendez-vous.
La différence, en une scène. Un acheteur cherche des cloisons de bureau.
Aujourd'hui : il tape sur Google, il clique, il remplit votre
formulaire.
Avec l'IA qui parle : il demande à ChatGPT quelle entreprise choisir.
ChatGPT donne votre nom. Il va ensuite sur votre site et remplit le formulaire.
Avec un agent : il dit « demande-moi un devis à trois entreprises
d'Île-de-France ». L'IA va elle-même sur les trois sites et remplit elle-même les
trois formulaires. L'humain ne touche à rien.
Et voilà le risque : si vos boutons et vos champs ne sont pas lisibles
par un robot, il n'arrive pas à remplir votre formulaire. Vous perdez la demande — pas
parce que vous n'étiez pas cité, mais parce que le robot n'a pas réussi à cliquer.
Et je préfère vous le dire avant : c'est un pari, pas un marché.
Les agents qui remplissent des formulaires à la place des gens n'existent pas
encore à grande échelle.
La technologie dédiée (WebMCP) est encore expérimentale — Google la
décrit comme disponible « pour expérimentation », sous essai d'origine dans Chrome.
Je n'ai trouvé aucun chiffre fiable sur le nombre de demandes commerciales
qui passent aujourd'hui par un agent.
Pourquoi ça vaut quand même le coup : Google écrit lui-même que
« tout ce qui rend un site prêt pour les agents le rend aussi meilleur pour les humains —
bien structuré, accessible et sémantique ». Le même travail rend votre site
utilisable par une personne aveugle. Vous ne pouvez pas perdre : si les agents ne
décollent jamais, vous avez gagné un site accessible.
AGENT 1 · le plus important
Vos boutons sont-ils de vrais boutons ?
À faire : code source → cherchez votre bouton « Demander un devis ».
Est-ce <button> ou <a href> — ou bien un
<div> ou un <span> maquillé en bouton ?
Google l'écrit : « concevez les éléments actionnables avec du HTML sémantique.
Utilisez <button> et <a> plutôt que des
<div> et <span> modifiés. Les agents
reconnaissent les premiers comme interactifs. »
Si vous ne pouvez pas changer : Google donne la solution de
repli — ajoutez le rôle et l'ordre de tabulation, par exemple
<div role="button" tabindex="0">.
Source : Google — web.dev/articles/ai-agent-site-ux,
mis à jour le 1er avril 2026
AGENT 2
Les champs de votre formulaire de devis sont-ils étiquetés ?
À faire : code source de votre page de contact → cherchez
<label for=. Chaque champ (nom, e-mail, message, surface en m²) devrait avoir
une étiquette qui lui est liée.
Google : « ajoutez l'attribut for sur les balises
<label> pour les lier aux champs. Cela aide l'agent à comprendre le
but d'un champ. »
Sans ça, un agent voit trois cases vides et ne sait pas laquelle est le téléphone, laquelle
est la surface. Il remplit mal, ou il abandonne.
Source : Google — même guide · et spécification HTML du W3C
AGENT 3
Vos boutons sont-ils assez grands ?
À faire : regardez vos icônes cliquables — le petit téléphone, la
petite flèche, la croix de fermeture. Font-elles au moins 3 × 3 pixels
visibles ?
Google fixe un seuil chiffré : « assurez-vous que tout élément interactif nécessaire
pour accomplir une action est visible et plus grand que 8 pixels carrés, pour éviter
d'être filtré dans l'analyse visuelle du modèle ».
Source : Google — même guide
AGENT 4
Un calque invisible recouvre-t-il vos boutons ?
À faire : c'est le plus technique. Demandez à votre webmestre :
« avons-nous des calques transparents (overlays) au-dessus des zones cliquables ? »
C'est fréquent avec les bandeaux de cookies, les fenêtres surgissantes et les animations.
Google appelle ça les « éléments fantômes » : « évitez les calques
transparents qui masquent des éléments interactifs. L'analyse visuelle de l'agent peut
écarter les nœuds couverts, même si le calque paraît transparent. »
Source : Google — même guide
AGENT 5
Votre bouton de contact est-il toujours au même endroit ?
À faire : ouvrez cinq pages différentes de votre site. Le
bouton « Devis » ou « Contact » est-il à la même place sur les cinq ?
Google : « les agents qui prennent des captures d'écran seront probablement
perturbés si la mise en page de votre site change constamment — par exemple quand un bouton
"Ajouter au panier" est à un endroit différent pour chaque catégorie de produit ».
Source : Google — même guide
AGENT 6 · expérimental
Déclarez-vous vos actions aux agents (WebMCP) ?
À faire : code source → cherchez toolname ou
registerTool. Dans l'immense majorité des cas, vous ne trouverez rien
— et ce n'est pas grave aujourd'hui.
WebMCP permet de déclarer explicitement à un agent : « voici mon outil de demande de
devis, voici ce qu'il attend ». Google le décrit comme « une norme web PROPOSÉE »,
dont « les interfaces sont disponibles pour expérimentation en production dans Chrome, sous
essai d'origine ».
Donc : c'est le seul point de cette page qui n'est pas encore
actionnable sérieusement. Je le liste pour que vous sachiez qu'il existe, pas pour vous le
vendre.
Sources : Google — web.dev/articles/ai-agent-site-ux ·
developer.chrome.com/docs/ai/webmcp
Comment un agent voit votre site — les quatre canaux, selon Google :
Des captures d'écran, analysées par un modèle de vision — « lent et
coûteux, meilleur comme solution de repli ».
Le HTML brut — « si un bouton Acheter est dans un conteneur produit,
l'agent suppose que ce bouton appartient à CE produit ».
L'arbre d'accessibilité — « une carte haute-fidélité qui ignore le
bruit visuel du CSS ». C'est exactement celui qu'utilisent les lecteurs d'écran
pour les personnes aveugles.
Les outils WebMCP, quand ils existent.
Les 9 outils gratuits — audités le 4 octobre 2026
Tous sont gratuits et sans inscription. Je n'en ai construit aucun et
je n'ai aucun lien avec eux. Je les ai simplement audités pour voir lesquels
s'appliquent à eux-mêmes ce qu'ils vendent.
L'outil
Ce qu'il propose
Son propre score
Accès des robots IA à son site
geoready.dev
audit + outil en ligne de commande, licence libre
91 — excellent
partiel
seomator.com
jusqu'à 50 pages, 5 moteurs
82
partiel
sitetest.ai
note A–F sur 92 contrôles
78
signalé bloqué
arisegeo.com
part de citation sous 24 h
72
signalé bloqué
aeocheck.co
25 contrôles + réponse IA
72
partiel
clayhog.com
8 dimensions, moins de 30 secondes
70
partiel
thefirstranker.com
vérificateur d'entité, générateur llms.txt
65
signalé bloqué
joshuaopolko.com/aiscan
14 robots IA + rendu serveur
63
partiel
ai1stseo.com
annonce un audit à 236 points
45
partiel
Ce que ce tableau dit, et ce qu'il ne dit pas.
Il ne dit pas que ces outils sont mauvais. Je ne les ai pas comparés sur
la qualité de leurs résultats — je n'ai mesuré que la configuration de leurs propres sites.
Les trois « signalés bloqués » ont tous un robots.txt exemplaire —
j'ai vérifié chaque fichier à la main. Le blocage détecté vient de leur CDN, pas de leur
fichier. C'est précisément pour ça que le mur 2 existe : même des spécialistes ne
le voient pas.
Conflit d'intérêt que je dois signaler : l'outil de mesure que j'ai
utilisé — geo-optimizer — est publié par l'équipe de geoready.dev, qui arrive
premier de ce classement. Ce n'est pas neutre, et vous devez le savoir.
Son barème est discutable : il attribue 24 points sur 100 à des
fichiers (llms.txt, ai.txt) dont Google déclare explicitement ne pas
se servir. J'ai gardé les chiffres bruts sans les corriger, pour que vous puissiez les
reproduire à l'identique.
Mesure d'un seul jour, le 4 octobre 2026. Les systèmes évoluent.
Reproduisez ce tableau vous-même, gratuitement :
pip install geo-optimizer-skill geo access --url https://votresite.fr ← les murs geo audit --url https://votresite.fr ← les signaux
Lancez geo accessen premier : s'il y a un mur, le reste
ne sert à rien. Et il détecte le blocage par CDN, que l'autre commande ne voit pas.
Ce que cette page ne prouve pas
Que ces vingt-et-un points vous feront citer par une IA. Ils établissent que
l'IA peut vous lire et vous comprendre. Pas qu'elle va vous recommander.
Qu'une citation rapporte de l'argent. À ce jour, aucune étude ne relie une
citation par une IA à un euro gagné. Les travaux universitaires qualifient eux-mêmes les
affirmations de rentabilité de « prématurées ».
Qu'un bon score prédit la citation. Un travail publié le 7 septembre 2026
mesure la corrélation entre une note de page et la citation réelle à 0,11 —
c'est-à-dire presque rien. Méfiez-vous de quiconque vous vend un score comme une promesse.
Que votre position sera stable. Selon les mesures disponibles, 45 à 88 %
des sources citées par une IA changent d'un jour à l'autre.
Que des agents viendront remplir votre formulaire. Les six contrôles
« agents » sont un pari, et je le dis dans la section : la technologie dédiée est
encore expérimentale et aucun chiffre fiable n'existe sur le volume d'affaires qui passe
aujourd'hui par un agent. Ce qui est certain, c'est que le même travail rend votre site
accessible aux personnes handicapées — ça, c'est acquis quoi qu'il arrive.
Si quelqu'un vous promet ces cinq choses, il ne les a pas mesurées.
Et après ?
Si les murs sont ouverts et que des signaux manquent, la correction est presque toujours de
la configuration, pas de la rédaction : déclarer la langue, ajouter un
titre principal, décrire les images, publier les données structurées. Sur un cas réel mesuré en
octobre 2026, l'ensemble représentait une demi-journée de travail et faisait
passer le site du dernier rang de son secteur au-dessus de sa moyenne — sans écrire une
ligne de contenu.
Vous pouvez tout faire vous-même avec cette page. C'est fait pour.
Si vous préférez déléguer, écrivez-moi — je travaille par écrit.