Registre des contrôles
126 contrôles. Chacun est réfutable.
Chaque constat d'un audit vient de l'une de ces règles. Les scores en sont calculés de façon déterministe ; un modèle de langage ne décide jamais d'un score. Chaque règle indique comment vous sauriez qu'elle se trompe : un constat est donc un argument vérifiable, pas un verdict.
Technique 30 contrôles
Une page de contenu indexable porte un noindex
Comment savoir que c'est faux : Si ces pages sont volontairement exclues (préproduction, page utilitaire légère), reclassez, sinon, retirer le noindex doit rétablir l'indexation dans la GSC.
La canonique pointe vers une forme d'URL différente de l'URL en ligne
Comment savoir que c'est faux : Alignez la canonique sur la forme en ligne (celle du sitemap) ; les avertissements doublon/canonique de la GSC pour ces URLs devraient disparaître en quelques semaines.
La page est en noindex mais canonise vers une autre URL
Comment savoir que c'est faux : Vérifiez la cible canonique dans l'Inspection d'URL de la GSC : si elle est toujours indexée et servie, le signal contradictoire a été absorbé. Choisissez une intention (noindex avec auto-canonique, ou indexable avec canonique croisée) et réinspectez.
Les pages de contenu sont servies non mises en cache (no-store / private)
Comment savoir que c'est faux : Activez ISR/s-maxage sur la route ; les en-têtes de réponse deviennent cachables et le taux de succès du CDN devient observable.
Contenu mixte : ressources http:// sur une page https
Comment savoir que c'est faux : La console du navigateur affiche des avertissements de contenu mixte avant, aucun après.
La page renvoie 4xx/5xx
Comment savoir que c'est faux : Récupérez-la de nouveau après correction : un statut 200 et la (ré)indexation dans le rapport de couverture de la GSC confirment la résolution.
Aucun sitemap XML trouvé
Comment savoir que c'est faux : Ajoutez /sitemap.xml (et référencez-le depuis robots.txt) ; le rapport sitemap de la GSC devrait l'accepter et la découverte s'élargir.
Balise meta viewport manquante (rendu mobile)
Comment savoir que c'est faux : Le test d'optimisation mobile échoue sans elle et réussit après ajout, c'est une vérification binaire.
L'auto-référence hreflang contredit la canonique de la page
Comment savoir que c'est faux : Quand la canonique pointe ailleurs que la ligne hreflang propre, Google écarte la grappe linguistique. Rendez-les identiques et revalidez dans un testeur hreflang.
Valeurs hreflang avec des codes invalides ou non canoniques
Comment savoir que c'est faux : Validez avec un outil de test hreflang : Google ignore totalement les codes invalides ; la forme canonique est lang-REGION (fr-FR).
L'ensemble hreflang ne référence pas la page elle-même
Comment savoir que c'est faux : La documentation hreflang de Google exige que chaque page se liste elle-même ; ajoutez la ligne propre et revalidez.
Canonique manquante
Comment savoir que c'est faux : Si la GSC ne montre aucun regroupement d'URLs dupliquées pour ces pages, l'impact était faible ; cela reste une assurance peu coûteuse.
Pages dupliquées à l'octet près sous des URLs différentes
Comment savoir que c'est faux : Regroupez via canonique ou redirection, ou dépubliez ; après correction, deux URLs indexables ne partagent plus la même empreinte de contenu.
Aucun favicon déclaré
Comment savoir que c'est faux : Après ajout du jeu d'icônes, le favicon devrait remplacer le globe générique dans les résultats en quelques jours (à vérifier avec une requête site:).
HTML plus grand que la limite de traitement de 2 Mo
Comment savoir que c'est faux : Google traite environ les 2 premiers Mo d'un fichier HTML. Récupérez la page et vérifiez si votre contenu principal et le JSON-LD se trouvent avant ce seuil : si oui, ce n'est qu'un problème de poids, pas de troncature.
robots.txt déclare un sitemap qui ne répond pas
Comment savoir que c'est faux : Ouvrez chaque URL Sitemap: de robots.txt dans un navigateur, un sitemap actif renvoie du XML, pas un 404 ni une page HTML. Corrigez l'URL ou supprimez la ligne ; le rapport Sitemaps de la GSC devrait cesser d'afficher une erreur de récupération.
Des pages crawlées manquent dans le sitemap
Comment savoir que c'est faux : Ajoutez les URLs listées au sitemap ; leur délai d'indexation dépendant de la découverte devrait se réduire dans la GSC.
Le sitemap contient des URLs http://
Comment savoir que c'est faux : Chaque entrée http coûte une redirection au crawl ; passez-les en https et la redirection disparaît.
Le sitemap existe mais est vide ou illisible
Comment savoir que c'est faux : Validez le XML ; dès qu'il s'analyse avec au moins un <url><loc>, ce constat disparaît au prochain audit.
L'URL découverte redirige vers une autre URL
Comment savoir que c'est faux : Mettez à jour le sitemap et les liens internes vers les URLs finales ; recrawlez, zéro entrée redirigée le confirme.
Ensembles hreflang sans x-default
Comment savoir que c'est faux : x-default oriente les utilisateurs dont la langue ne correspond pas ; sans lui Google choisit arbitrairement, ajoutez-le et observez les impressions internationales.
Liens internes en http://
Comment savoir que c'est faux : Chaque lien de ce type coûte une redirection ; le crawl après correction montre zéro 301 interne vers https.
Pas de robots.txt
Comment savoir que c'est faux : Sans lui les robots supposent une autorisation totale, mais vous perdez l'endroit où déclarer vos sitemaps et votre politique sur les robots d'IA ; ajoutez-en un et c'est réglé.
En-têtes de sécurité manquants (HSTS / nosniff / XFO)
Comment savoir que c'est faux : Ce n'est pas un facteur de classement en soi ; traitez-le comme de l'hygiène de confiance. Si les en-têtes existent au niveau du CDN mais pas de l'origine, vérifiez la réponse en ligne.
Tous les lastmod du sitemap sont identiques
Comment savoir que c'est faux : Google ne tient compte que d'un lastmod vérifiablement exact ; des horodatages uniformes se lisent comme du bruit généré à la compilation.
Les valeurs <lastmod> du sitemap ne sont pas des dates W3C valides
Comment savoir que c'est faux : Passez le sitemap dans n'importe quel validateur de sitemap XML (ou le rapport Sitemaps de la GSC) : un lastmod valide est AAAA-MM-JJ ou un horodatage ISO 8601 complet. Si les valeurs sont déjà valides dans le fichier en ligne, le crawl a échantillonné une copie obsolète.
Le site mélange des URLs avec et sans barre oblique finale
Comment savoir que c'est faux : Demandez les deux formes d'une URL : si l'une redirige en 301 vers l'autre, le site est cohérent côté serveur et ceci est cosmétique. Sinon les deux formes peuvent être indexées comme doublons : choisissez-en une et redirigez l'autre.
On-page 28 contrôles
H1 manquant
Comment savoir que c'est faux : Si, après avoir ajouté des H1 ailleurs, le classement et les citations IA de ces pages ne changent pas, le H1 n'était pas la contrainte.
<title> manquant
Comment savoir que c'est faux : Si les pages sans titre obtiennent malgré tout des snippets et un CTR normaux, ce constat était sans objet.
Une surcouche recouvre l'écran mobile au chargement
Comment savoir que c'est faux : Chargez la page dans une fenêtre mobile de 375x812 et regardez le premier écran. Si aucune couche n'en recouvre la moitié avant interaction, ou si la couche est un avis légal (cookies / RGPD / vérification d'âge, que nous excluons), ce constat est faux.
Une image produit générée par IA ne porte pas d'IPTC DigitalSourceType
Comment savoir que c'est faux : Lisez le XMP du fichier avec exiftool : si DigitalSourceType est présent avec une valeur IPTC d'IA (par ex. trainedAlgorithmicMedia), ce constat est faux. Si l'image n'a pas été générée par une IA, la signature de générateur détectée est erronée : envoyez-nous le fichier et nous retirerons le motif.
Les images ne se chargent qu'avec JavaScript (pas de src dans le HTML)
Comment savoir que c'est faux : Récupérez la page avec JavaScript désactivé (curl) et cherchez <img src> : si les images sont là, c'est réglé. Déplacer l'URL dans src tout en gardant loading=lazy donne les deux.
Attribut lang manquant sur html
Comment savoir que c'est faux : Si les moteurs détectent tout de même la bonne langue de façon constante, c'est de l'hygiène, mais la correction ne coûte rien.
Images sans texte alternatif
Comment savoir que c'est faux : Si le trafic de recherche d'images et les audits d'accessibilité ne montrent aucune lacune, les alt restants sont décoratifs.
Méta-description manquante
Comment savoir que c'est faux : Si les snippets de ces pages se lisent bien (extraits automatiquement), l'impact se limite à la perte du contrôle du snippet.
og:url pointe vers une page différente de l'URL en ligne
Comment savoir que c'est faux : Partagez l'URL : l'aperçu doit résoudre vers cette page et non vers l'accueil ; après correction og:url égale l'URL canonique.
Titres dupliqués entre plusieurs pages
Comment savoir que c'est faux : Le regroupement « titre dupliqué » de la GSC disparaît une fois les titres uniques ; si les pages visent volontairement les mêmes requêtes, consolidez plutôt.
Titre de plus de 60 caractères
Comment savoir que c'est faux : Si Google affiche le titre complet sans le tronquer pour ces pages, la longueur ne posait pas de problème.
Cibles tactiles inférieures à 24x24 px sur mobile
Comment savoir que c'est faux : Ouvrez la page en 375px de large et mesurez les éléments listés. Si chacun fait au moins 24x24 px CSS, ou se trouve à l'intérieur d'une phrase (exception en ligne WCAG 2.5.8, que nous excluons déjà), ce constat est faux.
Contrôles interactifs sans nom accessible
Comment savoir que c'est faux : Inspectez les éléments listés dans l'arbre d'accessibilité (devtools > Accessibility). Si chacun expose un nom via du texte, aria-label, aria-labelledby, alt ou title, ce constat est faux. Les éléments masqués par aria-hidden sont déjà exclus.
Texte alternatif hors de la plage 10-125 caractères
Comment savoir que c'est faux : En dessous de 10 caractères il n'apporte aucun sens pour la recherche ; au-delà de 125 les lecteurs d'écran le tronquent. Réécrivez-le et confirmez via les impressions en recherche d'images.
Noms de fichiers d'images par défaut d'appareil photo ou sans signification
Comment savoir que c'est faux : Des noms descriptifs en kebab-case sont un signal de pertinence en recherche d'images ; renommez-les (ou servez-les via un alias CDN) et observez les impressions de ces ressources.
IPTC DigitalSourceType présent mais ce n'est pas une valeur IPTC NewsCodes
Comment savoir que c'est faux : Comparez la valeur au vocabulaire IPTC DigitalSourceType NewsCodes. Si elle y figure et que nous l'avons quand même signalée, ce constat est faux.
Pages de contenu à plus de 3 clics de la page d'accueil
Comment savoir que c'est faux : La profondeur est mesurée uniquement sur l'échantillon crawlé, un lien depuis une page non crawlée peut raccourcir le chemin. Vérifiez avec un crawl complet ; si la profondeur est réelle, liez la page depuis un hub ou la navigation principale et observez la fréquence de crawl dans la GSC.
L'article long ne cite aucune source externe
Comment savoir que c'est faux : Les liens sortants vers des sources primaires sont un signal d'autorité pour les humains comme pour les moteurs. Liez les sources que vous avez réellement utilisées ; si rien ne change pour cette page en un trimestre, le sourcing n'était pas la lacune.
Texte d'ancre générique (style « cliquez ici »)
Comment savoir que c'est faux : Les ancres descriptives portent la pertinence, les génériques la gaspillent. Remplacez-les et observez dans la GSC les requêtes des pages liées.
Plusieurs éléments H1
Comment savoir que c'est faux : Les moteurs modernes tolèrent plusieurs H1 ; traitez cela comme de l'hygiène sauf si l'extraction des titres casse visiblement.
Niveau de titre sauté (par ex. H2 → H4)
Comment savoir que c'est faux : Si les analyseurs de plan (et l'extraction de passages par l'IA) segmentent toujours correctement la page, le saut est cosmétique.
Article long avec très peu de liens internes dans le corps
Comment savoir que c'est faux : L'objectif de qualité est de 3-10 liens internes pour les articles de plus de 1500 mots ; ajoutez des liens contextuels et observez le crawl et la découverte des cibles.
Méta-descriptions dupliquées
Comment savoir que c'est faux : Des descriptions uniques redonnent le contrôle du snippet page par page ; si les moteurs réécrivent quand même les snippets, l'impact est limité.
Méta-description hors de la plage 120-160 caractères
Comment savoir que c'est faux : Dans cette plage Google tronque moins et réécrit moins souvent ; vérifiez-le sur le snippet des résultats.
Pages sans lien interne entrant (dans l'échantillon crawlé)
Comment savoir que c'est faux : L'échantillonnage peut masquer des pages liantes ; vérifiez avec un crawl complet ou le rapport de liens internes de la GSC, puis ajoutez des liens contextuels et observez la découverte et la fréquence de crawl.
Titre de moins de 30 caractères
Comment savoir que c'est faux : La plage de qualité est de 30-60 caractères ; un titre plus long et descriptif devrait augmenter le taux de clic de façon mesurable.
Aucune balise meta twitter:card
Comment savoir que c'est faux : Partagez sur X : sans balisage de carte l'aperçu se dégrade ; avec, une carte de résumé s'affiche.
URL de plus de 100 caractères
Comment savoir que c'est faux : Les URLs longues sont tronquées dans les résultats et moins copiées ou liées ; raccourcissez le slug et redirigez l'ancienne en 301.
Contenu 18 contrôles
Se classe en première page mais n'est presque jamais cliquée
Comment savoir que c'est faux : Ouvrez la Search Console pour cette URL : si le taux de clic est normal pour ses requêtes (les termes navigationnels de marque sont naturellement bas), ce constat est faux. Il l'est aussi si la page se classe sur des requêtes qu'elle ne devrait pas viser : alors c'est le ciblage qu'il faut corriger, pas le titre.
L'article de blog ne lie, dans son corps, aucune page de conversion
Comment savoir que c'est faux : Ajoutez des appels à l'action en fin d'article ; si en 4-6 semaines les conversions assistées et le flux de liens internes ne bougent pas, le constat était faux.
La page mobile affiche beaucoup moins de contenu que la version bureau
Comment savoir que c'est faux : Ouvrez la page en 375px puis en 1280px et comparez le texte visible. Si la vue mobile porte le même contenu (seulement replié dans des accordéons ou des onglets, ce qui reste présent dans le DOM mais masqué : vérifiez s'il s'agit de display:none), ce constat est faux.
L'article de blog n'a pas de signature d'auteur visible
Comment savoir que c'est faux : Indicateur E-E-A-T : ajoutez des signatures nominatives avec une courte bio ; les contenus anonymes signés « notre rédaction » sont moins cités par les moteurs IA.
Aucune information de contact dans tout le crawl (ni tel: ni mailto:)
Comment savoir que c'est faux : Socle de confiance (E-E-A-T) : une adresse e-mail ou un téléphone qui fonctionne quelque part sur le site ; les consignes qualité considèrent les exploitants injoignables comme peu fiables.
Aucune page de confidentialité ni de conditions trouvée
Comment savoir que c'est faux : Publiez la confidentialité et les conditions et liez-les depuis le pied de page ; si les pages existent et que le crawl les a manquées, marquez ceci comme résolu, cette vérification ne rapporte que ce que le crawl a pu voir.
L'article de blog n'affiche aucune date de publication
Comment savoir que c'est faux : La fraîcheur conditionne l'éligibilité aux citations IA ; une date lisible par machine (meta/time/schéma) rend l'article datable.
Les pages sont surtout du texte de gabarit partagé avec peu de contenu propre
Comment savoir que c'est faux : Ajoutez à cinq pages 2-3 paragraphes qui ne pourraient figurer que là (chiffres précis, détail local, notes de première main) ; si en 6-8 semaines les impressions de leurs propres requêtes ne bougent pas, la part de gabarit n'était pas le blocage.
Page à contenu maigre (<300 mots)
Comment savoir que c'est faux : Développez ou regroupez ; si la page se classe et convertit telle quelle (page utilitaire), reclassez comme intentionnel.
Le premier écran mobile ne contient presque pas de texte
Comment savoir que c'est faux : Chargez la page en 375x812 et lisez le premier écran. Si du texte lisible s'y trouve sans défilement, ce constat est faux : vérifiez si le texte n'est rendu qu'après l'hydratation côté client.
Le H1 de la page d'accueil ne mentionne pas la marque
Comment savoir que c'est faux : Clarté d'entité : si les réponses IA attribuent déjà le site à la bonne marque, passez.
Le contenu pratique ne montre aucun signe d'expérience de première main
Comment savoir que c'est faux : Le premier E d'E-E-A-T est l'expérience : les tests et tutoriels qui ne disent jamais ce qui a réellement été essayé se lisent comme de la recherche documentaire. Ajoutez un passage concret de première main (ce que vous avez fait, ce qui s'est passé, un chiffre mesuré) et revérifiez en 6-8 semaines le classement pour les requêtes propres à cette page.
Le contenu en anglais est difficile à lire (Flesch sous 30)
Comment savoir que c'est faux : Flesch n'est calibré que pour l'anglais, cette vérification ne s'exécute jamais dans d'autres langues. Raccourcissez les phrases et préférez les mots courants ; si les indicateurs d'engagement ne bougent pas, la lisibilité n'était pas le problème.
Article de plus de 12 mois sans mise à jour visible
Comment savoir que c'est faux : Les pages laissées telles quelles pendant 6 mois ou plus perdent leur éligibilité aux citations IA (SE Ranking) ; une actualisation avec dateModified devrait la rétablir.
Se classe juste en dehors des positions qui reçoivent des clics
Comment savoir que c'est faux : Examinez dans la Search Console les requêtes derrière cette page. Si elles n'ont rien à voir avec son objet, monter n'aiderait pas et ce n'est pas une opportunité. Si la page convertit déjà depuis sa position actuelle, la priorité est plus basse que le chiffre ne le suggère.
Paragraphes bien au-delà de la règle des 2-4 phrases
Comment savoir que c'est faux : Les paragraphes courts sont un signal structurel pour l'extraction par l'IA ; découpez-les et observez les citations au niveau des passages.
Contenu sous le seuil de mots pour son type de page
Comment savoir que c'est faux : Les seuils (accueil 500 / service 800 / blog 1500) sont des médianes concurrentielles, pas une loi ; si la page gagne déjà sa classe de requêtes dans la GSC, reclassez en brièveté volontaire.
Schéma 21 contrôles
Champs obligatoires manquants dans le schéma Product (name / image / offers)
Comment savoir que c'est faux : La fiche marchand de Google exige les trois ; le test des résultats enrichis signale les mêmes champs manquants.
Champs obligatoires manquants dans le schéma LocalBusiness (name / address)
Comment savoir que c'est faux : La documentation LocalBusiness de Google exige name + PostalAddress ; le test des résultats enrichis signale la même chose.
Champs obligatoires manquants dans le schéma Article (image / datePublished / publisher.logo)
Comment savoir que c'est faux : Le test des résultats enrichis liste exactement les champs obligatoires manquants avant la correction et passe après.
JSON-LD invalide (erreur d'analyse)
Comment savoir que c'est faux : Le test des résultats enrichis doit passer après la correction ; avant, il signale la même erreur d'analyse.
Champs d'offre mal formés (price / currency / availability)
Comment savoir que c'est faux : price doit être numérique (sans symbole), priceCurrency au format ISO-4217, availability une URL d'énumération schema.org, le test des résultats enrichis signale chacun.
ratingValue ou reviewCount manquant dans aggregateRating
Comment savoir que c'est faux : Les deux champs sont requis pour les résultats enrichis avec étoiles ; le test des résultats enrichis signale celui qui manque.
Le numéro de téléphone du schéma ne correspond pas à celui de la page
Comment savoir que c'est faux : Le classement local dépend d'un NAP cohérent. Rendez identiques le lien tel: visible et le telephone du schéma ; si les deux numéros diffèrent volontairement (ventes / support), reclassez comme intentionnel.
Les URLs du schéma utilisent une forme de barre oblique différente de l'URL en ligne
Comment savoir que c'est faux : Alignez les URLs du schéma sur la forme canonique ; dans le test des résultats enrichis, les URLs d'entité doivent correspondre exactement aux URLs en ligne.
Problèmes d'hygiène dans les données structurées (context / URLs relatives / valeurs de remplissage / dates invalides)
Comment savoir que c'est faux : Le test des résultats enrichis signale exactement ces classes d'erreurs ; un balisage propre se valide sans bruit.
La page d'accueil n'a pas de schéma Organization
Comment savoir que c'est faux : Clarté d'entité : une fois Organization (@id, logo, sameAs) en place et référencé par les articles, les signaux d'entité ont une racine à laquelle se rattacher.
Une page SaaS utilise le schéma Product au lieu de SoftwareApplication
Comment savoir que c'est faux : Si la documentation des résultats enrichis pour les logiciels accepte explicitement Product dans ce cas, rétrogradez ; sinon SoftwareApplication est le type documenté.
La page de contenu n'a aucune donnée structurée
Comment savoir que c'est faux : Le test des résultats enrichis détecte zéro élément avant, au moins un après.
L'offre produit ne déclare ni politique de livraison ni de retour
Comment savoir que c'est faux : Ajoutez shippingDetails et hasMerchantReturnPolicy à l'offre ; le rapport des fiches marchand de la Search Console devrait cesser de les signaler manquantes et les annotations livraison/retours deviennent éligibles.
Le schéma Product omet les champs sur lesquels les marchands sont appariés
Comment savoir que c'est faux : brand, sku/gtin et description sont ce qu'utilisent les surfaces d'achat pour apparier et afficher un produit. Ajoutez ceux que vous possédez réellement ; les rapports de fiches marchand devraient cesser de les signaler.
Coordonnées LocalBusiness sous les 4 décimales
Comment savoir que c'est faux : 4-5 décimales ≈ 10 m de précision ; des points plus grossiers situent mal l'établissement sur les cartes, corrigez et revérifiez le point sur la carte.
Le priceRange de LocalBusiness n'est pas une fourchette symbolique courte
Comment savoir que c'est faux : Le guide de Google attend un indicateur compact comme « $$ » ou « €€-€€€ », pas une phrase ni une liste de prix. Raccourcissez-le et relancez le test des résultats enrichis.
Schéma BlogPosting sans datePublished
Comment savoir que c'est faux : La fraîcheur conditionne l'éligibilité aux citations IA ; les articles datés sont extractibles comme sources récentes.
Types de schéma obsolètes utilisés (HowTo / SpecialAnnouncement / …)
Comment savoir que c'est faux : Google a retiré ces résultats enrichis (HowTo 2023, SpecialAnnouncement 2025, FAQ 2026) ; le balisage n'apporte rien.
Les données structurées utilisent Microdata/RDFa au lieu de JSON-LD
Comment savoir que c'est faux : Collez la page dans le test des résultats enrichis : si l'entité est détectée et éligible, le balisage fonctionne et il s'agit d'une préférence de maintenabilité, pas d'un défaut. Google recommande JSON-LD parce qu'il survit aux modifications de gabarit qui cassent les attributs en ligne.
Le schéma Organization n'a aucun lien sameAs
Comment savoir que c'est faux : sameAs est la façon dont un moteur relie votre marque à l'entité qu'il connaît (Wikipédia, LinkedIn, X, Crunchbase). Ajoutez 2-4 URLs de profils réels ; si après un trimestre les mentions de marque ne résolvent toujours pas vers votre entité, la lacune était ailleurs.
Performance 6 contrôles
La première image (probablement celle du LCP) est en chargement différé
Comment savoir que c'est faux : Différer l'image principale retarde le LCP d'un aller-retour. Retirez loading=lazy de la première image visible (ajoutez fetchpriority=high) et comparez le LCP avant/après dans une trace ou dans CrUX.
Images sans width/height (risque de CLS)
Comment savoir que c'est faux : Réserver les dimensions supprime les décalages tardifs de mise en page ; les données de terrain CLS s'améliorent après la correction.
Une ressource préchargée n'est jamais utilisée sur la page
Comment savoir que c'est faux : La console DevTools avertit « preloaded but not used within a few seconds », reproductible avant, absent après.
Images de contenu sans decoding=async
Comment savoir que c'est faux : decoding=async permet au thread principal de peindre sans attendre le décodage ; ajoutez-le et vérifiez dans une trace que le temps de décodage sur le thread principal diminue.
Une page riche en images les charge toutes immédiatement
Comment savoir que c'est faux : Ajoutez loading=lazy aux images sous la ligne de flottaison ; les octets transférés au premier chargement baissent de façon mesurable.
Images majoritairement JPEG/PNG, sans diffusion moderne ni adaptative
Comment savoir que c'est faux : WebP/AVIF ou srcset réduit les octets d'image de 30 à 70 % ; la taille transférée par image baisse de façon vérifiable.
AEO 8 contrôles
Les titres de question sont un texte de gabarit identique dans tous les articles
Comment savoir que c'est faux : Remplacez les questions de gabarit par des questions propres à la page dans 5 articles ; si en 4-6 semaines les réponses IA commencent à citer ces sections, le blocage était le manque d'originalité, sinon, reclassez en choix de conception.
Contenu long sans listes ni tableaux
Comment savoir que c'est faux : Les réponses IA privilégient les blocs extractibles ; ajoutez des listes ou tableaux à vos pages principales et observez la part de citations pour ces requêtes.
Gestionnaires de clic sur des éléments non interactifs (invisibles pour les agents)
Comment savoir que c'est faux : Les agents IA et les lecteurs d'écran agissent sur de vrais <a>/<button> ; un div avec onclick est invisible pour les deux.
Du contenu FAQ est présent mais il n'y a pas de schéma FAQPage
Comment savoir que c'est faux : Si le bloc questions-réponses de la page obtient déjà des citations IA sans schéma, le balisage n'est qu'un renfort facultatif.
Le paragraphe d'introduction enterre la réponse (BLUF)
Comment savoir que c'est faux : 44 % des citations IA proviennent des premiers 30 % d'une page ; placez une réponse de 40-60 mots en tête et observez la part de citations.
Champs de formulaire sans libellé
Comment savoir que c'est faux : Les champs libellés sont utilisables par les agents et les technologies d'assistance ; un audit d'accessibilité signale les mêmes champs.
Aucun repère <main>/<article>
Comment savoir que c'est faux : Les repères permettent aux extracteurs d'isoler le contenu principal du reste ; la qualité du retrait du gabarit s'améliore.
La page de contenu n'a aucun titre sous forme de question
Comment savoir que c'est faux : Les titres en forme de question correspondent aux schémas de requête ; si ces pages sont déjà citées dans les PAA ou les réponses IA, la structure suffit.
GEO 15 contrôles
Robots d'IA bloqués dans robots.txt
Comment savoir que c'est faux : Si le blocage est une décision de licence délibérée, reclassez-le en politique ; sinon, le déblocage doit faire apparaître des accès de robots IA dans les journaux.
Contenu invisible pour les robots d'IA (rendu côté client)
Comment savoir que c'est faux : Récupérez l'URL avec curl : si le contenu de réponse est absent du HTML brut, aucun agent sans JavaScript ne peut le citer. Le SSR/prerender corrige cela de façon mesurable.
La page à intention comparative n'a pas de tableau comparatif
Comment savoir que c'est faux : Ajoutez un tableau HTML ; si après 4-6 semaines les réponses IA aux requêtes « X vs Y / alternatives à X » ne citent toujours pas la page, la structure n'était pas le blocage.
Les contrôles de snippet empêchent les moteurs de citer la page
Comment savoir que c'est faux : nosnippet / max-snippet:0 / data-nosnippet indiquent aux moteurs qu'ils ne peuvent pas citer le texte, or c'est exactement ce dont une réponse IA a besoin. Retirez-les et regardez si la page devient citable.
La page à intention de question ne répond pas dans le passage d'ouverture
Comment savoir que c'est faux : Ce que les moteurs extraient, ce sont les réponses placées en tête (40-60 premiers mots) ; remontez la réponse directe en haut du texte et revérifiez les réponses IA pour la requête.
llms.txt pointe vers des URLs qui ne répondent pas
Comment savoir que c'est faux : Ouvrez les URLs listées : chacune doit renvoyer 200. Nous avons échantillonné les 10 premiers liens de même origine ; si elles répondent toutes maintenant, le fichier a été corrigé ou l'échantillon était malchanceux : relancez l'audit.
Aucune section ne tombe dans la plage de passage citable (~134-167 mots)
Comment savoir que c'est faux : Fusionnez les sections fragmentaires et découpez les blocs monolithiques vers 100-200 mots ; si la citation IA ne bouge pas en 4-6 semaines, la taille des passages n'était pas le blocage.
La page de définition ne commence pas par une phrase de définition
Comment savoir que c'est faux : Les moteurs de réponse reprennent la phrase qui définit le terme. Réécrivez l'ouverture sous la forme « X est … » et vérifiez en 4-6 semaines si la page apparaît dans les réponses de définition.
La clé IndexNow de ProvenVisible n'est pas installée
Comment savoir que c'est faux : Publiez le fichier de clé généré et envoyez un ping : le rapport IndexNow des Bing Webmaster Tools devrait montrer des soumissions reçues sous quelques jours. Si vous utilisez déjà IndexNow avec un autre outil ou si vos moteurs l'ignorent, écartez ce constat.
Pas de llms.txt
Comment savoir que c'est faux : Google rejette publiquement llms.txt comme signal de classement ; sa valeur se limite aux agents non-Google qui le lisent. Si aucun de vos moteurs cibles ne le récupère (journaux serveur), passez.
L'article structuré n'a aucun titre sous forme de question
Comment savoir que c'est faux : Les moteurs de réponse IA associent les H2/H3 en forme de question aux requêtes des utilisateurs ; reformulez 2-3 titres en questions et observez les citations au niveau des passages.
L'article long ne contient aucun chiffre concret à citer
Comment savoir que c'est faux : Les moteurs de réponse citent des nombres concrets (pourcentages, prix, durées, dates). Ajoutez 2-3 chiffres réels avec leur source ; si après 4-6 semaines la page n'apparaît toujours pas dans les réponses, la citabilité n'était pas le blocage.
robots.txt annonce une licence RSL absente ou mal formée
Comment savoir que c'est faux : Ouvrez l'URL License: de robots.txt : elle doit renvoyer un document XML dont la racine est <rsl> dans l'espace de noms https://rslstandard.org/rsl, avec au moins un <content> et un <license>. Si c'est le cas et que le constat persiste, la vérification est fausse.
Votre document de licence RSL refuse les clients ordinaires
Comment savoir que c'est faux : Récupérez l'URL License: avec curl (sans en-têtes de navigateur). Si le XML revient, c'est réglé ; s'il renvoie 403 comme chez nous, les robots pour qui la licence est écrite ne peuvent pas la lire non plus.
Votre licence RSL interdit l'usage de ce contenu par une IA
Comment savoir que c'est faux : Ce n'est pas un défaut mais une décision de licence : le fichier dit que les moteurs de réponse ne peuvent pas utiliser votre contenu. Si vous voulez de la visibilité IA, modifiez la ligne <prohibits type=… ; sinon, reclassez ce constat en politique.
Cette page est générée depuis le registre de contrôles en production : elle montre toujours exactement ce que l'audit exécute.