SEO

Audit SEO technique : les 15 contrôles qui comptent

Un audit technique n'a de valeur que s'il dit quoi corriger en premier. Voici les quinze contrôles qui décident si Google peut explorer, comprendre et afficher vos pages, avec la façon de les vérifier et de les corriger.

  • technical SEO
  • site audit
  • crawling
  • Core Web Vitals

En bref

Un audit SEO technique vérifie d'abord que vos pages sont accessibles (robots.txt, statut HTTP, noindex, rendu JavaScript), puis qu'elles ne se concurrencent pas (canonique, doublons), qu'elles se décrivent bien (titre, description, H1, langue, viewport, alt, JSON-LD) et qu'elles sont reliées et rapides (liens internes, sitemaps, signaux web essentiels). Corrigez d'abord les erreurs qui touchent le plus de pages, puis relancez une exploration pour confirmer.

Sur cette page
  1. Comment lire cet audit
  2. Accès et indexation
  3. 1. robots.txt et accès des robots
  4. 2. Statut HTTP
  5. 3. Directive noindex
  6. 4. Rendu JavaScript
  7. 5. URL canonique
  8. 6. Contenu dupliqué
  9. Balises et contenu de la page
  10. 7. Balise title
  11. 8. Meta description
  12. 9. Titre H1
  13. 10. Langue et hreflang
  14. 11. Balise viewport
  15. 12. Texte alternatif des images
  16. Structure, données et performance
  17. 13. Données structurées JSON-LD
  18. 14. Liens internes, pages orphelines et sitemaps
  19. 15. Signaux web essentiels
  20. Tableau récapitulatif
  21. Comment se calcule le score de santé
  22. Ce que l'exploration ne contrôle pas page par page
  23. Vérifier à la main
  24. Prioriser, corriger, vérifier
  25. Questions fréquentes

Comment lire cet audit

Chaque contrôle ci-dessous dit pourquoi il compte, comment le vérifier et comment corriger, puis donne le code que le NeoRank Engine affiche quand il le détecte. Le robot s'identifie comme NeoRankBot/1.0 (+https://neorank.ai/bot), respecte votre robots.txt et son Crawl-delay, et lit le HTML servi sans exécuter le JavaScript. Une exploration rapide lit 12 pages ; le détail est dans la documentation de l'audit.

Les quinze contrôles forment trois familles, et l'ordre compte : une page que les robots ne peuvent pas lire rend les treize autres contrôles inutiles pour elle. Commencez donc par l'accès et l'indexation, passez ensuite aux balises, puis à la structure et à la performance.

Accès et indexation

1. robots.txt et accès des robots

Une règle Disallow trop large empêche l'exploration de sections entières. Google rappelle que robots.txt gère l'exploration, pas l'indexation. Relisez le fichier règle par règle et testez vos chemins clés. Vérifiez aussi le pare-feu ou le CDN : un robot bloqué au niveau du réseau n'atteint jamais le robots.txt. Ce contrôle est lu au niveau du site : la vue Directives robots lit votre robots.txt pour huit robots d'IA, sans code par page (accès des robots d'IA).

2. Statut HTTP

Une page qui répond 404 ou 500 ne sera pas indexée, et Google traite chaque famille de statuts différemment. Corrigez le lien, restaurez la page ou redirigez vers son équivalent. Code : HTTP_ERROR, pour tout statut de 400 ou plus.

3. Directive noindex

Un noindex laissé par un gabarit ou un environnement de préproduction retire des pages de l'index sans bruit. Vérifiez chaque page marquée : est-ce voulu ? Code : NOINDEX, une remarque, car la directive est parfois volontaire.

4. Rendu JavaScript

Google sait exécuter le JavaScript, mais en différé et avec des limites ; un robot qui n'exécute pas le JavaScript, comme le NeoRank Engine, ne voit que le HTML servi. Si le contenu principal n'apparaît qu'après exécution, passez au rendu serveur ou à la génération statique. Code : CLIENT_RENDERED.

5. URL canonique

La canonique désigne la version à indexer quand plusieurs URL montrent le même contenu. Chaque page indexable devrait en déclarer une, absolue, vers elle-même ou vers l'original. Codes : CANONICAL_MISSING, CANONICAL_INVALID (illisible) et CANONICAL_CROSS_ORIGIN (vers un autre domaine, à confirmer).

6. Contenu dupliqué

Deux pages identiques se disputent la même requête et dispersent leurs liens. Fusionnez-les, différenciez-les ou déclarez une canonique. Sources fréquentes : paramètres d'URL, variantes http / https ou avec et sans www, versions imprimables. Code : CONTENT_EXACT_DUPLICATE, qui signale un contenu identique à celui d'une autre page explorée.

Balises et contenu de la page

7. Balise title

Le titre est la source principale du lien de titre dans les résultats. Visez un titre unique et descriptif, qui nomme le sujet avant la marque. Codes : TITLE_MISSING, TITLE_LENGTH et TITLE_DUPLICATE. La plage de 15 à 65 caractères est le seuil de NeoRank, pas une règle de Google.

8. Meta description

Google peut s'en servir pour l'extrait quand elle décrit mieux la page que le texte. Écrivez-en une par page, spécifique. Codes : META_DESCRIPTION_MISSING et META_DESCRIPTION_LENGTH, hors de 50 à 170 caractères, là encore un seuil de NeoRank.

9. Titre H1

Le H1 annonce le sujet au lecteur et structure la page. Un H1 clair par page suffit. Codes : H1_MISSING (avertissement) et H1_MULTIPLE (remarque).

10. Langue et hreflang

L'attribut lang déclare la langue ; les annotations hreflang relient les versions traduites, chacune pointant vers les autres et vers elle-même. Codes : HTML_LANG_MISSING, HREFLANG_INVALID et HREFLANG_DUPLICATE.

11. Balise viewport

Google indexe d'abord la version mobile. Sans balise viewport, la page s'affiche comme un écran de bureau rétréci. Code : VIEWPORT_MISSING.

12. Texte alternatif des images

Le texte alternatif sert l'accessibilité et aide Google à comprendre l'image. Décrivez les images utiles ; laissez un alt vide pour les images décoratives. Code : IMAGE_ALT_MISSING.

Structure, données et performance

13. Données structurées JSON-LD

Les données structurées décrivent l'entité et le contenu de la page. Un bloc qui ne se lit pas est ignoré. Code : JSON_LD_INVALID, un contrôle de syntaxe et non de conformité Schema.org. La méthode complète est dans notre guide JSON-LD.

Google découvre les pages par des liens explorables et par les sitemaps. Le NeoRank Engine suit les sitemaps déclarés dans le robots.txt et /sitemap.xml, jusqu'à cinq fichiers. Codes : INTERNAL_LINKS_MISSING (page sans lien interne explorable) et ORPHAN_PAGE_CANDIDATE (dans le sitemap, sans lien interne observé vers elle).

15. Signaux web essentiels

Les Core Web Vitals mesurent le chargement, la réactivité et la stabilité visuelle. NeoRank les lit via PageSpeed Insights : données réelles CrUX quand Google en dispose, sinon mesure de laboratoire Lighthouse, avec l'URL et la date. Si la capture n'est pas activée, la carte affiche « Non mesuré », jamais un score inventé (signaux web dans NeoRank).

Tableau récapitulatif

ContrôleCodes NeoRankGravité
Statut HTTPHTTP_ERRORErreur
NoindexNOINDEXRemarque
Rendu JavaScriptCLIENT_RENDEREDAvertissement
CanoniqueCANONICAL_MISSING, CANONICAL_INVALID, CANONICAL_CROSS_ORIGINAvertissement, erreur, avertissement
DoublonsCONTENT_EXACT_DUPLICATEAvertissement
TitleTITLE_MISSING, TITLE_LENGTH, TITLE_DUPLICATEErreur, avertissement
Meta descriptionMETA_DESCRIPTION_MISSING, META_DESCRIPTION_LENGTHAvertissement, remarque
H1H1_MISSING, H1_MULTIPLEAvertissement, remarque
Langue et hreflangHTML_LANG_MISSING, HREFLANG_INVALID, HREFLANG_DUPLICATERemarque, avertissement
ViewportVIEWPORT_MISSINGAvertissement
Alt des imagesIMAGE_ALT_MISSINGAvertissement
JSON-LDJSON_LD_INVALIDErreur
Maillage interneINTERNAL_LINKS_MISSING, ORPHAN_PAGE_CANDIDATERemarque

Comment se calcule le score de santé

Chaque page part de 100 et perd 15 points par erreur, 8 par avertissement et 3 par remarque, sans descendre sous 0. Le score du site est la moyenne arrondie des pages : 80 et plus est sain, 50 à 79 est à surveiller, moins de 50 est critique (détail du score).

Ce que l'exploration ne contrôle pas page par page

Soyons précis : les chaînes de redirections, les liens internes cassés, la profondeur de clic et le blocage d'un robot d'IA page par page ne sont pas des constats de l'exploration. Pour les redirections et les pages introuvables, le rapport d'indexation des pages de la Search Console montre les pages que Google n'a pas indexées et la raison qu'il donne ; pour la profondeur de clic, il faut un outil qui la mesure. Un outil qui prétendrait tout mesurer sans le faire vous ferait corriger des problèmes imaginaires et en ignorer de réels.

Vérifier à la main

  • HTML servi : affichez la source de la page (pas l'inspecteur du navigateur) pour voir ce qu'un robot sans JavaScript reçoit.
  • HTML rendu par Google : l'outil d'inspection d'URL de la Search Console montre la page telle que Googlebot l'a traitée.
  • JSON-LD : le test des résultats enrichis de Google et le validateur Schema.org, en complément du contrôle de syntaxe de NeoRank.
  • Performance : PageSpeed Insights pour une URL précise, en distinguant données réelles et mesure de laboratoire.

Prioriser, corriger, vérifier

  1. Triez par gravité, puis par nombre de pages touchées : une erreur de gabarit se corrige une fois pour des centaines d'URL.
  2. Ouvrez la résolution du problème : pourquoi, où, avant / après et la liste des pages.
  3. Corrigez et publiez.
  4. Relancez l'exploration (offres payantes) : le problème disparaît quand la nouvelle exploration ne le retrouve plus.

Questions fréquentes

À quelle fréquence faire un audit SEO technique ?
Après chaque mise en production qui touche les gabarits, la navigation ou le rendu, et au minimum une fois par mois sur un site qui publie régulièrement. Un audit ponctuel se périme vite.
Faut-il corriger toutes les remarques ?
Non. Une remarque signale un point à vérifier, comme un noindex volontaire ou plusieurs H1 sur une page longue. Traitez d'abord les erreurs, puis les avertissements qui touchent beaucoup de pages.
Pourquoi mon site est-il signalé comme rendu côté navigateur ?
Le NeoRank Engine lit le HTML servi sans exécuter le JavaScript. Si le contenu principal n'y figure pas, les robots qui n'exécutent pas le JavaScript voient une page vide ; le rendu serveur corrige le problème.
Les longueurs de titre et de description sont-elles des règles de Google ?
Non. Google ne fixe pas de longueur officielle. Les plages de 15 à 65 et de 50 à 170 caractères sont des seuils de NeoRank pour repérer les titres et descriptions probablement tronqués ou trop pauvres.
Un score de santé de 100 garantit-il un bon classement ?
Non. Le score mesure l'absence de défauts techniques détectés, pas la qualité ni la pertinence du contenu. Il supprime des obstacles à l'exploration et à la compréhension ; le classement dépend ensuite de ce que vos pages apportent aux lecteurs.

Voyez où en est votre site

Lancez l'analyse gratuite pour voir ce que le NeoRank Engine relève sur votre site.

Lancer l'analyse gratuite

Sources

  1. Introduction to robots.txt
  2. How HTTP status codes, and network and DNS errors affect Google Search
  3. Block Search indexing with noindex
  4. Understand JavaScript SEO basics
  5. How to specify a canonical URL with rel=canonical and other methods
  6. Influencing your title links in search results
  7. Control your snippets in search results
  8. Tell Google about localized versions of your page
  9. Mobile site and mobile-first indexing best practices
  10. Google Images SEO best practices
  11. Introduction to structured data markup in Google Search
  12. Link best practices for Google
  13. Learn about sitemaps
  14. Web Vitals
  15. About PageSpeed Insights

Partager