Audit SEO technique : les 15 contrôles qui comptent
Un audit technique n'a de valeur que s'il dit quoi corriger en premier. Voici les quinze contrôles qui décident si Google peut explorer, comprendre et afficher vos pages, avec la façon de les vérifier et de les corriger.
En bref
Un audit SEO technique vérifie d'abord que vos pages sont accessibles (robots.txt, statut HTTP, noindex, rendu JavaScript), puis qu'elles ne se concurrencent pas (canonique, doublons), qu'elles se décrivent bien (titre, description, H1, langue, viewport, alt, JSON-LD) et qu'elles sont reliées et rapides (liens internes, sitemaps, signaux web essentiels). Corrigez d'abord les erreurs qui touchent le plus de pages, puis relancez une exploration pour confirmer.
Sur cette page
- Comment lire cet audit
- Accès et indexation
- 1. robots.txt et accès des robots
- 2. Statut HTTP
- 3. Directive noindex
- 4. Rendu JavaScript
- 5. URL canonique
- 6. Contenu dupliqué
- Balises et contenu de la page
- 7. Balise title
- 8. Meta description
- 9. Titre H1
- 10. Langue et hreflang
- 11. Balise viewport
- 12. Texte alternatif des images
- Structure, données et performance
- 13. Données structurées JSON-LD
- 14. Liens internes, pages orphelines et sitemaps
- 15. Signaux web essentiels
- Tableau récapitulatif
- Comment se calcule le score de santé
- Ce que l'exploration ne contrôle pas page par page
- Vérifier à la main
- Prioriser, corriger, vérifier
- Questions fréquentes
Comment lire cet audit
Chaque contrôle ci-dessous dit pourquoi il compte, comment le vérifier et comment corriger, puis donne le code que le NeoRank Engine affiche quand il le détecte. Le robot s'identifie comme NeoRankBot/1.0 (+https://neorank.ai/bot), respecte votre robots.txt et son Crawl-delay, et lit le HTML servi sans exécuter le JavaScript. Une exploration rapide lit 12 pages ; le détail est dans la documentation de l'audit.
Les quinze contrôles forment trois familles, et l'ordre compte : une page que les robots ne peuvent pas lire rend les treize autres contrôles inutiles pour elle. Commencez donc par l'accès et l'indexation, passez ensuite aux balises, puis à la structure et à la performance.
Accès et indexation
1. robots.txt et accès des robots
Une règle Disallow trop large empêche l'exploration de sections entières. Google rappelle que robots.txt gère l'exploration, pas l'indexation. Relisez le fichier règle par règle et testez vos chemins clés. Vérifiez aussi le pare-feu ou le CDN : un robot bloqué au niveau du réseau n'atteint jamais le robots.txt. Ce contrôle est lu au niveau du site : la vue Directives robots lit votre robots.txt pour huit robots d'IA, sans code par page (accès des robots d'IA).
2. Statut HTTP
Une page qui répond 404 ou 500 ne sera pas indexée, et Google traite chaque famille de statuts différemment. Corrigez le lien, restaurez la page ou redirigez vers son équivalent. Code : HTTP_ERROR, pour tout statut de 400 ou plus.
3. Directive noindex
Un noindex laissé par un gabarit ou un environnement de préproduction retire des pages de l'index sans bruit. Vérifiez chaque page marquée : est-ce voulu ? Code : NOINDEX, une remarque, car la directive est parfois volontaire.
4. Rendu JavaScript
Google sait exécuter le JavaScript, mais en différé et avec des limites ; un robot qui n'exécute pas le JavaScript, comme le NeoRank Engine, ne voit que le HTML servi. Si le contenu principal n'apparaît qu'après exécution, passez au rendu serveur ou à la génération statique. Code : CLIENT_RENDERED.
5. URL canonique
La canonique désigne la version à indexer quand plusieurs URL montrent le même contenu. Chaque page indexable devrait en déclarer une, absolue, vers elle-même ou vers l'original. Codes : CANONICAL_MISSING, CANONICAL_INVALID (illisible) et CANONICAL_CROSS_ORIGIN (vers un autre domaine, à confirmer).
6. Contenu dupliqué
Deux pages identiques se disputent la même requête et dispersent leurs liens. Fusionnez-les, différenciez-les ou déclarez une canonique. Sources fréquentes : paramètres d'URL, variantes http / https ou avec et sans www, versions imprimables. Code : CONTENT_EXACT_DUPLICATE, qui signale un contenu identique à celui d'une autre page explorée.
Balises et contenu de la page
7. Balise title
Le titre est la source principale du lien de titre dans les résultats. Visez un titre unique et descriptif, qui nomme le sujet avant la marque. Codes : TITLE_MISSING, TITLE_LENGTH et TITLE_DUPLICATE. La plage de 15 à 65 caractères est le seuil de NeoRank, pas une règle de Google.
8. Meta description
Google peut s'en servir pour l'extrait quand elle décrit mieux la page que le texte. Écrivez-en une par page, spécifique. Codes : META_DESCRIPTION_MISSING et META_DESCRIPTION_LENGTH, hors de 50 à 170 caractères, là encore un seuil de NeoRank.
9. Titre H1
Le H1 annonce le sujet au lecteur et structure la page. Un H1 clair par page suffit. Codes : H1_MISSING (avertissement) et H1_MULTIPLE (remarque).
10. Langue et hreflang
L'attribut lang déclare la langue ; les annotations hreflang relient les versions traduites, chacune pointant vers les autres et vers elle-même. Codes : HTML_LANG_MISSING, HREFLANG_INVALID et HREFLANG_DUPLICATE.
11. Balise viewport
Google indexe d'abord la version mobile. Sans balise viewport, la page s'affiche comme un écran de bureau rétréci. Code : VIEWPORT_MISSING.
12. Texte alternatif des images
Le texte alternatif sert l'accessibilité et aide Google à comprendre l'image. Décrivez les images utiles ; laissez un alt vide pour les images décoratives. Code : IMAGE_ALT_MISSING.
Structure, données et performance
13. Données structurées JSON-LD
Les données structurées décrivent l'entité et le contenu de la page. Un bloc qui ne se lit pas est ignoré. Code : JSON_LD_INVALID, un contrôle de syntaxe et non de conformité Schema.org. La méthode complète est dans notre guide JSON-LD.
14. Liens internes, pages orphelines et sitemaps
Google découvre les pages par des liens explorables et par les sitemaps. Le NeoRank Engine suit les sitemaps déclarés dans le robots.txt et /sitemap.xml, jusqu'à cinq fichiers. Codes : INTERNAL_LINKS_MISSING (page sans lien interne explorable) et ORPHAN_PAGE_CANDIDATE (dans le sitemap, sans lien interne observé vers elle).
15. Signaux web essentiels
Les Core Web Vitals mesurent le chargement, la réactivité et la stabilité visuelle. NeoRank les lit via PageSpeed Insights : données réelles CrUX quand Google en dispose, sinon mesure de laboratoire Lighthouse, avec l'URL et la date. Si la capture n'est pas activée, la carte affiche « Non mesuré », jamais un score inventé (signaux web dans NeoRank).
Tableau récapitulatif
| Contrôle | Codes NeoRank | Gravité |
|---|---|---|
| Statut HTTP | HTTP_ERROR | Erreur |
| Noindex | NOINDEX | Remarque |
| Rendu JavaScript | CLIENT_RENDERED | Avertissement |
| Canonique | CANONICAL_MISSING, CANONICAL_INVALID, CANONICAL_CROSS_ORIGIN | Avertissement, erreur, avertissement |
| Doublons | CONTENT_EXACT_DUPLICATE | Avertissement |
| Title | TITLE_MISSING, TITLE_LENGTH, TITLE_DUPLICATE | Erreur, avertissement |
| Meta description | META_DESCRIPTION_MISSING, META_DESCRIPTION_LENGTH | Avertissement, remarque |
| H1 | H1_MISSING, H1_MULTIPLE | Avertissement, remarque |
| Langue et hreflang | HTML_LANG_MISSING, HREFLANG_INVALID, HREFLANG_DUPLICATE | Remarque, avertissement |
| Viewport | VIEWPORT_MISSING | Avertissement |
| Alt des images | IMAGE_ALT_MISSING | Avertissement |
| JSON-LD | JSON_LD_INVALID | Erreur |
| Maillage interne | INTERNAL_LINKS_MISSING, ORPHAN_PAGE_CANDIDATE | Remarque |
Comment se calcule le score de santé
Chaque page part de 100 et perd 15 points par erreur, 8 par avertissement et 3 par remarque, sans descendre sous 0. Le score du site est la moyenne arrondie des pages : 80 et plus est sain, 50 à 79 est à surveiller, moins de 50 est critique (détail du score).
Ce que l'exploration ne contrôle pas page par page
Soyons précis : les chaînes de redirections, les liens internes cassés, la profondeur de clic et le blocage d'un robot d'IA page par page ne sont pas des constats de l'exploration. Pour les redirections et les pages introuvables, le rapport d'indexation des pages de la Search Console montre les pages que Google n'a pas indexées et la raison qu'il donne ; pour la profondeur de clic, il faut un outil qui la mesure. Un outil qui prétendrait tout mesurer sans le faire vous ferait corriger des problèmes imaginaires et en ignorer de réels.
Vérifier à la main
- HTML servi : affichez la source de la page (pas l'inspecteur du navigateur) pour voir ce qu'un robot sans JavaScript reçoit.
- HTML rendu par Google : l'outil d'inspection d'URL de la Search Console montre la page telle que Googlebot l'a traitée.
- JSON-LD : le test des résultats enrichis de Google et le validateur Schema.org, en complément du contrôle de syntaxe de NeoRank.
- Performance : PageSpeed Insights pour une URL précise, en distinguant données réelles et mesure de laboratoire.
Prioriser, corriger, vérifier
- Triez par gravité, puis par nombre de pages touchées : une erreur de gabarit se corrige une fois pour des centaines d'URL.
- Ouvrez la résolution du problème : pourquoi, où, avant / après et la liste des pages.
- Corrigez et publiez.
- Relancez l'exploration (offres payantes) : le problème disparaît quand la nouvelle exploration ne le retrouve plus.
Questions fréquentes
- À quelle fréquence faire un audit SEO technique ?
- Après chaque mise en production qui touche les gabarits, la navigation ou le rendu, et au minimum une fois par mois sur un site qui publie régulièrement. Un audit ponctuel se périme vite.
- Faut-il corriger toutes les remarques ?
- Non. Une remarque signale un point à vérifier, comme un noindex volontaire ou plusieurs H1 sur une page longue. Traitez d'abord les erreurs, puis les avertissements qui touchent beaucoup de pages.
- Pourquoi mon site est-il signalé comme rendu côté navigateur ?
- Le NeoRank Engine lit le HTML servi sans exécuter le JavaScript. Si le contenu principal n'y figure pas, les robots qui n'exécutent pas le JavaScript voient une page vide ; le rendu serveur corrige le problème.
- Les longueurs de titre et de description sont-elles des règles de Google ?
- Non. Google ne fixe pas de longueur officielle. Les plages de 15 à 65 et de 50 à 170 caractères sont des seuils de NeoRank pour repérer les titres et descriptions probablement tronqués ou trop pauvres.
- Un score de santé de 100 garantit-il un bon classement ?
- Non. Le score mesure l'absence de défauts techniques détectés, pas la qualité ni la pertinence du contenu. Il supprime des obstacles à l'exploration et à la compréhension ; le classement dépend ensuite de ce que vos pages apportent aux lecteurs.
Voyez où en est votre site
Lancez l'analyse gratuite pour voir ce que le NeoRank Engine relève sur votre site.
Lancer l'analyse gratuiteSources
- Introduction to robots.txt
- How HTTP status codes, and network and DNS errors affect Google Search
- Block Search indexing with noindex
- Understand JavaScript SEO basics
- How to specify a canonical URL with rel=canonical and other methods
- Influencing your title links in search results
- Control your snippets in search results
- Tell Google about localized versions of your page
- Mobile site and mobile-first indexing best practices
- Google Images SEO best practices
- Introduction to structured data markup in Google Search
- Link best practices for Google
- Learn about sitemaps
- Web Vitals
- About PageSpeed Insights