Ce qu'un outil de vérification des codes HTTP vous révèle
Chaque requête que votre navigateur, Googlebot ou un backlink envoie à une URL retourne un code de statut à trois chiffres. 200 signifie succès. 301 signifie redirection permanente. 404 signifie que la page n'existe plus. 500 signifie que le serveur a échoué. Un outil de vérification en masse des codes de statut des URLs lit ces codes pour de nombreuses URLs à la fois afin que vous n'ayez pas à ouvrir chacune dans un onglet du navigateur et à surveiller la barre d'adresse pour les redirections.
Les codes se divisent en cinq classes. Les codes 1xx sont informatifs et remontent rarement dans les audits réels. Les codes 2xx signifient succès, avec 200 comme seul code que vous voyez habituellement. Les codes 3xx signifient redirection, avec 301, 302, 307 et 308 comme codes courants. Les codes 4xx signifient que le côté client a échoué, avec 404 (non trouvé), 410 (disparu) et 403 (interdit) comme codes qui intéressent les SEOs. Les codes 5xx signifient que le serveur a échoué, avec 500 (erreur interne) et 503 (indisponible) comme codes les plus courants. Un outil de vérification des codes 200, 301, 404 scanne les trois à la fois et groupe les résultats afin que vous puissiez corriger les codes brisés sans trier une feuille de calcul.
Comment utiliser cet outil de vérification des codes HTTP
- Entrez les URLs (une par ligne, max 50). Collez votre liste dans la zone de texte, une URL par ligne, avec le protocole inclus (https:// ou http://). L'outil accepte jusqu'à 50 URLs par exécution. Pour les lots plus importants, divisez-les en groupes de 50.
- Choisissez Suivre les redirections. Choisissez Oui pour voir la chaîne complète de redirection et l'URL finale. Choisissez Non pour voir uniquement le premier code de réponse, ce qui est plus rapide lorsque vous ne vous souciez que de savoir si l'URL est active.
- Cliquez sur Vérifier les statuts. L'outil récupère chaque URL, enregistre le code de statut, capture le chemin de redirection si Suivre les redirections est activé, et calcule la réponse en millisecondes.
Essayez ceci avec une liste d'exemple. Collez https://example.com/old-page, https://example.com/contact, https://example.com/missing, https://example.com/blog, et https://example.com/api. Avec Suivre les redirections défini sur Oui, l'outil retourne : old-page = 301 vers /new-page (200), contact = 200, missing = 404, blog = 200, api = 503. Vous savez maintenant quelle page a bougé, quelle page est morte et quelle page le serveur ne peut pas afficher. Le temps d'exécution total est inférieur à cinq secondes pour 50 URLs.
Pourquoi la vérification en masse est importante pour les migrations SEO
Une migration de site casse les liens. Même avec une carte de redirection soignée, certaines URLs glissent à travers les mailles du filet. Les anciens articles de blog obtiennent des 404 parce que le motif du slug a changé. Les pages de catégorie chaînent par le biais de trois redirections parce que chaque refonte a ajouté un saut. Les PDFs qui se trouvaient autrefois à /downloads/ retournent maintenant 403 parce que le nouveau serveur a oublié de copier le dossier. Un outil de vérification des redirections exécuté sur votre sitemap le jour du lancement détecte ces problèmes en minutes au lieu de semaines de pertes de classement.
Google traite les pages 4xx et 5xx comme du gaspillage de crawl. Chaque URL brisée que Googlebot rencontre est une requête qui n'a pas atteint une page qui se classe. Une étude de 2024 de Botify analysant 1,2 milliard de crawls a révélé que les sites avec plus de 10 % des URLs crawlées retournant des 4xx ont perdu en moyenne 23 % de leur trafic organique en six mois. Les sites qui ont corrigé les erreurs 4xx se sont rétablis en deux mois. Une vérification des statuts en masse régulière maintient ce ratio bas et protège votre budget de crawl.
Erreurs courantes
- Traiter 302 comme 301. Un 302 est temporaire et ne passe pas l'équité de lien complète. Si une redirection est censée être permanente, changez-la en 301. Google traite finalement les 302 de longue durée comme des 301, mais attendre gaspille le temps de classement.
- Ignorer les chaînes de redirection. Une URL qui va de A à B à C à D est techniquement active, mais chaque saut ajoute de la latence et dilue l'équité de lien. Les chaînes plus longues que deux sauts doivent être aplaties afin que le lien source pointe directement vers D.
- Vérifier une seule URL à la fois. Une exécution unique de curl ne vous dit rien sur la santé du site entier. Une vérification en masse de 50 URLs à la fois montre des motifs, comme chaque URL
/blog/chaînant d'abord par/posts/. - Oublier d'inclure le protocole. Les URLs sans
https://ouhttp://peuvent être ignorées ou traitées comme des chemins relatifs. Collez toujours des URLs complètes. - Ignorer l'audit après une refonte. Les refontes cassent les liens de la même manière que les migrations. Exécutez une nouvelle vérification le jour où le nouveau site est en ligne et à nouveau deux semaines plus tard.
Conseils avancés
- Exécutez l'outil de vérification sur la sortie de votre sitemap XML. Extrayez les URLs du sitemap avec le sitemap-checker, collez-les, et confirmez que chaque URL que Google est invité à crawler retourne 200. Tout 3xx, 4xx ou 5xx dans votre sitemap est un signal de nettoyage.
- Associez cet outil avec le canonical-checker lors de l'audit d'une migration. Une URL qui retourne 200 mais se canonicalise vers une URL différente gaspille l'autorité. Le code de statut seul ne raconte pas l'histoire complète.
- Surveillez les temps de réponse. Un 200 qui prend 4 000 ms pour répondre est fonctionnellement cassé pour le SEO. Les données de Core Web Vitals de Google montrent que les pages avec un TTFB supérieur à 800 ms se classent en moyenne plus bas. Marquez toute URL au-dessus de 1 500 ms et enquêtez.
- Utilisez le google-crawler-simulator sur les URLs qui retournent 200 dans votre navigateur mais 403 ou 503 à l'outil de vérification. Certains serveurs bloquent les user agents des bots, ce qui signifie que Googlebot voit un statut différent d'un visiteur humain.
- Pour les audits de liens internes, exécutez l'outil de vérification sur la liste des URLs extraites de vos 20 pages les plus importantes. Les liens internes brisés poussent le PageRank vers des impasses. Les corriger améliore souvent les classements en une semaine sans aucun nouveau contenu.
Une fois que vous avez le rapport de statut, l'étape suivante consiste à corriger ce qui s'est cassé. Commencez par les erreurs 4xx qui ont des liens entrants et restaurez soit la page, soit effectuez un 301 vers l'équivalent vivant le plus proche. Utilisez le canonical-checker pour confirmer que les pages survivantes se canonicalisent sur elles-mêmes. Exécutez le sitemap-checker pour vous assurer que le sitemap ne reflète que les URLs actives. Réexécutez le google-crawler-simulator sur les URLs corrigées pour vérifier que Googlebot voit un 200 avec le bon canonical. Un rapport de statut propre maintient le budget de crawl orienté vers les pages qui méritent des classements.