Guide · Exploration et indexation
Redirections et codes de réponse
Un code de réponse est la phrase la plus courte qu'un serveur adresse à un moteur. Se tromper de code, c'est lui raconter autre chose que ce qui s'est passé.
Chaque demande reçoit un code de réponse à trois chiffres. C'est l'information la plus fiable dont dispose un moteur sur l'état d'une URL, et celle qu'on renseigne le plus mal.
Les codes qui comptent
200, succès. La page existe et son contenu suit. Rien à signaler.
301, déplacement permanent. Le contenu a une nouvelle adresse définitive. Le moteur transfère les signaux accumulés, remplace l'ancienne URL par la nouvelle dans son index, et cesse progressivement de demander l'ancienne.
302, déplacement temporaire. Le contenu est ailleurs pour le moment. Le moteur garde l'ancienne URL dans son index et continue de la demander. Utile pour une opération commerciale, dangereux quand c'est un déplacement permanent déclaré par erreur, ce qui arrive par défaut sur beaucoup de serveurs.
404, introuvable. La page n'existe pas. Le moteur la retire de son index après quelques passages.
410, disparue. La page a existé et a été supprimée volontairement. Le retrait est plus rapide qu'avec un 404. Peu d'outils le produisent, et il vaut la peine quand on supprime un gros volume.
503, service indisponible. Le serveur ne peut pas répondre pour l'instant. Le moteur revient plus tard sans rien conclure. C'est le bon code pendant une maintenance, et le mauvais code si l'état dure des semaines.
Quand rediriger, et vers quoi
La règle tient en une phrase : une redirection n'a de sens que si la page de destination répond à la même intention que la page disparue.
Un article supprimé et remplacé par un article plus récent sur le même sujet se redirige. Un produit retiré du catalogue se redirige vers son remplaçant, ou vers sa catégorie s'il n'y en a pas.
Un produit sans équivalent ne se redirige pas vers l'accueil. Le moteur reconnaît ce schéma et le traite comme une erreur molle : la redirection est ignorée et l'URL est considérée comme introuvable, avec une expérience utilisateur déplorable en prime.
Les chaînes, et pourquoi elles coûtent
Une chaîne apparaît quand une URL redirige vers une autre qui redirige à son tour. Trois ou quatre sauts s'accumulent facilement au fil des années et des migrations.
Le coût est double. Chaque saut est une demande supplémentaire, donc du budget d'exploration consommé pour rien. Et au-delà de quelques sauts, les robots abandonnent.
La correction consiste à réécrire la table de redirections pour que chaque ancienne URL pointe directement vers la destination finale. Un crawler produit cette liste en une passe.
Les boucles, où A redirige vers B qui redirige vers A, rendent la page définitivement inaccessible. Elles se détectent immédiatement et se corrigent en priorité.
Les erreurs molles
Une erreur molle est une page qui annonce un succès tout en n'ayant rien à montrer : un message « produit indisponible » renvoyé en 200, une page vide, une redirection vers l'accueil.
Le moteur les détecte et les traite comme des erreurs, mais il lui faut plus de temps et plus de passages pour en arriver là. Un code franc dès le départ coûte moins cher à tout le monde.
La page d'erreur, ce qui se joue vraiment
Une page 404 soignée ne change rien au référencement : le code est ce qui compte, pas la présentation. Elle change tout à l'expérience.
Une bonne page d'erreur reprend la navigation du site, propose une recherche, et suggère les contenus proches. Elle renvoie évidemment un code 404, ce que beaucoup de gabarits oublient de faire.
Les erreurs 404 ne sont pas un problème en soi. Un site vivant en produit en permanence, parce que d'autres sites font des liens vers des adresses inventées ou périmées. Ce qui mérite l'attention, ce sont les 404 sur des URL qui recevaient du trafic, et les 404 pointées par vos propres liens internes.