Réponse directe
L'indexabilité détermine si une page récupérable peut entrer dans un index. La canonicalisation détermine quelle URL peut représenter un groupe de pages dupliquées ou très similaires. Une balise canonical ne rend pas une page indexable, ne force pas Google à la sélectionner, et ne redirige pas les utilisateurs.
Choisissez d'abord l'état visé, puis alignez la réponse HTTP, la redirection, la directive d'index, le canonical, les liens internes, le sitemap et le hreflang. Google décrit les redirections et rel="canonical" comme des signaux canoniques forts, et l'inclusion dans le sitemap comme un signal plus faible. Des signaux contradictoires créent de l'ambiguïté, et Google peut sélectionner un canonical différent.
Pour un contenu supprimé, renvoyez un 404 ou un 410 significatif lorsqu'aucun remplacement n'existe. Ne redirigez que vers un remplacement pertinent. Une page en 200 qui affiche « introuvable » n'est pas un choix de conception anodin. Elle peut devenir une soft 404 et faire perdre du temps de diagnostic.
Ce que vous saurez faire
À la fin de cette leçon, vous serez capable de :
- distinguer indexabilité, indexation, déclaration canonique et sélection canonique ;
- prévoir comment les états HTTP courants affectent le crawl et l'éligibilité à l'index ;
- choisir entre redirection permanente, redirection temporaire, canonical,
noindex,404et410; - réconcilier un cluster d'URL dupliquées ;
- diagnostiquer un « Google a choisi un autre canonical » sans ajouter de directives contradictoires ;
- classer des combinaisons techniques comme invalides, contradictoires, faibles ou acceptables.
Quatre états que les équipes confondent
Indexable
La page n'a aucune directive technique connue qui empêche son éligibilité à l'index. Elle peut malgré tout être exclue pour cause de duplication, de qualité, d'accès, ou de choix du système.
Indexée
Le système de recherche stocke actuellement la page ou son représentant canonique.
Canonical déclaré
Le propriétaire du site indique un représentant préféré via rel="canonical" dans le HTML ou via un en-tête HTTP Link pris en charge.
Canonical sélectionné
Le système de recherche choisit un représentant pour un cluster de doublons à partir de plusieurs signaux.
Une page peut se déclarer elle-même canonique pendant que Google sélectionne une autre URL. La balise est un signal, pas un ordre.
Pourquoi les clusters de doublons existent
Une même ressource peut apparaître via :
- HTTP et HTTPS ;
wwwet non-www;- des paramètres de tracking ;
- des filtres et des tris ;
- des versions imprimables ou PDF ;
- des alternatives mobiles ;
- des paramètres de session ou de tenant ;
- du contenu copié ou traduit ;
- d'anciennes et de nouvelles structures de route.
Tout doublon n'est pas une pénalité. La canonicalisation aide les systèmes à consolider les signaux et à choisir un représentant. Le problème vient d'un inventaire non maîtrisé, d'une propriété contradictoire, d'un crawl gaspillé, et de la mauvaise URL qui apparaît.
Les signaux canoniques et leur force
La documentation de Google sur la canonicalisation décrit :
- les redirections comme un signal fort que la cible devrait être canonique ;
rel="canonical"comme un signal fort ;- l'inclusion dans le sitemap comme un signal faible ;
- des liens internes cohérents comme preuve à l'appui.
Les signaux peuvent se cumuler. Une redirection permanente vers l'URL A, un self-canonical sur A, des liens internes vers A, et l'inclusion de A dans le sitemap communiquent tous le même état.
Les signaux peuvent aussi entrer en conflit. Une page qui pointe en canonical vers A alors que les liens, le sitemap et le hreflang soutiennent B crée une ambiguïté évitable.
Quand utiliser chaque mécanisme
Redirection permanente
Utilisez 301 ou 308 lorsque les utilisateurs et les robots doivent désormais utiliser l'URL de remplacement.
Exemples :
- HTTP vers HTTPS ;
- ancien slug vers nouveau slug ;
- page fusionnée vers l'équivalent le plus proche.
Les recommandations de Google sur les redirections traitent les redirections permanentes côté serveur comme des signaux canoniques forts.
Redirection temporaire
Utilisez 302, 303 ou 307 lorsque l'URL d'origine reste le propriétaire à long terme et que le déplacement est temporaire.
Ne laissez pas un état « temporaire » indéfiniment sans vérifier si la propriété visée a changé entre-temps.
Canonical
Utilisez un canonical lorsque plusieurs variantes accessibles doivent rester disponibles, mais qu'une seule doit représenter le cluster dans la recherche.
Exemples :
- paramètres de tracking ;
- HTML adapté à l'impression ;
- syndication ou variantes de produit prises en charge.
N'utilisez pas le canonical comme substitut à une redirection appropriée lorsque l'alternative ne devrait plus être visitée.
Noindex
Utilisez noindex lorsqu'une page récupérable ne doit pas apparaître dans la recherche. Il ne consolide pas les signaux de la page vers une autre URL de la même façon qu'une redirection ou un canonical.
Les recommandations de Google sur le noindex exigent que le robot accède à la page et lise la directive.
404 ou 410
Utilisez 404 Not Found ou 410 Gone lorsqu'aucune ressource ni remplacement pertinent n'existe. Ne redirigez pas une page obsolète vers une page d'accueil sans rapport simplement pour éviter une erreur.
États et directives HTTP
La documentation de Google sur les codes de statut pour les robots explique comment ses robots traitent les réponses courantes. Le tableau ci-dessous est un résumé pratique, pas une garantie de délai.
| État ou directive HTTP | Comportement de crawl | Éligibilité à l'index | Effet canonique | Résultat utilisateur | Usage correct | Mésusage courant |
|---|---|---|---|---|---|---|
200 |
Le contenu peut être traité | Éligible si autorisé et utile | La page peut rejoindre un cluster | Contenu affiché | Ressource publique existante | Renvoyer « introuvable » avec un 200 |
204 |
Aucun contenu à traiter | Aucun contenu utile à indexer | Aucun | Succès vide | Requête réussie sans corps | Page de contenu public |
301 ou 308 |
Suit la redirection permanente | La source peut disparaître pendant que la cible prend la propriété | Signal cible fort | Envoyé vers l'URL finale | Déplacement permanent | Rediriger des suppressions non liées vers l'accueil |
302, 303, 307 |
Suit la redirection temporaire | L'original peut rester propriétaire | Signal cible temporaire | Envoyé temporairement | Déplacement temporaire court | Laisser une migration permanente en état temporaire |
304 |
Utilise la représentation en cache | L'état de contenu existant se poursuit | Aucune nouvelle propriété | Le navigateur utilise le cache | Requête conditionnelle | La traiter comme une redirection |
404 |
Observe l'absence | L'URL devient inéligible | Aucun | Introuvable | Ressource manquante | La styliser en 200 |
410 |
Observe une absence intentionnelle | L'URL devient inéligible | Aucun | Disparue | Ressource volontairement supprimée | Supposer une suppression garantie plus rapide |
429 |
Traité comme une limitation de débit | Des échecs persistants peuvent affecter le crawl et l'état d'index | Aucun | Débit limité | Véritable protection contre une surcharge | Limiter le débit des robots de façon permanente |
500 |
Défaillance du serveur | Des échecs persistants peuvent affecter les URL indexées | Aucun | Erreur | Défaillance inattendue | L'utiliser pour une maintenance planifiée indéfiniment |
503 |
Indisponibilité temporaire du serveur | Un échec persistant crée quand même un risque | Aucun | Temporairement indisponible | Maintenance ou surcharge de courte durée | Le laisser non résolu |
| Robots disallow | Le robot ne récupère pas le chemin correspondant | Une URL connue peut rester sans contenu | Masque les signaux de la page au robot | L'utilisateur peut quand même la visiter | Gestion du crawl | Désindexation ou sécurité |
| Noindex en meta ou en-tête | Le robot récupère et lit l'exclusion | Non éligible à l'index une fois traité | Ne transfère pas les signaux à lui seul | L'utilisateur peut visiter | Page publique exclue de la recherche | Bloquer le crawl en même temps |
rel="canonical" |
Le robot traite les deux variantes | Les deux peuvent être crawlées ; un représentant est choisi | Préférence déclarée forte | Aucune redirection utilisateur | Variantes similaires et accessibles | Canonical vers une URL non pertinente ou bloquée |
Google suit généralement jusqu'à dix sauts de redirection, mais les liens internes en production doivent pointer directement vers l'URL finale. Une chaîne ajoute de la latence, des points de défaillance et un coût de maintenance.
Les soft 404
Une soft 404 se produit lorsque la réponse semble réussie mais que le contenu indique que la ressource est absente, ou offre trop peu de valeur pour être traitée comme une vraie page.
Schémas courants :
- un
200avec « produit introuvable » ; - une page de catégorie vide avec une navigation générique ;
- toutes les pages retirées redirigées vers la page d'accueil ;
- un routeur côté client affiche une erreur mais le serveur renvoie toujours
200; - une page localisée ne contient aucun contenu localisé.
Corrigez l'état, pas l'étiquette dans un outil. Restaurez un contenu substantiel, renvoyez le bon statut d'absence, ou redirigez vers une ressource vraiment équivalente.
Une procédure de réconciliation canonique
1. Définir le propriétaire canonique
Écrivez l'URL préférée exacte, la langue, l'audience, l'état du contenu, et la raison pour laquelle elle représente le cluster.
2. Inventorier chaque variante
Incluez les redirections, les paramètres, les protocoles alternatifs, les fichiers imprimables, les URL locales, les routes mobiles, les liens de campagne, et les anciens slugs.
3. Récupérer chaque réponse
Consignez :
- le statut de départ et final ;
- la chaîne de redirection ;
- les en-têtes ;
- le canonical source ;
- le canonical rendu ;
- les directives robots et d'index ;
- la similarité de contenu.
4. Cartographier les signaux de liens et de sitemap
Comptez les liens internes par cible. Examinez l'inclusion dans le sitemap, le hreflang, les données structurées, les flux, et la navigation.
5. Assigner un état visé
Chaque URL devrait être :
- propriétaire canonique ;
- doublon accessible avec canonical ;
- alternative redirigée ;
- utilitaire public non indexable ;
- manquante ;
- privée.
6. Supprimer les contradictions
Alignez la réponse, le canonical, les liens internes, le sitemap, et le hreflang. Ne combinez pas un canonical vers une page avec un noindex simplement pour « être sûr ».
7. Vérifier l'état sélectionné
Utilisez des échantillons d'inspection d'URL, le reporting d'index, les journaux, et les données de performance. Le canonical sélectionné par Google reflète les signaux traités, pas votre dernier fichier source instantanément.
8. Surveiller les régressions
Testez les templates, les règles de route, la génération de sitemap, et les données canoniques en intégration continue.
Exemple travaillé : un cluster de six URL pour une leçon
Le propriétaire visé est :
https://www.seoryon.com/academy/canonicals/
URL 1 : version HTTP
http://www.seoryon.com/academy/canonicals/
État souhaité : 301 ou 308 direct vers le propriétaire HTTPS. Supprimez tous les liens internes et références de sitemap en HTTP.
URL 2 : paramètre de campagne
https://www.seoryon.com/academy/canonicals/?utm_source=email
État souhaité : la page peut rester accessible, mais elle doit déclarer le canonical propre et ne jamais utiliser la forme trackée dans la navigation interne persistante ou dans le sitemap.
URL 3 : PDF imprimable
https://www.seoryon.com/academy/canonicals.pdf
La décision dépend de l'objectif. Si le PDF est un actif imprimable séparé et utile, gardez-le accessible et décidez s'il doit être indexé. Si la leçon HTML doit posséder la recherche, utilisez un canonical via l'en-tête HTTP Link pris en charge ou une politique X-Robots-Tag selon l'état visé. Ne placez pas de balisage HTML contradictoire dans un PDF.
URL 4 : leçon en français
https://www.seoryon.com/fr/academy/canoniques/
Ce n'est pas un doublon simplement parce qu'elle couvre le même sujet. S'il s'agit d'une véritable traduction française, utilisez son propre self-canonical et un hreflang réciproque avec la version anglaise. Ne mettez pas le français en canonical vers l'anglais tout en prétendant que les deux locales sont des alternatives équivalentes.
URL 5 : ancien slug abandonné
https://www.seoryon.com/academy/canonical-tags/
Si la nouvelle leçon est le remplacement direct, utilisez une redirection permanente vers le propriétaire canonique. Mettez à jour tous les liens internes.
URL 6 : soft 404 accidentelle
https://www.seoryon.com/academy/missing-lesson/
Le routeur renvoie 200 avec « leçon introuvable ». Changez la réponse serveur en 404, retirez-la des sitemaps, et assurez-vous que la page d'erreur aide toujours les utilisateurs à naviguer.
Pourquoi cela peut échouer
Le HTML peut être parfait alors qu'une règle de redirection CDN envoie les utilisateurs mobiles vers un hôte différent. Ou le générateur de sitemap peut réintroduire des URL avec paramètres. La canonicalisation est une propriété du système, pas une seule balise.
Le réconciliateur canonique SEOryon
Téléchargez le réconciliateur d'indexabilité et de signaux canoniques.
Pour chaque URL, consignez :
- l'état de réponse ;
- l'accès au crawl ;
- la directive d'index ;
- le canonical déclaré ;
- la cible des liens internes ;
- l'état du sitemap ;
- le propriétaire visé ;
- la classe de conflit ;
- l'action requise ;
- la source de vérification.
Utilisez quatre étiquettes de conflit :
- Invalide : la syntaxe ou l'état ne peut pas fonctionner comme prévu.
- Contradictoire : des signaux forts pointent vers des propriétaires différents.
- Faible : la direction est plausible mais incomplète.
- Acceptable : les signaux et l'état visé sont alignés.
Modes de défaillance
Canonical vers une URL bloquée
Le robot ne peut pas traiter le contenu cible de façon fiable. Gardez les propriétaires canoniques accessibles.
Canonical plus noindex sans raison documentée
L'un dit de consolider vers un autre représentant tandis que l'autre exclut cette page. Choisissez l'état réellement souhaité.
Rediriger chaque page supprimée vers l'accueil
La page d'accueil n'est pas un remplacement pour chaque ressource. Renvoyez une absence quand c'est approprié.
Chaînes et boucles
Faites pointer les liens directement vers l'URL finale et testez les règles de route avant la mise en production.
Redirections temporaires laissées indéfiniment
Vérifiez si le déplacement est toujours temporaire. Alignez le statut avec la propriété réelle.
Conflit entre hreflang et canonical
Chaque véritable version linguistique devrait normalement être self-canonical et référencer des alternatives équivalentes.
Exercice : diagnostiquer huit combinaisons
Classez chacune comme invalide, contradictoire, faible ou acceptable, puis choisissez un correctif.
200, index autorisé, self-canonical, liens internes et sitemap en accord.200,noindex, robots disallow.301vers B, alors que tous les liens internes pointent encore vers A.- Page à paramètre en
200avec canonical vers l'URL propre, l'URL propre est self-canonical. - Page « introuvable » en
200avec self-canonical et inclusion dans le sitemap. - Page française self-canonical, page anglaise self-canonical, hreflang réciproque.
302utilisé pour une migration permanente de deux ans.404page supprimée sans remplacement, retirée du sitemap et des liens.
Corrigé
- Acceptable.
- Contradictoire, car le blocage du crawl peut masquer le
noindex. Autorisez le crawl jusqu'à ce que la directive soit traitée, à moins qu'un autre état ne soit visé. - Faible et incohérent. Mettez à jour les liens vers B et retirez A du sitemap.
- Acceptable lorsque le contenu est équivalent et que les paramètres n'ont aucun objectif distinct.
- État visé invalide et risque de soft 404. Restaurez la page ou renvoyez
404. - Acceptable pour de véritables traductions équivalentes.
- Faible ou contradictoire par rapport à l'intention permanente. Utilisez une redirection permanente appropriée après avoir validé la migration.
- Acceptable.
Checklist finale
- Le propriétaire canonique est défini avant l'implémentation des balises.
- Chaque variante d'URL a un état visé.
- Les redirections sont directes et pointent vers des remplacements pertinents.
- Le statut permanent et temporaire correspond à la propriété réelle.
- Les pages manquantes renvoient
404ou410. - Les pages de contenu public ne renvoient pas d'erreurs
200trompeuses. - Les pages
noindexrestent crawlables jusqu'à ce que la directive soit traitée. - Les cibles canoniques sont accessibles et éligibles à l'index.
- Le canonical source et le canonical rendu concordent.
- Les liens internes pointent vers les URL finales canoniques.
- Les sitemaps ne contiennent que des URL publiques canoniques.
- Le hreflang et les signaux canoniques ne sont pas en conflit.
- L'inspection d'URL distingue canonical déclaré et canonical sélectionné.
- Les journaux et les données de performance surveillent le propriétaire résultant.
- Les tests de templates et de routage préviennent les régressions.
Questions fréquentes
Pourquoi Google a-t-il choisi un canonical différent ?
Google combine la similarité de contenu, les redirections, les déclarations canoniques, les liens internes, les sitemaps, la préférence de protocole, et d'autres signaux. Examinez l'ensemble du cluster plutôt que de répéter la même balise.
Un canonical redirige-t-il les utilisateurs ?
Non. Il communique un représentant préféré aux systèmes qui le prennent en charge. Utilisez une redirection HTTP lorsque les utilisateurs doivent aller ailleurs.
Le contenu dupliqué est-il une pénalité ?
Les URL dupliquées créent souvent des problèmes de clustering et de sélection plutôt qu'une pénalité manuelle. Les politiques anti-spam peuvent s'appliquer à une duplication manipulatrice à grande échelle, mais les doublons techniques ordinaires nécessitent une consolidation des signaux.
Le 410 est-il plus rapide que le 404 ?
Les deux représentent une absence. Ne promettez jamais un délai universel de suppression. Utilisez le statut qui décrit fidèlement la ressource.
Chaque page devrait-elle être self-canonical ?
Les self-canonicals sont une pratique de cohérence utile pour les pages canoniques indexables, mais ils ne remplacent pas des redirections, des liens, des sitemaps, ou des décisions de contenu corrects.
Sources et méthodologie
La recherche communautaire a montré que « Google a choisi un autre canonical », les anciennes structures d'URL, les doublons par paramètre, et les erreurs de canonical restent difficiles à expliquer en langage simple. Ces questions ont façonné l'exemple travaillé. Les conseils communautaires n'ont pas été utilisés comme autorité technique.
- Google Search Central, Consolider les URL en double, mis à jour le 10 juillet 2026 et vérifié le 28 juillet 2026. Recommandations officielles sur les signaux canoniques.
- Google Search Central, Bloquer l'indexation avec noindex, mis à jour le 10 décembre 2025 et vérifié le 28 juillet 2026. Exigences officielles sur les directives d'index.
- Google Search Central, Les redirections et Google Search, mis à jour le 14 avril 2026 et vérifié le 28 juillet 2026. Recommandations officielles sur les redirections permanentes et temporaires.
- Google Crawling Infrastructure, Codes de statut HTTP, mis à jour le 4 février 2026 et vérifié le 28 juillet 2026. Comportement officiel des réponses aux robots. Les délais restent non garantis.
Précédent : Explorabilité et découverte
Suite : SEO pour JavaScript et interfaces lisibles par des agents