La balise canonique (rel="canonical") indique à Google la version principale d'une page quand des URL similaires ou dupliquées existent, évitant les pénalités.
La balise canonique est un élément HTML (<link rel="canonical" href="URL"/>) placé dans le <head> de la page qui signale à Google qu'il s'agit de la version « préférée » ou « canonique » du contenu. Elle est essentielle lorsque le même contenu apparaît sur des URL différentes (avec et sans www, avec des paramètres d'URL, http vs https, avec/sans slash final). Chaque page devrait avoir une canonique pointant vers elle-même (self-referencing canonical) ou vers la version principale.
Sans canonique, Google peut décider seul quelle version de votre page est l'« originale » — et se tromper. Un contenu dupliqué non résolu peut diluer l'autorité de classement entre les versions et entraîner une pénalité. Google confirme qu'une canonicalisation correcte est essentielle pour une indexation efficace.
Source : Google Search Central — CanonicalLe SEO technique regroupe les optimisations de l'infrastructure du site — crawlabilité, indexation, vitesse, HTTPS et structure des données — pour aider Google.
Le robots.txt est un fichier texte à la racine du site qui indique aux crawlers (Google, Bing, GPTBot) quelles pages explorer et indexer ou non.
Un sitemap XML est un fichier qui liste toutes les URL importantes de votre site, aidant Google à les découvrir et à les indexer plus vite et plus complètement.
La crawlabilité est la capacité des robots de Google à accéder, parcourir et lire les pages de votre site — condition préalable à l'indexation et au classement.
Découvrez comment appliquer ce concept à votre secteur et votre ville.
