La balise canonique (rel="canonical") indique à Google quelle est la version principale d'une page lorsque des URL similaires ou dupliquées existent, évitant les pénalités pour contenu dupliqué.
La balise canonique est un élément HTML (<link rel="canonical" href="URL"/>) placé dans le <head> de la page qui signale à Google qu'il s'agit de la version « préférée » ou « canonique » du contenu. Elle est essentielle lorsque le même contenu apparaît sur des URL différentes (avec et sans www, avec des paramètres d'URL, http vs https, avec/sans slash final). Chaque page devrait avoir une canonique pointant vers elle-même (self-referencing canonical) ou vers la version principale.
Sans canonique, Google peut décider seul quelle version de votre page est l'« originale » — et se tromper. Un contenu dupliqué non résolu peut diluer l'autorité de classement entre les versions et entraîner une pénalité. Google confirme qu'une canonicalisation correcte est essentielle pour une indexation efficace.
Source : Google Search Central — CanonicalLe SEO technique englobe les optimisations de l'infrastructure de votre site — crawlabilité, indexation, vitesse de chargement, HTTPS et structure des données — qui permettent à Google de trouver et comprendre vos pages.
Le robots.txt est un fichier texte placé à la racine du site qui indique aux crawlers (Google, Bing, GPTBot) quelles pages ils peuvent ou non explorer et indexer.
Un sitemap XML est un fichier qui liste toutes les URL importantes de votre site, aidant Google à les découvrir et à les indexer plus vite et plus complètement.
La crawlabilité est la capacité des robots de Google à accéder, naviguer et lire les pages de votre site — une condition préalable essentielle à l'indexation et au classement.
Découvrez comment appliquer ce concept à votre secteur et votre ville.