Tag-ul canonical (rel="canonical") indică Google care este versiunea principală a unei pagini atunci când există URL-uri similare sau duplicate, prevenind penalizările pentru conținut duplicat.
Tag-ul canonical este un element HTML (<link rel="canonical" href="URL"/>) plasat în secțiunea <head> a paginii care semnalează Google că aceasta este versiunea „preferată" sau „canonică" a conținutului. Este esențial când același conținut apare la URL-uri diferite (cu și fără www, cu parametri de URL, http vs https, cu/fără slash final). Fiecare pagină ar trebui să aibă un canonical care să pointeze spre ea însăși (self-referencing canonical) sau spre versiunea principală.
Fără canonical, Google poate decide singur care versiune a paginii tale e „originală" — și poate alege greșit. Conținutul duplicat nerezolvat poate dilua autoritatea de ranking între versiuni și poate duce la penalizare. Google confirmă că canonicalizarea corectă e esențială pentru indexare eficientă.
Sursă: Google Search Central — CanonicalSEO tehnic cuprinde optimizările infrastructurii site-ului — crawlabilitate, indexare, viteza de încărcare, HTTPS și structura datelor — care permit Google să găsească și să înțeleagă paginile tale.
Robots.txt este un fișier text din rădăcina site-ului care spune web crawlers (inclusiv Googlebot) ce pagini pot accesa și ce trebuie să evite.
Sitemap XML este un fișier pe site-ul tău care listează toate paginile importante pentru a le ușura Googlebot accesul și indexarea. Nu e indexabil de utilizatori, doar pentru motoare de căutare.
Crawlabilitate este capacitatea unui site de a fi accesat și explorat de Googlebot (web crawler-ul Google). Site-ul trebuie să fie accessible, rapid și structurat clar pentru maxim crawling.
Explorează cum aplici acest concept pe industria și orașul tău.