Robots.txt este un fișier text plasat la rădăcina site-ului care indică crawlerilor (Google, Bing, GPTBot) ce pagini pot sau nu pot accesa și indexa.
Fișierul robots.txt se află la adresa yourdomain.com/robots.txt și conține instrucțiuni pentru roboții web (crawleri). Folosind directivele „User-agent" (identifică crawlerul) și „Disallow" sau „Allow" (specifică ce poate accesa), poți controla care secțiuni ale site-ului sunt accesibile. Important: robots.txt nu garantează că Google nu va indexa paginile blocate dacă există linkuri spre ele — folosește „noindex" pentru a preveni indexarea efectivă. Google recomandă să permiți accesul GPTBot și ClaudeBot pentru a beneficia de vizibilitate în AI.
Un robots.txt configurat greșit poate bloca accidental indexarea întregului site sau a unor secțiuni importante. Este una din primele verificări în orice audit SEO tehnic. Totodată, permițând explicit crawlerele AI (GPTBot, ClaudeBot, PerplexityBot) crești șansele de a fi citat în răspunsurile AI.
Sursă: Google Search Central — Robots.txtSEO tehnic cuprinde optimizările infrastructurii site-ului: crawlabilitate, indexare, viteză de încărcare, HTTPS și structură clară a datelor.
Crawlabilitate este capacitatea unui site de a fi accesat și explorat de Googlebot; site-ul trebuie să fie rapid și structurat clar pentru un crawling bun.
Tag-ul canonical (rel="canonical") îi spune Google care e versiunea principală a unei pagini când există URL-uri duplicate, prevenind penalizările.
Sitemap XML este un fișier care listează toate paginile importante ale site-ului, ajutând Googlebot să le descopere și să le indexeze mai ușor.
Explorează cum aplici acest concept pe industria și orașul tău.
