Consultanță Gratuită →
SEO 365 — agenție SEO și AI Search

X-Robots-Tag

EN: X-Robots-TagSEO tehnic
Captură din Glosarul SEO 365 pentru X-Robots-Tag (SEO tehnic): X-Robots-Tag este un antet de răspuns HTTP care
X-Robots-Tag — ilustrație din Glosarul SEO 365 · SEO tehnic

Cunoscut și ca: antet X-Robots-Tag, antet HTTP X-Robots-Tag, X-Robots-Tag HTTP header, X-Robots-Tag header

Ce este X-Robots-Tag?

Pe scurt

X-Robots-Tag este un antet de răspuns HTTP care transmite crawlerelor reguli privind indexarea și afișarea unei resurse în rezultatele căutării. Poate fi folosit pentru pagini, imagini, fișiere PDF și alte documente non-HTML. Regulile sunt descoperite numai după ce robotul accesează resursa.

Cum funcționează X-Robots-Tag

X-Robots-Tag este un antet inclus în răspunsul HTTP al unui URL. El reprezintă o metodă de facto pentru comunicarea regulilor de indexare către motoare de căutare, crawlere și alți agenți automatizați. Nu face parte dintr-o specificație oficială, iar regulile sunt respectate doar de roboții cooperanți.

Antetul este util mai ales pentru resurse care nu au o secțiune HTML <head>, precum imaginile, documentele PDF și alte fișiere media. Pentru paginile HTML, reguli similare pot fi transmise prin elementul <meta name="robots">.

Sintaxa de bază este:

X-Robots-Tag: noindex

Mai multe directive pot fi separate prin virgulă. Regulile pot fi aplicate tuturor crawlerelor sau unui agent specific:

X-Robots-Tag: googlebot: noindex, nofollow

Directive uzuale

noindex solicită ca resursa să nu fie afișată în rezultatele căutării. nofollow solicită crawlerului să nu urmeze linkurile din resursă. none este echivalent cu noindex, nofollow. nosnippet împiedică afișarea unui fragment text sau a unei previzualizări video. noimageindex solicită ca imaginile paginii să nu fie indexate.

Alte directive pot limita previzualizările text, video sau imagine, pot împiedica oferirea unei traduceri ori pot solicita eliminarea resursei din rezultate după o dată specificată.

Relația cu robots.txt

Crawlerul trebuie să acceseze URL-ul pentru a descoperi antetul. Dacă resursa este blocată în robots.txt, regula X-Robots-Tag nu poate fi citită și va fi ignorată. Pentru eliminarea din index, URL-ul trebuie să poată fi recrawlat, astfel încât regula noindex să poată fi detectată.

Dacă X-Robots-Tag și meta robots conțin reguli conflictuale, se aplică regula mai restrictivă. Directivele reciproc incompatibile pot produce un comportament nedefinit, diferit între crawlere.

De ce contează în SEO?

X-Robots-Tag contează în SEO tehnic deoarece permite administrarea indexării și a modului de afișare pentru pagini și fișiere non-HTML. Este potrivit, de exemplu, când un document PDF trebuie să rămână accesibil utilizatorilor, dar nu trebuie afișat în rezultatele căutării. Poate limita și fragmentele text, previzualizările video sau imaginile prezentate în rezultate.

O configurare greșită poate exclude o resursă relevantă prin noindex, poate opri urmărirea linkurilor prin nofollow sau poate elimina fragmentele prin nosnippet, în cazul crawlerelor care respectă aceste reguli. Efectul poate apărea numai după ce un crawler accesează din nou URL-ul și citește răspunsul HTTP. Blocarea simultană prin robots.txt împiedică descoperirea regulii.

Efectul asupra oricărui sistem automatizat trebuie evaluat în funcție de crawlerul folosit. X-Robots-Tag influențează un astfel de sistem numai dacă agentul său poate accesa resursa și respectă directiva transmisă. Nu trebuie presupus că toate serviciile interpretează identic fiecare regulă.

Directivele care limitează indexarea sau fragmentele pot reduce posibilitatea ca resursa să fie prezentată de sistemele care le respectă. În sens invers, eliminarea unei restricții nu garantează includerea resursei în rezultate sau în alte forme de prezentare. X-Robots-Tag comunică reguli privind indexarea și prezentarea resursei, fără să garanteze vizibilitatea acesteia.

Exemplu

Un magazin online din România publică pe site fișe tehnice PDF. Documentele trebuie să poată fi descărcate de utilizatori, dar proprietarul nu dorește afișarea lor separată în rezultatele căutării.

Serverul poate returna pentru fișierele PDF:

HTTP/1.1 200 OK
Content-Type: application/pdf
X-Robots-Tag: noindex

Crawlerelor cooperante li se solicită astfel să nu afișeze documentul PDF în rezultatele căutării. Fișierul trebuie să rămână accesibil crawlerului pentru ca antetul să fie citit. Dacă URL-ul PDF este blocat prin robots.txt, regula noindex nu va fi descoperită.

Cum verifici?

  1. Deschide URL-ul în Google Chrome și accesează instrumentele pentru dezvoltatori.
  2. Selectează fila Network și reîncarcă resursa.
  3. Alege solicitarea corespunzătoare și verifică secțiunea cu antetele răspunsului.
  4. Caută antetul X-Robots-Tag și notează directivele, agentul vizat și eventualele antete repetate.
  5. Verifică și meta robots pentru paginile HTML. Dacă există reguli conflictuale, identifică regula mai restrictivă.
  6. Controlează fișierul robots.txt. URL-ul trebuie să poată fi accesat de crawler pentru ca X-Robots-Tag să fie citit.
  7. Opțional, Ahrefs SEO Toolbar poate afișa X-Robots-Tag în secțiunea proprie Indexability. Aceasta este o verificare oferită de unealtă, nu o confirmare a modului în care Google aplică directiva.

Ce trebuie să faci?

  1. Folosește X-Robots-Tag când trebuie să transmiți reguli pentru PDF-uri, imagini sau alte resurse non-HTML.
  2. Alege directiva conform rezultatului urmărit: noindex pentru excluderea din rezultate, nofollow pentru neurmărirea linkurilor sau nosnippet pentru eliminarea fragmentului.
  3. Specifică numele crawlerului numai dacă regula trebuie aplicată unui anumit agent.
  4. Păstrează URL-ul accesibil crawlerului atunci când vrei ca o regulă noindex să fie descoperită.
  5. Verifică răspunsul HTTP efectiv, nu doar configurația serverului.
  6. Elimină directivele incompatibile și verifică împreună configurațiile X-Robots-Tag, meta robots și robots.txt.

Greșeli frecvente

  • Blocarea URL-ului în robots.txt și așteptarea ca robotul să citească directiva X-Robots-Tag: noindex.
  • Căutarea antetului X-Robots-Tag în codul HTML, deși acesta face parte din răspunsul HTTP.
  • Folosirea simultană a unor directive reciproc incompatibile, precum index și noindex.
  • Aplicarea accidentală a noindex tuturor fișierelor care corespund unei reguli globale de server.
  • Presupunerea că orice robot sau sistem automatizat va respecta toate directivele X-Robots-Tag.

Perspectiva SEO 365

Verificăm răspunsul HTTP real înainte de orice schimbare la nivel de indexare. Urmărim ca X-Robots-Tag, meta robots și robots.txt să fie configurate astfel încât crawlerul să poată accesa și citi regula dorită. Evităm aplicarea globală a directivei noindex fără verificarea resurselor afectate.

Întrebări frecvente despre X-Robots-Tag

Deschide instrumentele pentru dezvoltatori ale browserului, accesează fila Network, reîncarcă URL-ul și selectează răspunsul corespunzător. În secțiunea Response Headers, caută X-Robots-Tag și verifică directivele, crawlerul vizat și eventualele antete repetate. Pentru o verificare rapidă din linia de comandă, poți inspecta antetele HTTP folosind o solicitare de tip HEAD.

Surse și documentație

Conținut educațional din partea echipei SEO 365, pentru a clarifica terminologia și a ajuta la înțelegerea conceptelor din optimizarea pentru motoarele de căutare. · Ultima verificare a surselor: