Indexerbarhetskontroll

Kontrollera Indexerbarhet
Nästa

En sida kan vara helt bra men osynlig för sök eftersom en enda tagg säger “noindex” eller robots.txt blockerar sökroboten. Klistra in en URL så utvärderar den här kontrollen varje signal Google använder, robots.txt, meta robots, X-Robots-Tag-huvud, kanoniskt mål, HTTP-status, och talar om för dig om sidan är indexerbar, varför, och vad du ska ändra om inte.

Så kontrollerar du indexerbarhet

  1. 1

    Ange en URL

    Kontrollen hämtar URL:en som Googlebot skulle göra.

  2. 2

    Den löser omdirigeringar

    En kedja av 301/302-hopp spåras; den slutliga URL:en är den som utvärderas.

  3. 3

    Den läser varje indexerbarhetssignal

    robots.txt-regler, meta robots, X-Robots-Tag, kanonisk, statuskod.

  4. 4

    Utlåtande och orsak

    Indexerbar / inte indexerbar / delvis, med den exakta signal som orsakade utlåtandet.

Indexerbarhetssignaler och deras prioritetsordning

Google utvärderar en uppsättning signaler i en specifik ordning; en enda negativ i kedjan räcker för att blockera indexering.

Ordning för signalutvärdering

  1. HTTP-status: 2xx krävs. 3xx-kedjor följs; 4xx och 5xx avslutar indexering.
  2. robots.txt: om URL:en är förbjuden för Googlebot crawlas sidan aldrig, vilket betyder att noindex-taggar på den aldrig syns.
  3. X-Robots-Tag-huvud: noindex i HTTP-svarshuvudena blockerar indexering.
  4. Meta robots: <meta name="robots" content="noindex"> blockerar indexering.
  5. Kanonisk: en kanonisk som pekar någon annanstans betyder att Google indexerar den andra URL:en i stället.
  6. Innehållskvalitet och dubblettidentifiering: Google kan hoppa över indexering även utan uttryckliga direktiv.

Vanliga misstag detta fångar

Problem Orsak
Hela avsnittet inte indexerat Disallow:-regel i robots.txt
Specifik sida inte indexerad noindex i meta robots
Indexerad med fel URL Kanonisk pekar någon annanstans
Fast på 5xx Serverfel bryter crawl
Konflikt mellan Disallow + noindex Robots.txt blockerar crawl, noindex-tagg aldrig läst
Staging läcker till produktion X-Robots-Tag: noindex kvarlämnad från en testmiljö

Fällan robots.txt + noindex

Om du Disallow:-ar en URL i robots.txt crawlar Google den aldrig, så den ser aldrig någon noindex-tagg. URL:en kan ändå dyka upp i sökresultaten som en “tom” post med bara URL:en och ingen beskrivning. För att ta bort en URL från indexet korrekt, tillåt crawling och använd noindex, blockera sedan crawling först efter att Google har avindexerat den.

Testning ur Googlebots perspektiv

Kontrollen skickar Googlebot-användaragenten så att alla serversidiga “endast sökrobotar ser X”-trick är synliga. Verifiera alltid produktions-URL:er, inte staging.

Vanliga frågor

Att vara indexerbar betyder bara att det inte finns någon teknisk blockering; det garanterar inte indexering. Google bestämmer också utifrån upplevd kvalitet, dubblettinnehåll och crawlbudget. Använd Search Consoles URL-inspektion för ett definitivt svar från Google självt.

Oftast är bara meta robots (eller X-Robots-Tag) rätt svar. Robots.txt blockerar crawling; meta robots blockerar indexering. För sidor du inte vill ha indexerade, tillåt crawling så att Google kan läsa din noindex-tagg.

Google utvärderar slutdestinationen för en omdirigeringskedja. En 301 från A till B betyder att Google i slutändan indexerar B, inte A. Kontrollen simulerar detta genom att lösa alla omdirigeringar innan utvärdering.

Nej. Sidor som kräver autentisering är per definition inte indexerbara. Om du behöver SEO för dem, överväg en publik förhandsversion.

Relaterade verktyg

Verktyget finns på andra språk