Kort svar: Indekset opdateres først, når Google crawler siden igen, og det kan tage uger. Den hyppigste fejl er at blokere adressen i robots.txt: så kan crawleren ikke hente siden og dermed heller ikke se, at den er væk eller sat til noindex.
Hvad kan det skyldes?
robots.txt blokerer den side, du vil have fjernet
Det er den klassiske selvmodsigelse. En blokeret adresse bliver ikke hentet, og så ser Google hverken 404-koden eller noindex-direktivet. Siden kan blive i resultatet uden uddrag.
Siden svarer stadig 200
En “side findes ikke”-tekst med statuskode 200 er en soft 404. For Google findes siden stadig. Den skal svare 404 eller 410, eller viderestille permanent.
Google har ikke crawlet adressen endnu
Fjernelsesværktøjet i Search Console skjuler resultatet i omkring seks måneder. Det er en midlertidig foranstaltning, ikke en sletning.
Sådan finder du ud af det
- Fjern blokeringen i robots.txt, så Google kan hente adressen og se, hvad der er sket.
- Lad siden svare 410, hvis indholdet er væk for altid, eller 301 til det, der erstattede det.
- Brug fjernelsesværktøjet som en midlertidig hastefiks, ikke som løsningen.
- Fjern adressen fra sitemappet.
- Kontrollér resultatet med URL-inspektion efter et par uger.
Det kan hverken vi eller et tjek afgøre
- Fjernelse fra Google er ikke fjernelse fra internettet. Andre tjenester og arkiver har deres egne kopier.
- Fjernelsesværktøjet skjuler midlertidigt. Efter perioden kommer siden igen, hvis den stadig svarer.
- Et automatisk tjek kan se robots.txt og statuskoder. Det kan ikke se, hvad der ligger i Googles indeks.
Kontrollerne bag svaret
- Hvad skal der stå i robots.txt? — Filen på domænets rod, der styrer hvad crawlere må hente — og kan spærre alt.
- Hvad betyder noindex, og hvorfor er min side ikke i Google? — Direktivet der holder siden helt ude af søgeresultater — også fra HTTP-headeren.
- Hvad er et XML-sitemap, og skal du have et? — Listen over de sider, du gerne vil have crawlet.