Kort svar: Et XML-sitemap er en liste over de sider, du gerne vil have crawlet. Det hjælper især nye og dybt placerede sider med at blive fundet. Ahorizon leder efter filen på standardadressen og kræver, at den kan læses som gyldig XML med urlset eller sitemapindex.
Hvad Ahorizon måler
Kontrollen indgår i ét af tjekkene. Tærsklerne nedenfor er dem, motoren faktisk regner med.
| Tjek | Hvad motoren ser på | Hvornår kontrollen består |
|---|---|---|
| SEO-tjekXML-sitemap kan findes | Om der findes et sitemap på standardadressen, og om indholdet indeholder et urlset- eller sitemapindex-element. | Fuld score kræver begge dele. En fil, der findes men ikke kan læses som XML, giver nul på lige fod med en manglende fil. |
Sådan ser det ud i koden
En HTML-side kaldt sitemap.xml består ikke tjekket. Indholdet skal være XML, ikke en oversigtsside for mennesker.
<!doctype html>
<html><body><h1>Sitemap</h1><ul>…</ul></body></html><?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url><loc>https://eksempel.dk/ydelser</loc></url>
</urlset>Hvad fundet betyder
- Nye sider og sider dybt i strukturen bliver opdaget langsommere uden et sitemap.
- Sitemappet er også dit signal om, hvilke URL-varianter du foretrækker.
- Et sitemap med gamle, viderestillede eller noindex-sider sender modstridende signaler.
Sådan retter du det
- Udgiv sitemappet på en fast adresse, og henvis til den fra robots.txt.
- Medtag kun canonical-URL'er, der svarer 200 og må indekseres.
- Lad sitemappet genereres automatisk, så det ikke forældes.
- Indsend adressen i Search Console, og hold øje med hvad der bliver afvist.
Det kan tjekket ikke afgøre
- Et sitemap er en anbefaling om at crawle, ikke en garanti for at indeksere. Google afgør selv, hvad der kommer med.
- Motoren kontrollerer, at filen findes og kan læses som XML. Den validerer ikke hver enkelt URL i den.
- Et website med god intern linkning klarer sig fint uden sitemap. Fundet er en mulighed, ikke en fejl.