Om Robots.txt
Hvad er en robots.txt-fil?
Robots.txt er en almindelig tekstfil i roden af et domæne, som fortæller automatiserede besøgende, hvilke dele af webstedet de må anmode om. Det er det første, de fleste crawlere anmoder om, før en side, og den ældste konvention på nettet til at angive, hvad en maskine skal holde sig fra.
Den styrer crawling, ikke indeksering, og den forskel forvirrer konstant folk. Blokering af en URL forhindrer en crawler i at hente den; det holder ikke pålideligt URL’en ude af søgeresultaterne, fordi en side kan blive indekseret på baggrund af links, der peger på den, uden at den nogensinde er blevet læst.
Det kan betale sig at køre en kontrol af robots.txt-filen, fordi et enkelt fejlplaceret tegn ændrer betydningen af hele filen, uden at noget på webstedet indikerer et problem, før trafikken forsvinder.
Er robots.txt stadig relevant i 2026?
Den traditionelle funktion er uændret: at holde crawlere ude af administrationsstier, interne søgeresultater, facetteret navigation og de endeløse kombinationer af parametre, som ellers ville bruge crawlbudget på sider, som ingen bør lande på.
Dens nyere opgave er større. Filen er blevet det sted, hvor webstedsejere beslutter, hvilke AI-crawlere der overhovedet må få adgang til deres indhold – et spørgsmål, som de fleste aldrig tidligere havde behøvet at tage stilling til. Alle større AI-virksomheder driver nu en navngiven crawler, og de fleste respekterer filen.
Det gør den til en af de få filer på et websted, der virkelig kan få konsekvenser, og til en fil, der er værd at gennemgå bevidst i stedet for blot at acceptere den version, som platformen leverede som standard.
Hvordan robots.txt hænger sammen med AI-søgning
Du står over for et reelt valg, og der findes ikke ét universelt korrekt svar. Hvis du blokerer AI-crawlere, beskytter du dit indhold mod at blive brugt som trænings- eller svarmateriale. Det fjerner også enhver mulighed for at blive citeret i de svar, som en voksende andel af mennesker nu stoler på.
De to effekter er ikke symmetriske. Blokering er næsten absolut, mens det er usikkert, om du bliver citeret, så valget afhænger af, om dit indhold er produktet eller markedsføringen af det.
En udgiver, der sælger abonnementer, kan med rimelighed blokere adgangen, mens en virksomhed, hvis sider er oprettet for at blive fundet, som regel ikke vil gøre det. Det afgørende er, at filen angiver det, du faktisk har til hensigt.
Bedste praksis for robots.txt
- Placer filen i domænets rodmappe. Hvis den placeres et andet sted, ignoreres den fuldstændigt.
- Brug den aldrig til at skjule følsomt indhold. Filen er offentlig, og ved at læse den kan man hurtigst finde de stier, du ønskede at skjule.
- Brug en noindex-direktiv i stedet for en crawl-blokering, når målet er at holde en side ude af søgeresultaterne.
- Kombinér ikke de to på den samme side. En blokeret side kan aldrig læses, så dens noindex-direktiv bliver aldrig set.
- Referér til dit XML-sitemap i filen, så crawlere kan finde det uden at få det oplyst separat.
- Giv underdomæner deres egen fil; en regel på hoveddomænet gælder ikke for dem.
Almindelige fejl
- At lade en regel fra udviklingsfasen, der blokerer hele webstedet, blive stående efter lanceringen er den mest skadelige version af denne fejl.
- At blokere CSS eller JavaScript, hvilket forhindrer søgemaskiner i at gengive siden, som en besøgende ser den.
- At antage, at en blokeret URL fjernes fra søgeresultaterne, selv om den stadig kan være vist uden en beskrivelse.
- At skrive regler for en user agent-streng, der ikke findes, så intet bliver påvirket.
- Blokerer crawl-stier, som dit eget sitemap derefter indsender, og sender modstridende instruktioner.
Hvad dette værktøj kontrollerer
robots.txt-kontrollen henter filen fra domænets rod og rapporterer, om der findes en.
Den bekræfter, at filen eksisterer, i stedet for at evaluere reglerne, så en fil, der ved et uheld blokerer hele dit website, består kontrollen på præcis samme måde som en korrekt fil. Det er vigtigt at læse, hvad den faktisk siger, og det tager omkring et minut.
Hvad kan du gøre som det næste