Ordliste
robots.txt
robots.txt er en tekstfil i rotmappen på et nettsted som styrer hvilke roboter som får lov til å lese hvilke deler av siden. Den bør eksplisitt tillate anerkjente søkemotor- og AI-crawlere — som Googlebot, GPTBot, ClaudeBot og PerplexityBot — og kun blokkere teknisk nødvendige mapper som `/api/` eller `/admin/`.
Hvordan filen fungerer
Når en robot besøker et nettsted, sjekker den først /robots.txt for å se hvilke deler av siden den har lov til å lese. Filen består av regler som User-agent (hvilken robot regelen gjelder for) og Disallow/Allow (hvilke stier som er sperret eller åpne). Én feilplassert linje — for eksempel en Disallow: / som ble liggende igjen fra en test- eller utviklingsversjon — kan blokkere hele siden fra Google, ofte uten at noen merker det før trafikken stuper måneder senere.
Hvorfor eksplisitt tillatelse er noe annet enn stillhet
De fleste robots.txt-filer sier ingenting om AI-crawlere, og lar dem dermed passere som standard. Å aktivt liste dem opp — GPTBot, ChatGPT-User, ClaudeBot, Claude-User, PerplexityBot, Google-Extended og de andre — er noe annet: det er et bevisst signal om at nettstedet ønsker å bli lest og sitert av AI-modeller, ikke bare tillater det i mangel av et forbud.
Hva som normalt bør blokkeres
Kun mapper som ikke har noe innhold søkemotorer skal indeksere: /api/, /_next/, /admin/ eller tilsvarende. Alt annet — tjenestesider, FAQ, artikler, ordliste — bør være åpent. Filen bør gjennomgås jevnlig, siden nye AI-crawlere og agent-user-agenter dukker opp med jevne mellomrom, og bør tillates som standard fremfor å oppdages for sent. Se teknisk SEO for hvordan robots.txt henger sammen med resten av den tekniske grunnmuren.
Få et fastpristilbud.
Fortell kort hva du trenger, så kommer vi tilbake med en fast pris og en konkret tidslinje.
Svar innen én arbeidsdag.