Skip to content

Søkeroboter

Konsept innen AI-søk og SEO
Volatil, sist sjekket 2026-09-04 Denne siden inneholder målte tall som endrer seg raskt.Gjennomgått 2026-09-04

Søkeroboter henter sider i bulk for å bygge en indeks som en svar-motor henter fra ved spørringstidspunktet[1]. De er klassen en AI-svar vanligvis siterer: OpenAI kjører OAI-SearchBot for ChatGPTs søkefunksjoner[2], Anthropic kjører Claude-SearchBot[3], og Perplexity kjører PerplexityBot for å vise og lenke til nettsteder i resultatene sine[4]. Det som skiller dem fra en treningsskraper er hva som skjer med kopien: en indeks-oppføring kan hentes og lenkes tilbake, et treningskorpus absorberes i modellvekter, og de to kontrolleres av forskjellige robots.txt-tokens[5].

Separate tokens for indeks og trening

Google publiserer forskjellige robots.txt-tokens for de to jobbene. GoogleOther er den generiske søkeroboten produktteamene bruker for å hente offentlig tilgjengelig innhold[6], mens Google-Extended er et frittstående token som avgjør om skrapet innhold kan trene fremtidige Gemini-modeller[5]. Et nettsted kan forbli i indeksen og utenfor treningskorpuset. OpenAI dokumenterer den samme splitten, og kjører OAI-SearchBot for søk og et separat token for modelltrening[2]. Se treningsskrapere og robots.txt.

Håndtering av Robots.txt

Google opplyser at deres vanlige søkeroboter alltid respekterer robots.txt-regler for automatiske søk[7], og protokollen forutsetter nettopp det: en søkerobot leser filen og bestemmer hva den skal følge[1]. Lydighet i den bredere populasjonen er ujevn, og det ble ikke målt mesteparten av protokollens levetid: 2025-papiret som først testet det i stor skala, på anonymiserte institusjonelle weblogger, registrerer at bevisene før det var anekdotiske[8]. Denne studien, av 130 selvdeklarerte roboter over 40 dager, fant at overholdelse faller når et direktiv blir strengere, og at AI-søkeroboter ofte ikke ber om robots.txt i det hele tatt[9], så en Disallow-linje er en forespørsel snarere enn en kontroll.

Hva indeksering gir

Indeksmedlemskap er forutsetningen for sitering. OpenAI opplyser at et nettsted som er valgt bort fra OAI-SearchBot ikke vil vises i ChatGPT-søkesvar, selv om det fortsatt kan vises som en navigasjonslenke[2], Anthropic beskriver Claude-SearchBot som analyserende innhold for å forbedre relevansen av søkeresultater[3], og Perplexity ber webmastere om å tillate PerplexityBot slik at sider kan vises og lenkes[4]. Å blokkere søketokenet til en motor fjerner siden fra bassenget svarene trekkes fra, noe som er en annen beslutning enn å nekte trening. Se ChatGPT-søk, svarmotorer og AI-sitasjonskilder.

Volumer

Søkeroboter utgjør fortsatt den største andelen av automatisert henting. Cloudflare registrerte at Googlebot økte fra 30 % til 50 % av søkerobotanropene mellom mai 2024 og mai 2025[10], med GPTBot som gikk fra 2,2 % til 7,7 % på en 305 % økning i anrop[11]. I løpet av 2025 stammet Googlebot 4,5 % av HTML-anropene på Cloudflare-nettverket mot 4,2 % for alle andre AI-roboter kombinert[12]. Henting er et mindretall av erklært AI-robotformål: et leverandørpanel for søkeroboter for januar til juli 2026 satte søk eller svarhenting til 11,1 % av AI-robotanropene mot 46,5 % for trening[13]. Se Cloudflare og AI-søkeroboter.

Roboter i denne klassen

Baseline Labs robotregister (v1) sporer 33 av disse. Hver har sin egen oppføring med sin brukeragent, sitt robots.txt-token og hvordan den kan verifiseres.

Den komplette robotleksikonet viser alle klasser side om side.

Referanser (13)
  1. Web crawler - Wikipedia
    Journalistikk Hentet 2026-09-04
  2. Oversikt over OpenAI-søkeroboter - OpenAI utviklerdokumentasjon
    Dokumentasjon Hentet 2026-09-04
  3. Henter Anthropic data fra nettet, og hvordan kan nettstedseiere blokkere søkeroboten? - Claude support
    Dokumentasjon Hentet 2026-09-04
  4. PerplexityBot - Perplexity utviklerdokumentasjon
    Dokumentasjon Hentet 2026-09-04
  5. Googles vanlige søkeroboter - Google Search Central
    Dokumentasjon Hentet 2026-09-04
  6. Googles vanlige søkeroboter - Google Search Central
    Dokumentasjon Hentet 2026-09-04
  7. Oversikt over Googles søkeroboter og henting - Google Search Central
    Dokumentasjon Hentet 2026-09-04
  8. Skrapere respekterer selektivt robots.txt-direktiver: bevis fra en storskala empirisk studie
    Akademisk Publisert 2025-05-27 Hentet 2026-09-04
  9. Skrapere respekterer selektivt robots.txt-direktiver - arXiv 2505.21733 (ACM IMC 2025)
    Akademisk Publisert 2025-05-27 Hentet 2026-09-04
  10. Fra Googlebot til GPTBot: hvem søkeroboter nettstedet ditt i 2025 - Cloudflare Blog
    Leverandørdokumentasjon Publisert 2025-07-01 Hentet 2026-09-04 Volatil, sist sjekket 2026-09-04
  11. Fra Googlebot til GPTBot: hvem søkeroboter nettstedet ditt i 2025 - Cloudflare Blog
    Leverandørdokumentasjon Publisert 2025-07-01 Hentet 2026-09-04 Volatil, sist sjekket 2026-09-04
  12. Cloudflare Radar 2025 År i gjennomgang - Cloudflare Blog
    Leverandørdokumentasjon Hentet 2026-09-04 Volatil, sist sjekket 2026-09-04
  13. Forhold mellom søk og referanse: AI-søkeroboter og LLM-roboter - Seomator søkerobotpanel
    Leverandørdokumentasjon Publisert 2026-07-21 Hentet 2026-09-04 Enkeltkilde Volatil, sist sjekket 2026-09-04

Sist oppdatert 2026-09-04. Skrevet og vedlikeholdt av Baseline Labs.

George
Online
0%