Søkeroboter
Søkeroboter henter sider i bulk for å bygge en indeks som en svar-motor henter fra ved spørringstidspunktet[1]. De er klassen en AI-svar vanligvis siterer: OpenAI kjører OAI-SearchBot for ChatGPTs søkefunksjoner[2], Anthropic kjører Claude-SearchBot[3], og Perplexity kjører PerplexityBot for å vise og lenke til nettsteder i resultatene sine[4]. Det som skiller dem fra en treningsskraper er hva som skjer med kopien: en indeks-oppføring kan hentes og lenkes tilbake, et treningskorpus absorberes i modellvekter, og de to kontrolleres av forskjellige robots.txt-tokens[5].
Separate tokens for indeks og trening
Google publiserer forskjellige robots.txt-tokens for de to jobbene. GoogleOther er den generiske søkeroboten produktteamene bruker for å hente offentlig tilgjengelig innhold[6], mens Google-Extended er et frittstående token som avgjør om skrapet innhold kan trene fremtidige Gemini-modeller[5]. Et nettsted kan forbli i indeksen og utenfor treningskorpuset. OpenAI dokumenterer den samme splitten, og kjører OAI-SearchBot for søk og et separat token for modelltrening[2]. Se treningsskrapere og robots.txt.
Håndtering av Robots.txt
Google opplyser at deres vanlige søkeroboter alltid respekterer robots.txt-regler for automatiske søk[7], og protokollen forutsetter nettopp det: en søkerobot leser filen og bestemmer hva den skal følge[1]. Lydighet i den bredere populasjonen er ujevn, og det ble ikke målt mesteparten av protokollens levetid: 2025-papiret som først testet det i stor skala, på anonymiserte institusjonelle weblogger, registrerer at bevisene før det var anekdotiske[8]. Denne studien, av 130 selvdeklarerte roboter over 40 dager, fant at overholdelse faller når et direktiv blir strengere, og at AI-søkeroboter ofte ikke ber om robots.txt i det hele tatt[9], så en Disallow-linje er en forespørsel snarere enn en kontroll.
Hva indeksering gir
Indeksmedlemskap er forutsetningen for sitering. OpenAI opplyser at et nettsted som er valgt bort fra OAI-SearchBot ikke vil vises i ChatGPT-søkesvar, selv om det fortsatt kan vises som en navigasjonslenke[2], Anthropic beskriver Claude-SearchBot som analyserende innhold for å forbedre relevansen av søkeresultater[3], og Perplexity ber webmastere om å tillate PerplexityBot slik at sider kan vises og lenkes[4]. Å blokkere søketokenet til en motor fjerner siden fra bassenget svarene trekkes fra, noe som er en annen beslutning enn å nekte trening. Se ChatGPT-søk, svarmotorer og AI-sitasjonskilder.
Volumer
Søkeroboter utgjør fortsatt den største andelen av automatisert henting. Cloudflare registrerte at Googlebot økte fra 30 % til 50 % av søkerobotanropene mellom mai 2024 og mai 2025[10], med GPTBot som gikk fra 2,2 % til 7,7 % på en 305 % økning i anrop[11]. I løpet av 2025 stammet Googlebot 4,5 % av HTML-anropene på Cloudflare-nettverket mot 4,2 % for alle andre AI-roboter kombinert[12]. Henting er et mindretall av erklært AI-robotformål: et leverandørpanel for søkeroboter for januar til juli 2026 satte søk eller svarhenting til 11,1 % av AI-robotanropene mot 46,5 % for trening[13]. Se Cloudflare og AI-søkeroboter.
Roboter i denne klassen
Baseline Labs robotregister (v1) sporer 33 av disse. Hver har sin egen oppføring med sin brukeragent, sitt robots.txt-token og hvordan den kan verifiseres.
- AddSearchBotAddSearch
- AIWebIndexLyrenth
- amazon-kendraAmazon
- AmazonbotAmazon
- Amzn-SearchBotAmazon
- AndibotAndi
- AnomuraDireqt
- ApplebotApple
- Aranet-SearchBotUkjent
- atlassian-botAtlassian
- AzureAI-SearchBotMicrosoft
- BravebotBrave
- Channel3BotUkjent
- Claude-SearchBotAnthropic
- Cloudflare-AutoRAGCloudflare
- ExaBotExa
- GoogleOtherGoogle
- GoogleOther-ImageGoogle
- GoogleOther-VideoGoogle
- GrokBotxAI
- iAskBotiAsk
- iaskspideriAsk
- LinkupBotLinkup
- meta-webindexerMeta
- OAI-SearchBotOpenAI
- PerplexityBotPerplexity
- PetalBotHuawei
- Querit-SearchBotQuerit
- QueritBotQuerit
- TavilyBotTavily
- TimpibotTimpi
- YouBotYou.com
- ZanistaBotUkjent
Den komplette robotleksikonet viser alle klasser side om side.
Referanser (13)
- Web crawler - Wikipedia
- Oversikt over OpenAI-søkeroboter - OpenAI utviklerdokumentasjon
- Henter Anthropic data fra nettet, og hvordan kan nettstedseiere blokkere søkeroboten? - Claude support
- PerplexityBot - Perplexity utviklerdokumentasjon
- Googles vanlige søkeroboter - Google Search Central
- Googles vanlige søkeroboter - Google Search Central
- Oversikt over Googles søkeroboter og henting - Google Search Central
- Skrapere respekterer selektivt robots.txt-direktiver: bevis fra en storskala empirisk studie
- Skrapere respekterer selektivt robots.txt-direktiver - arXiv 2505.21733 (ACM IMC 2025)
- Fra Googlebot til GPTBot: hvem søkeroboter nettstedet ditt i 2025 - Cloudflare Blog
- Fra Googlebot til GPTBot: hvem søkeroboter nettstedet ditt i 2025 - Cloudflare Blog
- Cloudflare Radar 2025 År i gjennomgang - Cloudflare Blog
- Forhold mellom søk og referanse: AI-søkeroboter og LLM-roboter - Seomator søkerobotpanel
Sist oppdatert 2026-09-04. Skrevet og vedlikeholdt av Baseline Labs.