Sökkrypare
Sökkrypare hämtar sidor i bulk för att bygga ett index som en svarsmotor hämtar från vid frågetidpunkten[1]. De är den klass en AI-svar vanligtvis citerar: OpenAI kör OAI-SearchBot för ChatGPT:s sökfunktioner[2], Anthropic kör Claude-SearchBot[3], och Perplexity kör PerplexityBot för att visa och länka webbplatser i sina resultat[4]. Det som skiljer dem från en träningsskrapa är vad som händer med kopian: en indexpost kan hämtas och länkas tillbaka, en träningskorpus absorberas i modellvikter, och de två styrs av olika robots.txt-tokens[5].
Separata tokens för index och träning
Google publicerar olika robots.txt-tokens för de två jobben. GoogleOther är den generiska kryparen som dess produktteam använder för att hämta offentligt tillgängligt innehåll[6], medan Google-Extended är en fristående token som avgör om krypat innehåll får träna framtida Gemini-modeller[5]. En webbplats kan stanna i indexet och utanför träningskorpusen. OpenAI dokumenterar samma uppdelning, kör OAI-SearchBot för sökning och en separat token för modellträning[2]. Se träningsskrapor och robots.txt.
Robots.txt-hantering
Google anger att dess vanliga krypare alltid respekterar robots.txt-regler för automatiska krypningar[7], och protokollet förutsätter just det: en krypare läser filen och bestämmer vad den ska följa[1]. Lydnaden bland den bredare populationen är ojämn, och den mättes inte under större delen av protokollets livstid: 2025 års rapport som först testade det i stor skala, på anonymiserade institutionella webbloggar, konstaterar att bevisen före den var anekdotiska[8]. Den studien, av 130 självdeklarerade botar under 40 dagar, fann att efterlevnaden minskar när ett direktiv blir strängare, och att AI-sökkrypare ofta inte begär robots.txt alls[9], så en Disallow-rad är en begäran snarare än en kontroll.
Vad indexering ger
Indexmedlemskap är förutsättningen för citering. OpenAI anger att en webbplats som har valt bort OAI-SearchBot inte kommer att visas i ChatGPT-sökresultat, även om den fortfarande kan visas som en navigeringslänk[2], Anthropic beskriver Claude-SearchBot som att den analyserar innehåll för att förbättra relevansen av sökresultat[3], och Perplexity ber webbansvariga att tillåta PerplexityBot så att sidor kan visas och länkas[4]. Att blockera söktokensen för en motor tar bort sidan från den pool dess svar hämtas från, vilket är ett annat beslut än att vägra träning. Se ChatGPT-sökning, svarsmotorer och AI-citeringskällor.
Volymer
Sökkrypning är fortfarande den största andelen av automatiserad hämtning. Cloudflare registrerade att Googlebot ökade från 30 % till 50 % av kryparförfrågningarna mellan maj 2024 och maj 2025[10], med GPTBot som gick från 2,2 % till 7,7 % med en ökning på 305 % i förfrågningar[11]. Under 2025 stod Googlebot för 4,5 % av HTML-förfrågningarna på Cloudflare-nätverket mot 4,2 % för alla andra AI-botar tillsammans[12]. Hämtning är en minoritet av deklarerade AI-botändamål: en leverantörskryparpanel för januari till juli 2026 angav sök- eller svarshämtning till 11,1 % av AI-botförfrågningarna mot 46,5 % för träning[13]. Se Cloudflare och AI-krypare.
Botar i denna klass
Baseline Labs botregister (v1) spårar 33 av dessa. Var och en har sin egen post med sin användaragent, sin robots.txt-token och hur man verifierar den.
- AddSearchBotAddSearch
- AIWebIndexLyrenth
- amazon-kendraAmazon
- AmazonbotAmazon
- Amzn-SearchBotAmazon
- AndibotAndi
- AnomuraDireqt
- ApplebotApple
- Aranet-SearchBotOkänd
- atlassian-botAtlassian
- AzureAI-SearchBotMicrosoft
- BravebotBrave
- Channel3BotOkänd
- Claude-SearchBotAnthropic
- Cloudflare-AutoRAGCloudflare
- ExaBotExa
- GoogleOtherGoogle
- GoogleOther-ImageGoogle
- GoogleOther-VideoGoogle
- GrokBotxAI
- iAskBotiAsk
- iaskspideriAsk
- LinkupBotLinkup
- meta-webindexerMeta
- OAI-SearchBotOpenAI
- PerplexityBotPerplexity
- PetalBotHuawei
- Querit-SearchBotQuerit
- QueritBotQuerit
- TavilyBotTavily
- TimpibotTimpi
- YouBotYou.com
- ZanistaBotOkänd
Den fullständiga botencyklopedin listar varje klass sida vid sida.
Referenser (13)
- Web crawler - Wikipedia
- Översikt över OpenAI-krypare - OpenAI utvecklardokumentation
- Kryper Anthropic data från webben, och hur kan webbplatsägare blockera kryparen? - Claude support
- PerplexityBot - Perplexity utvecklardokumentation
- Googles vanliga krypare - Google Search Central
- Googles vanliga krypare - Google Search Central
- Översikt över Googles krypare och hämtare - Google Search Central
- Skrapor respekterar selektivt robots.txt-direktiv: bevis från en storskalig empirisk studie
- Skrapor respekterar selektivt robots.txt-direktiv - arXiv 2505.21733 (ACM IMC 2025)
- Från Googlebot till GPTBot: vem kryper din webbplats 2025 - Cloudflare Blog
- Från Googlebot till GPTBot: vem kryper din webbplats 2025 - Cloudflare Blog
- Cloudflare Radar 2025 Årsöversikt - Cloudflare Blog
- Crawl-to-refer-förhållande: AI-krypare och LLM-botar - Seomator kryparpanel
Senast uppdaterad 2026-09-04. Skriven och underhållen av Baseline Labs.