Skip to content

Sökkrypare

Koncept inom AI-sökning och SEO
Flyktig, senast kontrollerad 2026-09-04 Denna sida innehåller mätvärden som snabbt förändras.Granskad 2026-09-04

Sökkrypare hämtar sidor i bulk för att bygga ett index som en svarsmotor hämtar från vid frågetidpunkten[1]. De är den klass en AI-svar vanligtvis citerar: OpenAI kör OAI-SearchBot för ChatGPT:s sökfunktioner[2], Anthropic kör Claude-SearchBot[3], och Perplexity kör PerplexityBot för att visa och länka webbplatser i sina resultat[4]. Det som skiljer dem från en träningsskrapa är vad som händer med kopian: en indexpost kan hämtas och länkas tillbaka, en träningskorpus absorberas i modellvikter, och de två styrs av olika robots.txt-tokens[5].

Separata tokens för index och träning

Google publicerar olika robots.txt-tokens för de två jobben. GoogleOther är den generiska kryparen som dess produktteam använder för att hämta offentligt tillgängligt innehåll[6], medan Google-Extended är en fristående token som avgör om krypat innehåll får träna framtida Gemini-modeller[5]. En webbplats kan stanna i indexet och utanför träningskorpusen. OpenAI dokumenterar samma uppdelning, kör OAI-SearchBot för sökning och en separat token för modellträning[2]. Se träningsskrapor och robots.txt.

Robots.txt-hantering

Google anger att dess vanliga krypare alltid respekterar robots.txt-regler för automatiska krypningar[7], och protokollet förutsätter just det: en krypare läser filen och bestämmer vad den ska följa[1]. Lydnaden bland den bredare populationen är ojämn, och den mättes inte under större delen av protokollets livstid: 2025 års rapport som först testade det i stor skala, på anonymiserade institutionella webbloggar, konstaterar att bevisen före den var anekdotiska[8]. Den studien, av 130 självdeklarerade botar under 40 dagar, fann att efterlevnaden minskar när ett direktiv blir strängare, och att AI-sökkrypare ofta inte begär robots.txt alls[9], så en Disallow-rad är en begäran snarare än en kontroll.

Vad indexering ger

Indexmedlemskap är förutsättningen för citering. OpenAI anger att en webbplats som har valt bort OAI-SearchBot inte kommer att visas i ChatGPT-sökresultat, även om den fortfarande kan visas som en navigeringslänk[2], Anthropic beskriver Claude-SearchBot som att den analyserar innehåll för att förbättra relevansen av sökresultat[3], och Perplexity ber webbansvariga att tillåta PerplexityBot så att sidor kan visas och länkas[4]. Att blockera söktokensen för en motor tar bort sidan från den pool dess svar hämtas från, vilket är ett annat beslut än att vägra träning. Se ChatGPT-sökning, svarsmotorer och AI-citeringskällor.

Volymer

Sökkrypning är fortfarande den största andelen av automatiserad hämtning. Cloudflare registrerade att Googlebot ökade från 30 % till 50 % av kryparförfrågningarna mellan maj 2024 och maj 2025[10], med GPTBot som gick från 2,2 % till 7,7 % med en ökning på 305 % i förfrågningar[11]. Under 2025 stod Googlebot för 4,5 % av HTML-förfrågningarna på Cloudflare-nätverket mot 4,2 % för alla andra AI-botar tillsammans[12]. Hämtning är en minoritet av deklarerade AI-botändamål: en leverantörskryparpanel för januari till juli 2026 angav sök- eller svarshämtning till 11,1 % av AI-botförfrågningarna mot 46,5 % för träning[13]. Se Cloudflare och AI-krypare.

Botar i denna klass

Baseline Labs botregister (v1) spårar 33 av dessa. Var och en har sin egen post med sin användaragent, sin robots.txt-token och hur man verifierar den.

Den fullständiga botencyklopedin listar varje klass sida vid sida.

Referenser (13)
  1. Web crawler - Wikipedia
    Journalistik Hämtad 2026-09-04
  2. Översikt över OpenAI-krypare - OpenAI utvecklardokumentation
    Dokumentation Hämtad 2026-09-04
  3. Kryper Anthropic data från webben, och hur kan webbplatsägare blockera kryparen? - Claude support
    Dokumentation Hämtad 2026-09-04
  4. PerplexityBot - Perplexity utvecklardokumentation
    Dokumentation Hämtad 2026-09-04
  5. Googles vanliga krypare - Google Search Central
    Dokumentation Hämtad 2026-09-04
  6. Googles vanliga krypare - Google Search Central
    Dokumentation Hämtad 2026-09-04
  7. Översikt över Googles krypare och hämtare - Google Search Central
    Dokumentation Hämtad 2026-09-04
  8. Skrapor respekterar selektivt robots.txt-direktiv: bevis från en storskalig empirisk studie
    Akademisk Publicerad 2025-05-27 Hämtad 2026-09-04
  9. Skrapor respekterar selektivt robots.txt-direktiv - arXiv 2505.21733 (ACM IMC 2025)
    Akademisk Publicerad 2025-05-27 Hämtad 2026-09-04
  10. Från Googlebot till GPTBot: vem kryper din webbplats 2025 - Cloudflare Blog
    Leverantörsdokumentation Publicerad 2025-07-01 Hämtad 2026-09-04 Flyktig, senast kontrollerad 2026-09-04
  11. Från Googlebot till GPTBot: vem kryper din webbplats 2025 - Cloudflare Blog
    Leverantörsdokumentation Publicerad 2025-07-01 Hämtad 2026-09-04 Flyktig, senast kontrollerad 2026-09-04
  12. Cloudflare Radar 2025 Årsöversikt - Cloudflare Blog
    Leverantörsdokumentation Hämtad 2026-09-04 Flyktig, senast kontrollerad 2026-09-04
  13. Crawl-to-refer-förhållande: AI-krypare och LLM-botar - Seomator kryparpanel
    Leverantörsdokumentation Publicerad 2026-07-21 Hämtad 2026-09-04 Enkelkälla Flyktig, senast kontrollerad 2026-09-04

Senast uppdaterad 2026-09-04. Skriven och underhållen av Baseline Labs.

George
Online
0%