AI-assistent-hämtare
AI-assistent-hämtare hämtar en sida i taget, live, eftersom en person frågade assistenten något. OpenAI dokumenterar ChatGPT-User som att den tjänar användaråtgärder och säger att den inte används för att genomsöka webben på ett automatiskt sätt[1], och Google håller användarutlösta hämtare i en kategori skild från sina crawlers[2]. Klassen är viktig för webbplatsägare av en anledning: vissa operatörer anser att robots.txt, skriven för crawlers, inte styr en hämtning som en människa bad om[3][4]. En träff från denna klass är också den tydligaste efterfrågesignalen en webbplats får, eftersom en riktig person ställde en fråga som sidan besvarade. En granskning av cirka 37 000 kommersiella rekommendationskörningar ramar in produkterna bakom dessa hämtningar som rekommendationsmotorer snarare än sökmotorer, som besvarar en köpfråga genom att nominera varumärken istället för att returnera en lista med länkar[5].
Robots.txt-argumentet
Två operatörer skriver in undantaget i sin egen dokumentation. OpenAI säger att eftersom ChatGPT-User-åtgärder initieras av en användare, kanske robots.txt-regler inte gäller[3]. Perplexity är mer rakt på sak: eftersom en användare begärde hämtningen, ignorerar Perplexity-User i allmänhet robots.txt-regler[4]. Resonemanget är att filen styr systematisk insamling, och en enskild hämtning på en persons vägnar liknar den personen som öppnar sidan. Anthropic drar motsatt slutsats för samma beteende, och dokumenterar Claude-User som agenten som besöker en webbplats när någon ställer en fråga till Claude[6] samtidigt som den anger att dess bots respekterar do-not-crawl-direktiv i robots.txt[7]. Se robots.txt.
Tvisten
Argumentet blev en offentlig strid i augusti 2025, när Cloudflare rapporterade att Perplexity modifierade sin användaragent och roterade käll-ASNs för att fortsätta hämta domäner som hade förbjudit den[8]. Perplexitys svar vilade på klasskillnaden, och hävdade att en modern AI-assistent som besvarar en fråga fungerar annorlunda än traditionell webbsökning[9]. Publicister läser samma hämtning som obetald tillgång till innehåll, vilket är vad block-by-default och licensieringsåtgärderna som beskrivs under AI-crawlers svarar på.
Hur mycket trafik
Klassen är liten men den snabbast växande. Cloudflare registrerade ChatGPT-User-förfrågningar upp 2 825 % mellan maj 2024 och maj 2025, till en andel på 1,3 % av crawler-förfrågningarna[10], och satte tillväxten av AI-användaråtgärdscrawling under 2025 till mer än 15 gånger[11]. Det förblir en tunn skiva av det totala: en leverantörs crawler-panel för januari till juli 2026 tillskriver 2,5 % av AI-botförfrågningarna till användarutlösta åtgärder, mot 46,5 % för träning[12]. Eftersom varje träff står för en ställd fråga, är denna klass den trafik en webbplats kan läsa som efterfrågan snarare än insamling. Se AI-synlighetsmätning och AI-referenstrafik.
Bots i denna klass
Baseline Labs botregister (v1) spårar 30 av dessa. Var och en har sin egen post med sin användaragent, sin robots.txt-token och hur man verifierar den.
- AI2Bot-DeepResearchEvalAllen Institute
- amazon-QBusinessAmazon
- Amzn-UserAmazon
- bigsur.aiBig Sur AI
- BuddyBotBuddyBotLearning
- ChatGPT-UserOpenAI
- Claude-UserAnthropic
- cohere-aiCohere
- DuckAssistBotDuckDuckGo
- GeistHaus-PageFetcherGeistHaus
- Gemini-Deep-ResearchGoogle
- Google-NotebookLMGoogle
- GoogleAgent-URLContextGoogle
- Grok-DeepSearchxAI
- kagi-fetcherKagi
- Kimi-UserMoonshot AI
- KlaviyoAIBotKlaviyo
- LinerBotLiner
- Meta-ExternalFetcherMeta
- MistralAI-UserMistral
- Perplexity-UserPerplexity
- PhindBotPhind
- Poggio-CitationsPoggio
- QualifiedBotQualified
- Shap-UserParallel
- TongyiBotAlibaba
- UseAIOkänd
- wpbotQuantumCloud
- WRTNBotWrtn
- YiyanBotBaidu
Den fullständiga botencyklopedin listar varje klass sida vid sida.
Referenser (12)
- Översikt över OpenAI Crawlers - OpenAI utvecklardokumentation
- Översikt över Google-crawlers och hämtare - Google Search Central
- Översikt över OpenAI Crawlers - OpenAI utvecklardokumentation
- PerplexityBot - Perplexity utvecklardokumentation
- Prominence-Stratified Failure Modes in Retrieval-Augmented Commercial Recommendation: A 37,000-Run Audit
- Samlar Anthropic in data från webben, och hur kan webbplatsägare blockera crawlern? - Claude support
- Samlar Anthropic in data från webben, och hur kan webbplatsägare blockera crawlern? - Claude support
- Perplexity använder smygande, odeklarerade crawlers för att undvika webbplatsens no-crawl-direktiv - Cloudflare Blog
- Perplexity AI ignorerar no-crawling-regler på webbplatser, genomsöker dem ändå - Malwarebytes
- Från Googlebot till GPTBot: vem genomsöker din webbplats 2025 - Cloudflare Blog
- Cloudflare Radar 2025 År i granskning - Cloudflare Blog
- Crawl-to-refer-förhållande: AI-crawlers och LLM-bots - Seomator crawler-panel
Senast uppdaterad 2026-09-04. Skriven och underhållen av Baseline Labs.