Skip to content
Maskinoversat fra den engelske original. Se originalen
Crawl control - GEO

'Bloker alle AI-bots' koster dig nu aktivt synlighed

Den robots.txt-rådgivning, du kopierede for to år siden, arbejder nu imod dig. Enhver større AI-leverandør har delt deres crawlere i to - en bot, der træner på dit indhold, en anden, der driver live søgesvar. Bloker alt, og du forsvinder fra ChatGPT-søgeresultater, Claudes genfindingssvar og Perplexity-citater. Træningsbotten og søgebotten udfører forskellige opgaver, og at behandle dem som én koster dig stille og roligt synlighed.

George, Baseline Labs' maskot, holder et stopskilt op

Én Disallow linje, to meget forskellige bots

Da de fleste sider tilføjede AI-botblokeringer, tænkte de på træningsdata – og det var rimeligt. Men crawlerne er siden mangedoblet. OpenAI kører nu tre forskellige bots. Anthropic fulgte trop i begyndelsen af 2026. En generel Disallow: / for et hvilket som helst af disse navne fanger både trænings-crawleren og søge-/genfindings-crawleren – og kun én af disse skader dig ved at blokere.

OpenAIs dokumentation er utvetydig: "Sider, der har fravalgt OAI-SearchBot, vil ikke blive vist i ChatGPT-søgeresultater." Den samme logik gælder for Claude-SearchBot og Claude-User. Bloker dem, og du fravælger dig selv citering i realtids AI-svar. Det rækker langt ud over den fremtidige modeltræning, du havde til hensigt at stoppe.

Leverandør Træningsbot Søge-/genfindingsbot Blokering af søgebot fjerner dig fra...
OpenAI GPTBot OAI-SearchBot & ChatGPT-User ChatGPT-søgesvar
Anthropic ClaudeBot Claude-SearchBot & Claude-User Claude-søgning & live-hentningssvar
Google Google-Extended Googlebot (samme som websøgning) Blokering af Google-Extended fjerner dig ikke fra AI Overviews
ByteDance Bytespider - Kun træning; intet bekræftet søgeprodukt

Google-rækken fortjener en note for sig selv. Googles AI Overviews er bundtet med dens kerne søgecrawler - blokering Google-Extended fravælger dig Gemini-træning, men gør intet for at fjerne dig fra AI Overviews. Forskellen er vigtig.

GPTBot fører den blokerede liste – og bliver ved med at vokse

TechnologyChecker.io scannede 29,9 millioner aktive domæner i Q1 2026 og rangerede AI-crawlere efter andel af DISALLOW regler. Resultatet: GPTBot ligger i toppen og overgår allerede den ældre CCBot. De fleste af disse blokeringer blev skrevet, før opdelingen mellem træning og søgning var bredt forstået – hvilket betyder, at en stor del af dem stille og roligt fravælger disse sider fra AI-søgecitering.

5,52 %
af alle DISALLOW-regler blokerer GPTBot – mest blokerede AI-crawler
5,08 %
blokerer CCBot
4,88 %
blokerer ClaudeBot
4,44 %
blokerer Google-Extended

En BuzzStream-analyse af 100 top amerikanske og britiske nyhedsudgivere (januar 2026) fandt, at 79 % blokerer mindst én træningsbot – men Google-Extended var den mindst blokerede træningscrawler med 46 % samlet set, hvor amerikanske udgivere (58 %) var langt foran britiske udgivere (29 %). Udgivere ønsker tydeligvis at blokere – de er blot stumme om, hvordan de gør det.

416 milliarder anmodninger blokeret på fem måneder

Da Cloudflare erklærede "Content Independence Day" den 1. juli 2025 og begyndte at blokere AI-crawlere som standard på nye domæner, gav det os det første store billede af, hvor meget AI-crawling der foregår – i juni 2026 havde bots overhalet mennesker som flertallet af HTML-trafik. Cloudflare CEO Matthew Prince afslørede det samlede tal ved WIRED's Big Interview i december 2025: 416 milliarder AI-bot-anmodninger afværget på cirka fem måneder – omkring 2,8 milliarder om dagen. Det er en fuldskala industriel udvindingsoperation, der kører døgnet rundt.

416 mia.
AI-bot-anmodninger blokeret af Cloudflare, jul-dec 2025
~2,8 mia./dag
gennemsnitlig AI-crawl-volumen, der rammer Cloudflares netværk
1 mia.+/dag
HTTP 402 Pay-Per-Crawl-svar allerede sendt via Cloudflare-markedspladsen

Prince fremlagde også Googles strukturelle fordel i klare tal (januar 2026, indsendt sammen med den britiske CMA-høring): "Google udnytter deres søgemonopol til at se 3,2 gange så meget af internettet som OpenAI, 4,8 gange så meget som Microsoft og mere end 6 gange så meget som næsten alle andre." Denne asymmetri betyder, at blokering af Google-crawlere koster langt mere synlighed end blokering af en tilsvarende fra enhver anden leverandør.

Betal-per-crawl: en mellemvej er ved at dannes

I stedet for binær tillad/bloker, begynder udgivere at opkræve betaling for adgang. Cloudflares Pay Per Crawl-markedsplads (annonceret 2026) lader udgivere returnere en HTTP 402 Payment Required respons med en crawler-pris-header; Cloudflare fungerer som Merchant of Record. Over en milliard sådanne respons sendes allerede ud dagligt på Cloudflares netværk.

Stack Overflow gjorde opdelingen konkret i februar 2026: en licensaftale med Cloudflare opkræver betaling for kommerciel træningsadgang, mens fællesskabets indhold forbliver frit læsbart. Træningsdata har værdi; søgning hjælper fællesskabet. At opkræve betaling for det ene, mens det andet tillades, er nu en levende produktbeslutning - virksomheder sender det faktisk ud.

Ikke al blokering er forkert

Dette indlæg argumenterer ikke for åben adgang til alt. Der er gode grunde til at holde trænings-crawlere ude, og du bør overveje dem:

  • Træningsdata har reel værdi. Hvis dit indhold er originalt og autoritativt, udtrækker trænings-crawlere den værdi gratis. Stack Overflow-aftalen skaber præcedens for at opkræve betaling frem for at give det væk.
  • Trænings-crawlere giver ingen attribution og ingen henvisningstrafik. I modsætning til søgebot-citater efterlader trænings-passes ingen spor – dit indhold forbedrer en model uden anerkendelse og uden et link tilbage.
  • IP- og konkurrencerisiko. Hvis dit indhold er proprietært eller domænespecifikt nok til at udgøre en fordel, ønsker du måske ikke, at det bliver indbygget i en offentlig LLM, som enhver konkurrent kan forespørge.

Argumentet her er snævert: bloker trænings-crawlere bevidst, hvis du vælger det, men gør det ved navn, så en omfattende regel ikke også fanger søge-/hentningsbotterne, der driver citater og synlighed.

Endnu et forbehold: robots.txt-håndhævelse er frivillig. Bytespider har en dokumenteret historie med at ignorere det. Spoofere bruger rutinemæssigt Chrome-brugeragenter for at undgå detektion. En robots.txt-indgang signalerer din præference og giver dig et juridisk grundlag for klage; det forhindrer teknisk set ikke adgang. Reel kontrol kræver server-side-regler, WAF-konfiguration og verificerede bot-signaler (Cloudflares bot-styring kan verificere legitime crawlere via IP og TLS-fingeraftryk, før de tillades eller opkræves). Betragt robots.txt som dit første lag, og bak det derefter op med de ovennævnte server-side-kontroller.

Bloker træningsrobotterne ved navn

En robots.txt, der skelner mellem træning og søgning, ser sådan ud:

Bot Rolle Anbefalet holdning
GPTBot OpenAI-træning Bloker, hvis du vil fravælge brug af træningsdata
OAI-SearchBot ChatGPT-søgeindeks Tillad - blokering fjerner dig fra ChatGPT-søgeresultater
ChatGPT-User Live brugerhentning Tillad - driver browsing i realtid i ChatGPT
ClaudeBot Anthropic-træning Bloker, hvis du vil fravælge brug af træningsdata
Claude-SearchBot Claude søgeindeks Tillad - blokering fjerner dig fra Claude søgeresultater
Claude-User Live Claude hentning Tillad - driver live hentning i Claude
Google-Extended Gemini / SGE træning Bloker, hvis du vil fravælge Gemini-træning (påvirker ikke AI Overviews)
Bytespider ByteDance træning Bloker - intet søgeprodukt, kendt robots.txt-historik

Det andet skridt er at kontrollere, om din CDN eller WAF allerede har truffet denne beslutning for dig. Cloudflare begyndte at blokere AI-crawlere som standard på alle nye domæner fra 1. juli 2025. Hvis du oprettede eller migrerede et domæne efter denne dato, kan AI-crawlere allerede være blokeret på netværkslaget – inklusive de søgerobotter, du måske ønsker at tillade. Tjek dine Cloudflare Sikkerhed → Bots-indstillinger, før du antager, at din robots.txt gør arbejdet.

Det tredje skridt er at måle din nuværende AI-synlighed, så du ved, hvad du har at tabe eller vinde. Det er det, Baselines brandscanner gør.

Auditér din AI-synlighed

Kilder: OpenAI platform docs (openai.com/gptbot, openai.com/searchbot); Anthropic support docs om Claude crawlere (dækning: Search Engine Journal); TechnologyChecker.io, "robots.txt AI crawlers blocking report Q1 2026" - technologychecker.io (29.9M domæner); BuzzStream, "How Publishers Are Blocking AI" (jan. 2026) - buzzstream.com; Cloudflare "Content Independence Day" pressemeddelelse (jul. 2025) - cloudflare.com; 416B anmodninger statistik - Matthew Prince ved WIRED Big Interview, 4. dec. 2025 (via Tom's Hardware); Prince om Google webadgangsfordel (jan. 2026) via Search Engine Land; Cloudflare Pay Per Crawl - blog.cloudflare.com, AI Crawl Control.

Billede (brandbehandlet fra licenseret original): Tom butiksfacade af Mutney, CC BY 4.0, via Wikimedia Commons.

Se hvordan AI-søgning ser dit websted

Gratis AI-synlighedstjek på under et minut

Tjek min side
George
Online
0%