Wikipedia
Wikipedia er det gratis encyklopædi, der drives af Wikimedia Foundation, og i AI-søgning er det det referencelag, som motorer falder tilbage på. Målinger af dens andel af ChatGPT-citater spænder fra 5%[1] til 13,15%[2] afhængigt af prøven, og hver stor citationsundersøgelse placerer den øverst eller tæt på toppen sammen med Reddit. For alle, der arbejder med GEO, er denne position en begrænsning snarere end en mulighed: encyklopædiartiklen er som regel allerede der, og det nyttige spørgsmål er, hvad et brand kan sige, som den ikke gør.
Hvor meget motorer citerer den
Profounds analyse af omkring 730.000 ChatGPT-samtaler med citater, udtaget i USA mellem oktober og december 2025, viste, at Wikipedia leverede 5% af alle citater og optrådte i næsten hver sjette af dem[1]. En 5W-syntese baseret på en Similarweb-prøve af cirka 600.000 citationer fra januar til februar 2026 placerede den først med 13,15% af amerikanske ChatGPT-citater, foran Reddit med 11,97%[2], mens et tal rapporteret via Contently giver 7,8%[3]. De tre er uenige, fordi de prøver forskellige forespørgselsblandinger og perioder, så formen er troværdig, men tallet er det ikke. En undersøgelse fra marts 2026 af 30 millioner citerede kilder på tværs af fem systemer viste, at ChatGPT foretrak Wikipedia, Reddit og redaktionelle sider, hvor Reddit var først samlet[4].
Wikipedia som en træningsdata-proxy
Wikipedia-sidevisninger bruges i sprogmodel-forskning som et mål for, hvor kendt noget er. En analyse fra 2026 af OLMo-modellerne og deres fulde Dolma-foruddannelseskorpus, der dækker 7,4 billioner tokens og 2.000 entiteter, rapporterer, at foruddannelseseksponering korrelerer stærkt med Wikipedia-popularitet, hvilket den behandler som validering af eksponering som en proxy for real-world salience[5]. Den samme undersøgelse finder, at en models egne popularitetsvurderinger følger eksponering tættere, end de følger Wikipedia, og at effekten er stærkest i større modeller og i den lange hale[6]. Hvor velkendt et brand er for en model, er derfor en egenskab ved korpusset snarere end ved verden.
At blive citeret er ikke at blive besøgt
Wikimedia rapporterede, at menneskelige sidevisninger i maj og juni 2025 lå omkring 8% under de samme måneder i 2024, efter at de reviderede deres bot-detektion[7], og tilskrev faldet søgemaskiner, der besvarede forespørgsler direkte med generativ AI, og yngre læsere, der flyttede til sociale videoer[8]. Crawl-belastningen bevægede sig den anden vej: Fonden sagde i april 2025, at mindst 65% af dens dyreste trafik kom fra bots, som udgjorde omkring 35% af sidevisningerne[9]. Wikipedia er det tydeligste offentlige eksempel på nul-klik-handlen, fordi den offentliggør begge halvdele af den.
Betalt adgang til AI-genbrug
Wikimedia Enterprise sælger maskinlæsbar adgang i bulk til det samme indhold, som de gratis API'er leverer. Fondens angivne årsag er, at indholdet er gratis, men infrastrukturen er det ikke, og den begrænser nu store genbrugere af de gratis endepunkter[10]. Enterprise-indtægterne er begrænset til 30% af Fondens samlede indtægter[11]. Ordningen er værd at holde øje med som en skabelon for indholdslicensering generelt: en udgiver, der ikke kan stoppe AI-crawlere, kan stadig opkræve betaling for en renere forbindelse.
Hvad det betyder for et websted
Profounds råd på baggrund af egne data er, at positionen ikke kan konkurreres, og at et brand bør sigte mod at være citationen efter Wikipedia, med dybere analyse, aktuelle data eller ekspertvurdering, som encyklopædien ikke kan indeholde[12]. Dette følger af, hvad Wikipedia er: en tertiær kilde uden original rapportering og en forsinkelse i forhold til begivenheder. Den praktiske læsning er at holde encyklopædiopslaget nøjagtigt, behandle det som uovervindelig grund, og lægge indsatsen i friskere materiale, som en fan-out-forespørgsel har en grund til at række ud efter.
Data
Vis tallene (3)
| Punkt | % |
|---|---|
| Menneskelige sidevisninger, maj-jun 2025 vs 2024 | -8 |
| Andel af dyr trafik fra bots | 65 |
| Andel af sidevisninger fra bots | 35 |
Referencer (12)
- How ChatGPT sources the web - Profound Arkiv
- Wikipedia and Reddit Now Drive Over 25% of ChatGPT Citations in the US - 5W via PR Newswire Arkiv
- Top 10 Sources LLMs Cite Most in 2026 - Contently Arkiv
- AI search engines cite Reddit, YouTube, and LinkedIn most: Study - Search Engine Land Arkiv
- Pretraining Exposure Explains Popularity Judgments in Large Language Models
- Pretraining Exposure Explains Popularity Judgments in Large Language Models
- New user trends on Wikipedia - Wikimedia Foundation Arkiv
- New user trends on Wikipedia - Wikimedia Foundation Arkiv
- How crawlers impact the operations of the Wikimedia projects - Wikimedia Diff Arkiv
- The cost of 'free': How Wikimedia Enterprise protects Wikipedia - Wikimedia Foundation Arkiv
- The cost of 'free': How Wikimedia Enterprise protects Wikipedia - Wikimedia Foundation Arkiv
- How ChatGPT sources the web - Profound Arkiv
Senest opdateret 2026-09-04. Skrevet og vedligeholdt af Baseline Labs.