Wikipedia
Wikipedia är den fria encyklopedin som drivs av Wikimedia Foundation, och inom AI-sökning är det referenslagret som motorerna faller tillbaka på. Mätningar av dess andel av ChatGPT-citat varierar från 5%[1] till 13,15%[2] beroende på urvalet, och varje stor citatstudie placerar den på eller nära toppen tillsammans med Reddit. För alla som sysslar med GEO är den positionen en begränsning snarare än en möjlighet: encyklopediartikeln finns oftast redan där, och den användbara frågan är vad ett varumärke kan säga som den inte gör.
Hur mycket motorer citerar den
Profounds analys av cirka 730 000 ChatGPT-konversationer med citat, samplade i USA mellan oktober och december 2025, fann att Wikipedia stod för 5% av alla citat och förekom i nästan var sjätte av dem[1]. En 5W-syntes byggd på ett Similarweb-urval av ungefär 600 000 citathändelser från januari till februari 2026 placerade den först med 13,15% av amerikanska ChatGPT-citat, före Reddit med 11,97%[2], medan en siffra rapporterad via Contently ger 7,8%[3]. De tre är oense eftersom de samplar olika frågeblandningar och perioder, så formen är pålitlig men siffran är det inte. En studie från mars 2026 av 30 miljoner citerade källor över fem system fann att ChatGPT föredrog Wikipedia, Reddit och redaktionella webbplatser, med Reddit först totalt sett[4].
Wikipedia som proxy för träningsdata
Wikipedias sidvisningar används i språkmodellforskning som ett mått på hur välkänt något är. En analys från 2026 av OLMo-modellerna och deras fullständiga Dolma-förträningskorpus, som täcker 7,4 biljoner tokens och 2 000 entiteter, rapporterar att förträningsexponering korrelerar starkt med Wikipedias popularitet, vilket den behandlar som validerande exponering som en proxy för verklig framträdande[5]. Samma studie finner att en modells egna popularitetsbedömningar följer exponeringen närmare än de följer Wikipedia, och att effekten är starkast i större modeller och i den långa svansen[6]. Hur bekant ett varumärke är för en modell är därför en egenskap hos korpusen snarare än hos världen.
Att bli citerad är inte att bli besökt
Wikimedia rapporterade mänskliga sidvisningar i maj och juni 2025 som låg cirka 8% under samma månader 2024 efter att de reviderat sin botdetektering[7], och tillskrev fallet sökmotorer som svarade direkt på frågor med generativ AI och yngre läsare som flyttade till sociala videor[8]. Sökrobotbelastningen rörde sig åt andra hållet: stiftelsen sade i april 2025 att minst 65% av dess dyraste trafik kom från botar, som utgjorde cirka 35% av sidvisningarna[9]. Wikipedia är det tydligaste offentliga fallet av nollklicks-handeln, eftersom den publicerar båda halvorna av den.
Betald åtkomst för AI-återanvändning
Wikimedia Enterprise säljer maskinläsbar massåtkomst till samma innehåll som de fria API:erna tillhandahåller. Stiftelsens angivna skäl är att innehållet är gratis men infrastrukturen är det inte, och den begränsar nu stora återanvändare av de fria ändpunkterna[10]. Intäkterna från Enterprise är begränsade till 30% av stiftelsens totala intäkter[11]. Arrangemanget är värt att observera som en mall för innehållslicensiering i allmänhet: en utgivare som inte kan stoppa AI-sökrobotar kan fortfarande ta betalt för en renare kanal.
Vad det betyder för en webbplats
Profounds råd, baserat på deras egna data, är att positionen inte är konkurrenskraftig, och att ett varumärke bör sträva efter att vara citatet efter Wikipedia, med djupare analys, aktuell data eller expertbedömning som encyklopedin inte kan innehålla[12]. Detta följer av vad Wikipedia är: en tertiär källa utan originalrapportering och en fördröjning bakom händelserna. Den praktiska tolkningen är att hålla encyklopediartikeln korrekt, behandla den som oövervinnerlig mark, och lägga ansträngningen på fräschare material som en fan-out-fråga har anledning att söka efter.
Data
Visa siffrorna (3)
| Punkt | % |
|---|---|
| Mänskliga sidvisningar, maj-jun 2025 vs 2024 | -8 |
| Andel av dyr trafik från botar | 65 |
| Andel av sidvisningar från botar | 35 |
Referenser (12)
- Hur ChatGPT källhänvisar webben - Profound Arkiv
- Wikipedia och Reddit driver nu över 25% av ChatGPT-citat i USA - Ny 5W-forskning visar - WSJ, NYT och Bloomberg förekommer inte bland de 20 främsta - 5W via PR Newswire Arkiv
- Topp 10 källor som LLM:er citerar mest 2026 - Contently Arkiv
- AI-sökmotorer citerar Reddit, YouTube och LinkedIn mest: Studie - Search Engine Land Arkiv
- Förträningsexponering förklarar popularitetsbedömningar i stora språkmodeller
- Förträningsexponering förklarar popularitetsbedömningar i stora språkmodeller
- Nya användartrender på Wikipedia - Wikimedia Foundation Arkiv
- Nya användartrender på Wikipedia - Wikimedia Foundation Arkiv
- Hur sökrobotar påverkar driften av Wikimedia-projekten - Wikimedia Diff Arkiv
- Kostnaden för "gratis": Hur Wikimedia Enterprise skyddar Wikipedia - Wikimedia Foundation Arkiv
- Kostnaden för "gratis": Hur Wikimedia Enterprise skyddar Wikipedia - Wikimedia Foundation Arkiv
- Hur ChatGPT källhänvisar webben - Profound Arkiv
Senast uppdaterad 2026-09-04. Skriven och underhållen av Baseline Labs.