Wikipedia
Wikipedia er det frie leksikonet drevet av Wikimedia Foundation, og i AI-søk er det referanselaget som motorer faller tilbake på. Målinger av andelen av ChatGPT-siteringer varierer fra 5 %[1] til 13,15 %[2] avhengig av utvalget, og hver store siteringstudie plasserer den på eller nær toppen sammen med Reddit. For alle som driver med GEO, er denne posisjonen en begrensning snarere enn en mulighet: leksikonartikkelen er vanligvis allerede der, og det nyttige spørsmålet er hva et merke kan si som den ikke gjør.
Hvor mye motorer siterer den
Profounds analyse av omtrent 730 000 ChatGPT-samtaler med siteringer, samlet i USA mellom oktober og desember 2025, fant at Wikipedia leverte 5 % av alle siteringer og dukket opp i nesten én av seks av dem[1]. En 5W-syntese bygget på et Similarweb-utvalg av omtrent 600 000 siteringshendelser fra januar til februar 2026 plasserte den først med 13,15 % av amerikanske ChatGPT-siteringer, foran Reddit med 11,97 %[2], mens et tall rapportert via Contently gir 7,8 %[3]. De tre er uenige fordi de prøver forskjellige spørringsmikser og perioder, så formen er pålitelig, men tallet er det ikke. En studie fra mars 2026 av 30 millioner siterte kilder på tvers av fem systemer fant at ChatGPT favoriserte Wikipedia, Reddit og redaksjonelle nettsteder, med Reddit først totalt sett[4].
Wikipedia som en treningsdata-proxy
Wikipedias sidevisninger brukes i språkmodellforskning som et mål på hvor kjent noe er. En analyse fra 2026 av OLMo-modellene og deres fulle Dolma-forhåndstreningskorpus, som dekker 7,4 billioner tokens og 2000 entiteter, rapporterer at forhåndstrenings-eksponering korrelerer sterkt med Wikipedias popularitet, noe den behandler som en validering av eksponering som en proxy for reell salience[5]. Den samme studien finner at en modells egne popularitetsvurderinger følger eksponering nærmere enn de følger Wikipedia, og at effekten er sterkest i større modeller og i den lange halen[6]. Hvor kjent et merke er for en modell er derfor en egenskap ved korpuset snarere enn ved verden.
Å bli sitert er ikke å bli besøkt
Wikimedia rapporterte menneskelige sidevisninger i mai og juni 2025 som lå omtrent 8 % under de samme månedene i 2024 etter at de reviderte bot-deteksjonen sin[7], og tilskrev fallet søkemotorer som svarte direkte på spørringer med generativ AI og yngre lesere som flyttet til sosiale videoer[8]. Crawl-belastningen beveget seg den andre veien: Stiftelsen sa i april 2025 at minst 65 % av den dyreste trafikken kom fra roboter, som utgjorde omtrent 35 % av sidevisningene[9]. Wikipedia er det tydeligste offentlige tilfellet av null-klikk-handelen, fordi den publiserer begge halvdelene av den.
Betalt tilgang for AI-gjenbruk
Wikimedia Enterprise selger maskinlesbar bulk-tilgang til det samme innholdet som de gratis API-ene serverer. Stiftelsens begrunnelse er at innholdet er gratis, men infrastrukturen er det ikke, og den begrenser nå store gjenbrukere av de gratis endepunktene[10]. Inntektene fra Enterprise er begrenset til 30 % av stiftelsens totale inntekter[11]. Ordningen er verdt å følge med på som en mal for innholds-lisensiering generelt: en utgiver som ikke kan stoppe AI-crawlere, kan fortsatt ta betalt for en renere kanal.
Hva det betyr for et nettsted
Profounds råd, basert på egne data, er at posisjonen ikke er konkurransedyktig, og at et merke bør sikte på å være sitatet etter Wikipedia, med dypere analyse, aktuelle data eller ekspertvurderinger som leksikonet ikke kan inneholde[12]. Dette følger av hva Wikipedia er: en tertiærkilde uten original rapportering og en forsinkelse bak hendelsene. Den praktiske tolkningen er å holde leksikonartikkelen nøyaktig, behandle den som uoppnåelig grunn, og legge innsatsen i friskere materiale som en fan-out-spørring har en grunn til å hente frem.
Data
Vis tallene (3)
| Punkt | % |
|---|---|
| Menneskelige sidevisninger, mai-jun 2025 vs 2024 | -8 |
| Andel av kostbar trafikk fra roboter | 65 |
| Andel av sidevisninger fra roboter | 35 |
Referanser (12)
- Hvordan ChatGPT henter kilder fra nettet - Profound Arkiv
- Wikipedia og Reddit driver nå over 25 % av ChatGPT-siteringer i USA - ny 5W-forskning finner - WSJ, NYT og Bloomberg vises ikke blant de 20 beste - 5W via PR Newswire Arkiv
- Topp 10 kilder LLM-er siterer mest i 2026 - Contently Arkiv
- AI-søkemotorer siterer Reddit, YouTube og LinkedIn mest: Studie - Search Engine Land Arkiv
- Forhåndstrenings-eksponering forklarer popularitetsvurderinger i store språkmodeller
- Forhåndstrenings-eksponering forklarer popularitetsvurderinger i store språkmodeller
- Nye brukertrender på Wikipedia - Wikimedia Foundation Arkiv
- Nye brukertrender på Wikipedia - Wikimedia Foundation Arkiv
- Hvordan crawlere påvirker driften av Wikimedia-prosjektene - Wikimedia Diff Arkiv
- Kostnaden for 'gratis': Hvordan Wikimedia Enterprise beskytter Wikipedia - Wikimedia Foundation Arkiv
- Kostnaden for 'gratis': Hvordan Wikimedia Enterprise beskytter Wikipedia - Wikimedia Foundation Arkiv
- Hvordan ChatGPT henter kilder fra nettet - Profound Arkiv
Sist oppdatert 2026-09-04. Skrevet og vedlikeholdt av Baseline Labs.