Innehållslicensavtal
Innehållslicensavtal är betalda överenskommelser där en utgivare eller plattform låter ett AI-företag använda dess material för modellträning, för visning i genererade svar, eller båda. Köpare inkluderar OpenAI, Google, Meta, Microsoft, Amazon och Perplexity, och rapporterade värden sträcker sig från 10 miljoner dollar fördelat på fem nyhetsredaktioner genom Lenfest Institute[1] till mer än 250 miljoner dollar över fem år för News Corp[2]. Omkring ett dussin stämningar mot OpenAI har lämnats in sedan slutet av 2023, så marknaden byggs upp genom avtal och stämningar samtidigt[3]. Huruvida en licens köper citering är en separat fråga: Google kopplar behörighet till indexering snarare än till kontrakt[4], och en publicerad granskning av licensierade utgivare fann ingen fördel med attribuering[5].
Vad pengarna köper
Två distinkta rättigheter är till salu, ofta i samma kontrakt. Träningsrättigheter täcker intag av ett arkiv i en modells vikter. Visningsrättigheter täcker sammanfattning av liveartiklar och länkning till dem i en svarsprodukt, vilket är den del som kan generera trafik. Enligt Associated Press avtal med Google kommer AP att "leverera ett flöde av realtidsinformation för att ytterligare förbättra användbarheten av resultat som visas i Gemini-appen"[6]. Nines avtal med Microsoft låter "Microsoft Copilot använda sin journalistik i realtid när den skapar AI-svar"[7], och Metas Reuters-avtal är utformat på samma sätt[8]. En tredje form betalar per användning istället för per arkiv: signerade utgivare under Perplexitys program "kommer att kunna dela intäkterna som genereras av interaktioner där deras innehåll refereras"[9].
Rapporterade värden
De flesta avtal avslöjar ingenting. Av de som läcker en siffra rapporterades News Corps OpenAI-avtal till "mer än 250 miljoner dollar över fem år"[2], dess senare Meta-avtal till "upp till 50 miljoner dollar per år i minst tre år"[10], och New York Times-avtalet med Amazon till "20 till 25 miljoner dollar per år"[11]. Fastare siffror kommer från anmälningar. Reddit meddelade SEC i februari 2024 att de hade "ingått vissa datalicensavtal med ett sammanlagt kontraktsvärde på 203,0 miljoner dollar och löptider från två till tre år"[12]. Intäktsraden för dessa kontrakt gick från 15,2 miljoner dollar 2023 till 140,0 miljoner dollar 2025[13], och 143,7 miljoner dollar i framtida intäkter var fortfarande under kontrakt i slutet av 2025[14].
Varför avtalen existerar
Det kommersiella trycket att licensiera kommer från att det öppna webben stängs. En longitudinell granskning av samtyckesprotokollen bakom de vanliga träningskorpuserna fann att, om man räknar med Terms of Service-genomsökningsrestriktioner snarare än enbart robots.txt, är hela 45% av C4-korpusen nu begränsad[15]. En sökrobot som bara läser filen underskattar vad webbplatsens egna villkor förbjuder, och ett kontrakt är det som täpper till den luckan.
Proveniensen i de befintliga korpuserna är svag i den andra riktningen. En granskning som spårade mer än 1 800 textdataset fann att licensutelämnande var över 70% och licensfelprocenten över 50% på allmänt använda datasetvärdsidor[16], så en köpare kan inte enbart från den offentliga registreringen fastställa vad en sammansatt korpus någonsin fick innehålla. Se AI-sökrobotar för hur restriktionerna uttrycks.
Köper en licens citering
Ett kontrakt är inte en rankningssignal. Googles vägledning för utgivare säger att "för att vara berättigad att visas som en stödjande länk i AI-översikter eller AI-läge, måste en sida vara indexerad och berättigad att visas i Google Sök"[4], vilket sätter genomsökning och indexering före alla kommersiella arrangemang. Tow Center testade 200 citat från 20 publikationer i ChatGPT och fann att det "gav delvis eller helt felaktiga svar vid etthundrafemtiotre tillfällen"[17]. Licensierade utgivare skonades inte: New York Post och The Atlantic "har licensavtal med OpenAI och möjliggjorde åtkomst för alla sökrobotar, men deras innehåll citerades ofta felaktigt eller missrepresenterades"[5]. En granskning från 2026 av citeringar för 44 Web3-företag fann att exponeringen snedvreds mot "redan framstående röster"[18].
Åtkomst säljs som infrastruktur
Vissa licenser säljer leverans snarare än tillstånd. Wikimedia Enterprise säljer API:er, ögonblicksbilder och realtidsströmmar av Wikipedia-innehåll, beskrivet som "Byggt för AI, Sök och Kunskapsgrafer"[19]. Innehållet är redan fritt att återanvända under en Creative Commons-licens, så det köparna betalar för är rörledningen och servicenivån, inte rätten.
Licensiera eller stämma
Samma utgivare finns på båda listorna. Omkring sex fall har väckts mot Perplexity, och en federal domare avvisade i stort sett en begäran om att avfärda Reddits fall, och sade att Reddit trovärdigt hade hävdat att Perplexity "konspirerade med minst en av de tre dataskrapare för att kringgå åtkomstkontroller och erhålla Reddits material"[20].
Data
Visa siffrorna (3)
| Punkt | $m |
|---|---|
| 2023 | 15.2 |
| 2024 | 114.7 |
| 2025 | 140 |
Referenser (20)
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI features and your website - Google Search Central Arkiv
- How ChatGPT Search (mis)represents publisher content - Columbia Journalism Review Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
- Reddit, Inc. Form S-1 registration statement Arkiv
- Reddit, Inc. Form 10-K, disaggregation of revenue by source Arkiv
- Reddit, Inc. Form 10-K, revenue note Arkiv
- Consent in Crisis: The Rapid Decline of the AI Data Commons
- The Data Provenance Initiative: A Large Scale Audit of Dataset Licensing and Attribution in AI
- How ChatGPT Search (mis)represents publisher content - Columbia Journalism Review Arkiv
- When Attention Becomes Exposure in Generative Search Arkiv
- Wikimedia Enterprise Arkiv
- AI deals with publishers: full list - Press Gazette Arkiv
Senast uppdaterad 2026-09-04. Skriven och underhållen av Baseline Labs.