Innholdsstruktur
Svarsmotorer leser ikke en side som en side. Hentesystemer deler et dokument inn i biter, legger inn hver bit og rangerer biter mot en spørring, noe som er grunnen til at overskriftsstruktur og selvstendige avsnitt endrer hva en motor kan sitere[1]. Google oppgir at ingen spesiell formatering er nødvendig for å vises i AI-funksjonene deres[2], mens Microsoft forteller utgivere at klare overskrifter, tabeller og FAQ-seksjoner gjør innholdet lettere å referere til[3]. De offentlige bevisene ligger mellom disse to posisjonene.
Hvordan svarsmotorer deler en side
Oppdeling eksisterer fordi innebyggings- og chatmodeller begrenser inndatalengden, og fordi én vektor beskriver en lang blandet side dårlig[1]. Microsofts hentedokumentasjon anbefaler å starte med 512 tokens per bit med 25 % overlapping, og nevner HTML-overskriftssyntaks som en måte å dele et dokument inn i seksjoner[4]. En evaluering fra 2024 fant at semantisk oppdeling, som plasserer grenser etter mening snarere enn etter lengde, ikke pålitelig slår fast størrelse-oppdeling[5]. Overskrifter på en side fungerer derfor mindre som et rangeringssignal enn som en grense: de bestemmer hvor en hentbar enhet starter og stopper.
Bevis fra kontrollerte tester
Artikkelen som navnga generativ søkemotoroptimalisering testet ni innholdsredigeringer mot en benchmark på 10 000 spørringer[6]. Å legge til sitater, statistikk eller kildehenvisninger ga en relativ gevinst på 30 til 40 % på synlighetsmålingen[7]. Nøkkelordfylling scoret 17,8 mot en baseline på 19,5, dårligere enn å la teksten være i fred[8]. Mønsteret favoriserer tekst som inneholder kontrollerbare spesifikasjoner fremfor tekst formet for nøkkelordmatch, en av de praktiske forskjellene mellom SEO og GEO.
Posisjon inne i dokumentet
Google kjører et passasjerangeringssystem som identifiserer individuelle seksjoner av en side for å bedømme relevans[9], slik at et begravd svar kan dukke opp uten at hele siden handler om det, mekanismen bak utvalgte utdrag. Inne i modellen koster posisjon fortsatt: svar er sterkest når den relevante teksten sitter i begynnelsen eller slutten av konteksten og svekkes når den sitter i midten[10]. En analyse av 1,4 millioner ChatGPT-spørsmål fant siterte sidetitler nærmere spørsmålet enn usiterte, 0,602 mot 0,484 cosinuslikhet[11].
Begrensninger i bevisene
Ingen svarsmotor publiserer sin chunker. Googles veiledning sier at en side bare trenger å være indeksert og utdrag-kvalifisert[12], noe som gjør formateringsråd ubekreftet mot rangeringssystemet det hevder å adressere. Formatstudiene er korrelasjonelle, og den ene kontrollerte benchmarken optimaliserer en proxy-score over et syntetisk spørringssett i stedet for live trafikk[6]. Motorer tilskriver også ufullkomment: en evaluering fra 2023 av fire generative søkemotorer fant at 51,5 % av genererte setninger var fullt støttet av sitatene deres og 74,5 % av sitatene støttet setningen de satt under[13].
Data
Vis tallene (2)
| Punkt | likhet |
|---|---|
| Siterte | 0.6 |
| Ikke siterte | 0.48 |
Referanser (13)
- Del opp dokumenter for vektorsøk, Azure AI Search Arkiv
- AI-funksjoner og nettstedet ditt Arkiv
- Introduksjon av AI-ytelse i Bing Webmaster Tools offentlig forhåndsvisning Arkiv
- Del opp dokumenter for vektorsøk, Azure AI Search Arkiv
- Er semantisk oppdeling verdt den beregningsmessige kostnaden? Arkiv
- GEO: Generativ søkemotoroptimalisering, introduksjon Arkiv
- GEO: Generativ søkemotoroptimalisering, seksjon 4 Arkiv
- GEO: Generativ søkemotoroptimalisering, tabell 1 Arkiv
- En guide til Googles søkerangeringssystemer Arkiv
- Tapt i midten: Hvordan språkmodeller bruker lange kontekster Arkiv
- Hvorfor ChatGPT siterer én side fremfor en annen, en studie av 1,4 millioner spørsmål Arkiv
- AI-funksjoner og nettstedet ditt Arkiv
- Evaluering av verifiserbarhet i generative søkemotorer Arkiv
Sist oppdatert 2026-09-04. Skrevet og vedlikeholdt av Baseline Labs.