På tvers av de fem AI-motorene er det bare 0,4 % av resultatene som siterer PDF-dokumenter — det store flertallet av sitater peker til vanlige skrevne nettsider.
Kun 80 av 19 279 resultater (0,4 %) på tvers av de fem sporede AI-motorene siterer PDF-dokumenter. Skrevne HTML-nettsider står for så å si alle de resterende — så svaret på om AI-modeller foretrekker PDF-innhold fremfor artikler er et tydelig nei, i hvert fall for dette settet med spørsmål.
Siteringsrate for PDF-dokumenter per AI-motor
Google AI Mode siterer PDF-dokumenter mest (0,8 %) og Perplexity minst (0,1 %) — en 12× forskjell, men selv lederen holder seg på lave ensifrede tall. PDF-innhold er en nisjekilde for sitater, ikke en mainstream-kilde, i alle sporede motorer. Motoren som lener seg mest på det (Google AI Mode) er verdt å merke seg hvis PDF er sentralt i innholdet ditt, men ingen motor behandler det som et primærformat.
De underliggende tallene
| AI-motor | Resultater | Siterer PDF-dokumenter | Andel |
|---|---|---|---|
| Google AI Mode | 3 975 | 31 | 0,8 % |
| ChatGPT | 5 119 | 35 | 0,7 % |
| Gemini | 5 123 | 10 | 0,2 % |
| Google AI Overviews | 2 010 | 2 | 0,1 % |
| Perplexity | 3 052 | 2 | 0,1 % |
Hva blir faktisk sitert i stedet
PDF-ene som faktisk blir sitert, skrår mot offisielle og institusjonelle dokumenter (offentlige organer, standardiseringsorganisasjoner, store konsulentfirmaer) som primært eksisterer i PDF-format — ikke markedsføringsmateriell. Hvis innhold kan publiseres som en HTML-side, er den versjonen langt mer sannsynlig å bli hentet frem og sitert enn en PDF av samme materiale.
PDF-siteringer over tid
Sporing daglig i Google AI Mode (den sterkeste motoren) viser at PDF-siteringsraten holder seg lav og flat over perioden — dette er en stabil strukturell preferanse for skrevne sider, ikke en midlertidig nedgang.
Hva dette betyr for innholdsstrategien
Hvis målet ditt er AI-søkesiteringer, er skrevne HTML-sider fortsatt arbeidshestformatet — PDF-dokumenter siteres altfor sjelden til å bygge en strategi rundt. Publiser på HTML først. Reserver PDF-er for formelle dokumenter der selve formatet tilfører troverdighet (rapporter, spesifikasjoner, innleveringer); for alt annet er en HTML-side den siterbare eiendelen. Hvis du må levere en PDF, publiser en HTML-følgeside også.
Hvorfor PDF-er er nesten usynlige for AI-søk
PDF-siteringsraten på 0,4 % er enda lavere enn video siteringsraten (2,6 %). Dette er slående fordi PDF-er i prinsippet er enklere for AI-motorer å behandle enn video — de inneholder uttrekkbar tekst, de er statiske dokumenter, og de er mye brukt for autoritativt innhold som forskningsartikler, offentlige rapporter og tekniske spesifikasjoner.
Så hvorfor blir PDF-er sitert så sjelden? Det finnes flere sannsynlige forklaringer:
PDF-er er ofte beskyttet eller vanskelige å oppdage. Mange PDF-er ligger bak skjemaer, betalingsmurer eller i dype mappestrukturer som søkekrawlere ikke nødvendigvis utforsker fullt ut. En HTML-side er typisk lenket fra nettstedets navigasjon; en PDF er ofte en isolert fil.
PDF-er er vanskeligere å tolke konsistent. Selv om PDF-er inneholder tekst, kan uttrekksprosessen være upålitelig — flerspalteoppsett, innebygde bilder og kompleks formatering kan gi ufullstendig eller forvrengt tekst. HTML er et strukturert format designet for teksteksport.
PDF-er mangler metadata og kontekst. En HTML-side har typisk en tittel-tagg, meta-beskrivelse, overskrifter og skjemamerking. En PDF har ingen av disse — eller har dem i en mindre standardisert form. AI-motorer er avhengige av denne metadataen for å forstå hva en side handler om.
PDF-er er ikke nettets primærformat. Nettet er overveldende HTML. AI-motorer er optimalisert for HTML. PDF-er er et sekundært format som krever spesiell håndtering.
Siteringsraten på 0,4 % betyr ikke at PDF-er er verdiløse. Det betyr at de er et nisjeformat for AI-siteringer. Hvis innholdet ditt kan leve som en HTML-side, er det den versjonen som vil oppnå sitater.
Når PDF-er faktisk blir sitert
PDF-ene som faktisk havner i siteringsmengden har et tydelig mønster: de er offisielle, autoritative dokumenter som primært eller utelukkende eksisterer i PDF-format. Eksempler fra våre data inkluderer:
- Offentlige hvitbøker og regulatoriske innleveringer
- Akademiske forskningsartikler (spesielt fra .edu-domener)
- Tekniske standarddokumenter (ISO, W3C, IETF)
- Store konsulentrapporter (McKinsey, Deloitte, BCG)
Disse dokumentene deler to egenskaper: de er autoritative av natur fra sin kilde, og de er ikke tilgjengelige i en tilsvarende HTML-versjon. AI-motoren siterer PDF-en fordi den er den beste tilgjengelige kilden for den informasjonen — ikke fordi PDF er et foretrukket format.
For de fleste organisasjoner har innholdet du produserer (blogginnlegg, guider, produktdokumentasjon, casestudier) ikke disse egenskapene. Det kan — og bør — leve som HTML.
HTML-følgesidestrategien
Hvis du har innhold som må publiseres som PDF (en formell rapport, en hvitbok, en spesifikasjon), er den mest effektive tilnærmingen å publisere en HTML-følgeside. Dette er en nettside som:
- Oppsummerer hovedfunnene eller spesifikasjonene fra PDF-en
- Gir kontekst og bakgrunn som PDF-en kan mangle
- Lenker til PDF-en for lesere som ønsker hele dokumentet
- Inkluderer riktig overskriftstruktur, metadata og skjemamerking
