Hvorfor bliver PDF'er ikke citeret oftere af AI-søgning?
Kun 0,4 % af AI-søgningssvar citerer en PDF, og de citerede er for det meste officielle dokumenter. Data om hvilke PDF'er der citeres, og hvorfor de forbliver n...
Kun 0,4 % af AI-søgningssvarene citerer PDF-dokumenter — skrevne sider dominerer. Fuld opdeling pr. søgemaskine med de rå tal.
På tværs af de fem AI-søgemaskiner citerer kun 0,4 % af svarene PDF-dokumenter — langt størstedelen af citationerne peger på almindelige skrevne websider.
Kun 80 ud af 19.279 svar (0,4 %) på tværs af de fem overvågede AI-søgemaskiner citerer PDF-dokumenter. Skrevne HTML-websider står for stort set alle de resterende — så svaret på, om AI-modeller foretrækker PDF-indhold frem for artikler, er et klart nej, i hvert fald for dette sæt af prompts.
Google AI Mode citerer PDF-dokumenter mest (0,8 %) og Perplexity mindst (0,1 %) — en faktor 12 i forskel, men selv føreren holder sig i lave encifrede procenter. PDF-indhold er en niche-citationskilde, ikke en mainstream-kilde, i alle overvågede søgemaskiner. Den søgemaskine, der læner sig mest op ad det (Google AI Mode), er værd at bemærke, hvis PDF er centralt for dit indhold, men ingen søgemaskine behandler det som et primært format.
| AI-søgemaskine | Svar | Citerer PDF-dokumenter | Rate |
|---|---|---|---|
| Google AI Mode | 3.975 | 31 | 0,8 % |
| ChatGPT | 5.119 | 35 | 0,7 % |
| Gemini | 5.123 | 10 | 0,2 % |
| Google AI Overviews | 2.010 | 2 | 0,1 % |
| Perplexity | 3.052 | 2 | 0,1 % |
De PDF’er, der rent faktisk bliver citeret, trækker i retning af officielle og institutionelle dokumenter (offentlige myndigheder, standardiseringsorganisationer, store konsulenthuse), der primært findes i PDF-form — ikke marketingsmateriale. Hvis indhold kan leve som en HTML-side, er den version langt mere tilbøjelig til at blive fundet frem og citeret end en PDF af samme materiale.
Målt dagligt i Google AI Mode (dens stærkeste søgemaskine) forbliver PDF-citationsraten lav og stabil hen over perioden — dette er en stabil strukturel præference for skrevne sider, ikke et midlertidigt dyk.
Hvis dit mål er AI-søgningscitationer, så er skrevne HTML-sider fortsat arbejdshesten — PDF-dokumenter citeres alt for sjældent til at bygge en strategi omkring. Publicér på HTML først. Gem PDF’er til formelle dokumenter, hvor selve formatet tilfører troværdighed (rapporter, specifikationer, indberetninger); til alt andet er en HTML-side det citerbare aktiv. Hvis du må sende en PDF afsted, så publicér også en ledsagende HTML-side.
PDF-citationsraten på 0,4 % er endnu lavere end video -citationsraten (2,6 %). Dette er slående, fordi PDF’er i princippet er lettere for AI-søgemaskiner at behandle end video — de indeholder udvindbar tekst, de er statiske dokumenter, og de er udbredt brugt til autoritativt indhold som forskningsartikler, offentlige rapporter og tekniske specifikationer.
Så hvorfor bliver PDF’er citeret så sjældent? Der er flere sandsynlige forklaringer:
PDF’er er ofte låst bag login eller svære at opdage. Mange PDF’er ligger bag formularer, betalingsmure eller i dybe mappestrukturer, som søgecrawlere måske ikke udforsker fuldt ud. En HTML-side er typisk linket fra sidens navigation; en PDF er ofte en isoleret fil.
PDF’er er sværere at fortolke ensartet. Selvom PDF’er indeholder tekst, kan udtrækningsprocessen være upålidelig — layout med flere spalter, indlejrede billeder og kompleks formatering kan give forvansket eller ufuldstændig tekst. HTML er et struktureret format designet til tekstudtrækning.
PDF’er mangler metadata og kontekst. En HTML-side har typisk en titel-tag, meta-beskrivelse, overskrifter og skema-markup. En PDF har intet af dette — eller har det i en mindre standardiseret form. AI-søgemaskiner er afhængige af disse metadata for at forstå, hvad en side handler om.
PDF’er er ikke webets primære format. Webben er overvejende HTML. AI-søgemaskiner er optimeret til HTML. PDF’er er et sekundært format, der kræver særlig håndtering.
Citationsraten på 0,4 % betyder ikke, at PDF’er er værdiløse. Det betyder, at de er et nicheformat for AI-citationer. Hvis dit indhold kan leve som en HTML-side, er det den version, der vil opnå citationer.
De PDF’er, der faktisk kommer med i det citerede sæt, har et tydeligt mønster: De er officielle, autoritative dokumenter, der primært eller udelukkende findes i PDF-form. Eksempler fra vores data inkluderer:
Disse dokumenter deler to egenskaber: De er autoritative af natur på grund af deres kilde, og de er ikke tilgængelige i en tilsvarende HTML-version. AI-søgemaskinen citerer PDF’en, fordi den er den bedst tilgængelige kilde til den pågældende information — ikke fordi PDF er et foretrukket format.
For de fleste organisationer har det indhold, I producerer (blogindlæg, guides, produktdokumentation, casestudier), ikke disse egenskaber. Det kan — og bør — leve som HTML.
Hvis du har indhold, der skal publiceres som PDF (en formel rapport, en hvidbog, en specifikation), er den mest effektive tilgang at publicere en ledsagende HTML-side. Dette er en webside, der:
Arshia er AI Workflow Engineer hos FlowHunt. Med en baggrund i datalogi og en passion for AI specialiserer han sig i at skabe effektive arbejdsgange, der integrerer AI-værktøjer i dagligdagens opgaver og øger produktiviteten og kreativiteten.

Se hvilke AI-søgemaskiner der citerer dit indhold — på tværs af ChatGPT, Perplexity, Gemini og flere.
Kun 0,4 % af AI-søgningssvar citerer en PDF, og de citerede er for det meste officielle dokumenter. Data om hvilke PDF'er der citeres, og hvorfor de forbliver n...
ChatGPT citerede PDF-dokumenter i 0,7% af svarene på tværs af 1.905 sporede forespørgsler — opdelt efter motor, efter hjemmeside, over tid, med rådata.
Kun 2,6 % af AI-søgningssvar citerer videosider (YouTube, Vimeo, Dailymotion) — skrevne sider dominerer. Fuld opdeling pr. søgemaskine med de rå tal.
Cookie Samtykke
Vi bruger cookies til at forbedre din browsingoplevelse og analysere vores trafik. See our privacy policy.