404 er ikke et nyt problem. Brugeren er ny
404 betyder ganske enkelt, at ressourcen ikke findes. Statuskoden blev lavet for at svare på forespørgsler mod indhold, der ikke er der, ikke for at håndtere stavefejl.
Volumen kom heller aldrig fra folk, der skrev forkert i adressefeltet. Den kom fra os selv. Nyt design, ny URL-struktur, flyttet indhold, og pludselig pegede alt det gamle ud i den blå luft. Google begyndte tidligt at vægte dette, og allerede omkring 2012 var 404-jagt standard i al seriøs webanalyse. De dyreste tilfælde var altid de samme to: en URL, der lå i søgeresultatet og førte til ingenting, og en annonce, du betalte for, som landede på en fejlside.
Siden er vi blevet langt bedre til omdirigeringer. Men ikke nødvendigvis til de rigtige omdirigeringer. Rigtig mange websites løser 404 ved at sende alt til forsiden. Det fjerner fejlkoden og bevarer nul relevans.
Det holdt, så længe trafikken kom fra en crawler, der fulgte links. Nu kommer den fra noget andet.
Fire grunde til at AI sender folk til en side, der ikke findes
Hallucination er den forklaring, alle griber fat i. Den er også den mindst almindelige.
1. Modellen gætter en logisk URL. Sprogmodeller har en stærk opfattelse af, hvordan websites er struktureret. Ved den, at du sælger et produkt, antager den, at du har /priser, /beregner eller /kontakt. Den konstruerer URL'en, fordi den virker rimelig, ikke fordi den har set den.
2. Modellen husker rigtigt, men gammelt. Dette er det mest almindelige, og det ingen taler om. URL'en fandtes i 2023. Du lavede en migrering i 2024. Omdirigeringen blev aldrig sat op, eller den blev fjernet i en oprydning. Modellen husker den gamle struktur fra sine træningsdata og peger derhen. Det er ikke hallucination. Det er teknisk gæld, der pludselig får trafik igen.
3. Linket brydes undervejs. Afsluttende parenteser, afkortede URL'er, markdown-formatering der ikke overlever kopiering ud af chatvinduet. Trivielt, men målbart.
4. Modellen citerer noget, du har fjernet. En kampagneside, en gammel artikel, en produktside du afpublicerede. Den lever videre i modellens hukommelse længe efter, den forsvandt fra dit website.
Sådan ser det ud i én log
Vi kørte tallene på vores eget website. Tabellen nedenfor er et øjebliksbillede af bot-loggen for citationlab.no pr. 10. august 2026, sorteret efter antal besøg. Hver række går op: 200-svar plus 404-svar er lig med det samlede antal forespørgsler, så dette er komplette tal per bot, ikke en stikprøve.
| Bot | Kategori | Besøg | 404 | Andel 404 |
|---|---|---|---|---|
| Bingbot | Søgemaskine | 2.119 | 139 | 6,6 % |
| Unknown Bot | Ukendt | 1.904 | 1.631 | 85,7 % |
| CCBot | AI-crawler | 1.524 | 1.522 | 99,9 % |
| Googlebot | Søgemaskine | 1.183 | 313 | 26,5 % |
| Baiduspider | Søgemaskine | 568 | 186 | 32,7 % |
| ChatGPT-User | AI-crawler | 183 | 87 | 47,5 % |
| PerplexityBot | AI-crawler | 149 | 45 | 30,2 % |
| SemrushBot | SEO-værktøj | 146 | 32 | 21,9 % |
| YandexBot | Søgemaskine | 68 | 26 | 38,2 % |
| Twitterbot | Sociale medier | 17 | 0 | 0,0 % |
| DuckDuckBot | Søgemaskine | 14 | 3 | 21,4 % |
| LinkedInBot | Sociale medier | 5 | 0 | 0,0 % |
| Alle bots | 7.880 | 3.984 | 50,6 % | |
Halvdelen af al bot-trafik ramte en side, der ikke findes. Men fordelingen er det interessante. Søgemaskinerne samlet lå på 16,9 % — Bingbot, den største enkeltkilde til forespørgsler, på 6,6 %. AI-crawlerne samlet lå på 89,1 %.
Én række bærer det tal. CCBot, Common Crawls crawler, ramte forkert på 1.522 af 1.524 forespørgsler. Common Crawl er et af de korpora, der leverer træningsdata til modellerne, og den arbejder sig gennem en URL-liste, der er flere år gammel — altså årsag nummer to ovenfor, observeret direkte i stedet for argumenteret for. Holder vi CCBot udenfor, ligger de resterende AI-crawlere på 39,8 %, stadig mere end dobbelt så højt som søgemaskinerne. Den ærlige læsning er, at én crawler dominerer overskriftstallet, og at mønsteret overlever, at den fjernes.
Rækken, der betyder mest kommercielt, er alligevel ChatGPT-User: 87 af 183 forespørgsler, 47,5 %. Det er ikke en crawler, der indekserer i baggrunden. Det er agenten, der henter en side, fordi et faktisk menneske sidder i chatten og venter på svaret. Næsten halvdelen af dem fik en fejlside.
Dette er ét website på ét tidspunkt, ikke en branchemåling. Tallet, du skal handle på, er dit eget.
Hvorfor det betyder mere, end volumen antyder
Lad os være ærlige om volumen først: for de fleste websites er AI-henvisninger stadig en lille andel af den samlede trafik, og 404-besøg er en brøkdel af det igen. Hvis argumentet var «det er meget trafik», ville argumentet være svagt.
Argumentet er værdi per besøg.
En bruger, der klikker ind fra ChatGPT eller Perplexity, har allerede været igennem research- og vurderingsfasen, med modellen som rådgiver. De har stillet opfølgende spørgsmål. De har fået en anbefaling. De kommer ikke for at orientere sig. De kommer for at handle.
Det er ikke et klik fra position fire i søgeresultatet. Det er en henvisning — og det er også derfor placering og citering er to forskellige spil.
At møde den henvisning med «Beklager, siden findes ikke» er blandt de dyreste tab per besøg i hele din funnel. Og i modsætning til et tabt organisk klik får du ingen ny chance. Brugeren går ikke tilbage til chatten for at bede om et alternativ. De går til konkurrenten, modellen nævnte i samme sætning.
404-loggen er et indholdshul-datasæt
Her er den del, de fleste overser.
Når en model gentagne gange gætter på en URL, du ikke har, fortæller den dig noget værdifuldt: hvad den forventer, at en virksomhed som din tilbyder.
Peger flere modeller uafhængigt af hinanden mod /priser, har du et transparensproblem. Peger de mod en beregner, du aldrig har bygget, har du et indholdshul, der er valideret af selve det system, du forsøger at blive citeret i.
Det er efterspørgselsdata. Gratis. Fra den kilde, der afgør, om du bliver anbefalet eller ej.
Sådan gør du i praksis
Tjek først, om du overhovedet måler 404-siden. 404-sider kan sagtens måles. Problemet er, at næsten ingen gør det. Nogle sender alle 404-besøg videre til forsiden med en omdirigering, hvilket ser ryddeligt ud og samtidig sletter det eneste datagrundlag, der ville vise dig, at det sker. Andre har en 404-side, der ligger uden for det almindelige skabelonsystem og derfor mangler analytics-tagging. I begge tilfælde findes problemet ikke i dine rapporter. Det findes kun i virkeligheden. Serverlogs eller Cloudflare-analytics fanger det, GA4 ikke ser.
Identificér AI-trafikken. Filtrér på henvisninger fra chatgpt.com, perplexity.ai, gemini.google.com og copilot.microsoft.com. Enkelte assistenter tilføjer også UTM-parametre automatisk — ChatGPT bruger utm_source=chatgpt.com, hvilket gør sporingen lettere. Vær opmærksom på, at en betydelig andel af AI-henvisninger kommer ind helt uden referrer, fordi brugeren kopierer linket manuelt. Serverloggen er sandheden her, ikke analyseværktøjet.
Regn med, at fordelingen er skæv. Over tolv uger på vores eget website (14. maj til 8. august 2026) registrerede GA4 594 sessioner fra AI-kilder. 559 af dem — 94 % — kom fra chatgpt.com. Perplexity stod for seks. Claude.ai for én. Lægger du målingen op omkring fire platforme med lige vægt, læser du forkert på noget, der i praksis er én platform plus en hale.
Regn også med falske positive. Den fjerde «AI-kilde» i samme rapport var slet ikke AI-trafik: et Vercel-preview-domæne, der tilfældigvis havde teksten «gemini» i værtsnavnet, fanget af et filter, der matchede på tekststreng. 28 sessioner, placeret forkert. Et værtsnavnsfilter er et udgangspunkt, ikke et svar — læs kildelisten, før du stoler på totalen.

Gør 404-siden til et navigationspunkt. Søgefelt. Hovedkategorier. Ét tydeligt næste skridt. Ikke en undskyldning og et link til forsiden. Bevar statuskode 404. Lav den ikke om til en soft 404, der returnerer 200, det skaber indekseringsproblemer uden at løse noget som helst.
Håndtér mønstre, ikke enkeltbesøg. Går en URL igen over tid? Fandtes siden før: sæt et 301-redirect. Har den aldrig eksisteret: overvej faktisk at bygge den. Enkeltbesøg er støj.
Byg ikke en side for hvert gæt. Så laver du doorway-sider og indeksoppustning, og har byttet ét problem ud med et større. Tærsklen bør være gentagne mønstre over tid, ikke ét enkelt besøg.
Hvor du begynder
Træk de seneste 90 dages 404-besøg ud af serverloggene, sortér efter frekvens, og markér hver URL, en AI-model kunne have produceret. De, der fandtes før, er omdirigeringer, du skylder dig selv. De, der aldrig har eksisteret, er en indholdsbrief skrevet af modellerne selv. Vil du se, hvilke sider modellerne tror, du har, før du graver i loggene, så kør et gratis AI-synlighedstjek, eller følg det løbende med AI Monitor.
Ofte stillede spørgsmål
Skal 404-siden returnere statuskode 404 eller 200?
Bør jeg lave sider til URL'er, som AI finder på?
Hjælper det at sætte omdirigeringer op for gamle URL'er fra 2023?
Hvordan ved jeg, hvilke AI-værktøjer der sender trafik til mig?
Var dette nyttigt?
