Gå til indhold
CitationLab
Tilbage til Måling og værktøjer
Måling og værktøjer

AI sender trafik til sider, du ikke har

AI-assistenter sender brugere til URL'er, der ikke findes på dit website. Hallucination får skylden, men den vigtigste årsag i dag er gammel hukommelse — en model, der peger mod den URL-struktur, du forlod for to migreringer siden.

KR
Krister Ross
Grundlægger og administrerende direktør, CitationLab
Udgivet Opdateret 8 min læsning
Nysgerrig på, hvordan AI omtaler dit brand?Kør et gratis synlighedstjek

404 er ikke et nyt problem. Brugeren er ny

404 betyder ganske enkelt, at ressourcen ikke findes. Statuskoden blev lavet for at svare på forespørgsler mod indhold, der ikke er der, ikke for at håndtere stavefejl.

Volumen kom heller aldrig fra folk, der skrev forkert i adressefeltet. Den kom fra os selv. Nyt design, ny URL-struktur, flyttet indhold, og pludselig pegede alt det gamle ud i den blå luft. Google begyndte tidligt at vægte dette, og allerede omkring 2012 var 404-jagt standard i al seriøs webanalyse. De dyreste tilfælde var altid de samme to: en URL, der lå i søgeresultatet og førte til ingenting, og en annonce, du betalte for, som landede på en fejlside.

Siden er vi blevet langt bedre til omdirigeringer. Men ikke nødvendigvis til de rigtige omdirigeringer. Rigtig mange websites løser 404 ved at sende alt til forsiden. Det fjerner fejlkoden og bevarer nul relevans.

Det holdt, så længe trafikken kom fra en crawler, der fulgte links. Nu kommer den fra noget andet.

Hallucination er ikke længere hovedforklaringen

Dette er værd at slå fast, fordi halvdelen af branchen stadig gentager det.

Tidlige modeller konstruerede URL'er ved ren mønstergenkendelse. De vidste, hvordan et website plejer at se ud, og gættede. Det blev et stort nok problem til, at leverandørerne byggede egne lag omkring linkhåndtering. Moderne assistenter henter i langt højere grad URL'er fra faktiske søgninger og hentede sider i stedet for at regne dem ud fra hukommelsen. Gættede URL'er forekommer stadig, men andelen er faldet kraftigt og fortsætter med at falde.

Det, der ikke er faldet, er alt det andet.

Fire årsager, der stadig gælder

1. Modellen husker rigtigt, men gammelt. Dette er den vigtigste, og den ingen taler om. En model har ingen god intern tidsstempling. Den ved ikke altid, hvad den lærte i 2023, og hvad den lærte i 2025. Lancerede du et nyt website i 2025, lever den gamle struktur fra 2023 videre i hukommelsen og kan blive brugt, som om den var gældende. Det er ikke hallucination. Det er teknisk gæld, der pludselig får trafik igen.

2. Modellen citerer noget, du har fjernet. En kampagneside, en gammel artikel, en produktside du afpublicerede. Den lever videre i modellens hukommelse og i tredjeparts citater længe efter, den forsvandt fra dit website.

3. Linket brydes undervejs. Afsluttende parenteser, afkortede URL'er, markdown-formatering der ikke overlever kopiering ud af chatvinduet. Trivielt, men målbart.

4. Modellen gætter stadig indimellem. Sjældnere end før, men det sker. Især på websites med lidt hentbart indhold, hvor modellen har lidt andet at gå efter.

Dette er et udvalg, ikke en komplet liste. 404 opstår også af intern fejllinkning, ødelagte kanoniske URL'er, tredjeparter der linker forkert, udløbne kampagne-URL'er og en lang række andre grunde. Pointen her er ikke at dække dem alle, men at pege på dem, der er nye.

Sådan ser det ud i én log

Vi kørte tallene på et kundewebsite. Tabellen nedenfor er et øjebliksbillede af bot-loggen der pr. 10. august 2026, sorteret efter antal besøg. Hver række går op: 200-svar plus 404-svar er lig med det samlede antal forespørgsler, så dette er komplette tal per bot, ikke en stikprøve.

BotKategoriBesøg404Andel 404
BingbotSøgemaskine2.1191396,6 %
Unknown BotUkendt1.9041.63185,7 %
CCBotAI-crawler1.5241.52299,9 %
GooglebotSøgemaskine1.18331326,5 %
BaiduspiderSøgemaskine56818632,7 %
ChatGPT-UserAI-crawler1838747,5 %
PerplexityBotAI-crawler1494530,2 %
SemrushBotSEO-værktøj1463221,9 %
YandexBotSøgemaskine682638,2 %
TwitterbotSociale medier1700,0 %
DuckDuckBotSøgemaskine14321,4 %
LinkedInBotSociale medier500,0 %
Alle bots7.8803.98450,6 %
Bot-log fra et kundewebsite, øjebliksbillede 10. august 2026. AI-crawlere fremhævet.

Halvdelen af al bot-trafik ramte en side, der ikke findes. Men fordelingen er det interessante. Søgemaskinerne samlet lå på 16,9 % — Bingbot, den største enkeltkilde til forespørgsler, på 6,6 %. AI-crawlerne samlet lå på 89,1 %.

Én række bærer det tal. CCBot, Common Crawls crawler, ramte forkert på 1.522 af 1.524 forespørgsler. Common Crawl er et af de korpora, der leverer træningsdata til modellerne, og den arbejder sig gennem en URL-liste, der er flere år gammel — altså årsag nummer et ovenfor, observeret direkte i stedet for argumenteret for. Holder vi CCBot udenfor, ligger de resterende AI-crawlere på 39,8 %, stadig mere end dobbelt så højt som søgemaskinerne. Den ærlige læsning er, at én crawler dominerer overskriftstallet, og at mønsteret overlever, at den fjernes.

Rækken, der betyder mest kommercielt, er alligevel ChatGPT-User: 87 af 183 forespørgsler, 47,5 %. Det er ikke en crawler, der indekserer i baggrunden. Det er agenten, der henter en side, fordi et faktisk menneske sidder i chatten og venter på svaret. Næsten halvdelen af dem fik en fejlside.

Dette er ét website på ét tidspunkt, ikke en branchemåling. Tallet, du skal handle på, er dit eget.

Volumenargumentet holder ikke længere

For et år siden var det rimeligt at afvise dette. AI-henvisninger var marginale for de allerfleste websites, og 404-besøg var en brøkdel af det igen.

Det har ændret sig hurtigt. Vi ser websites, hvor AI-drevet trafik er mangedoblet på seks måneder, og hvor den nu er blandt de vigtigste organiske kilder. Ikke i volumen på niveau med Google, men i betydning.

Og selv hvis volumen stadig var lav, ville argumentet holde. For det egentlige argument er værdi per besøg.

En bruger, der klikker ind fra ChatGPT eller Perplexity, har allerede været igennem research- og vurderingsfasen, med modellen som rådgiver. De har stillet opfølgende spørgsmål. De har fået en anbefaling. De kommer ikke for at orientere sig. De kommer for at handle.

Det er ikke et klik fra position fire i søgeresultatet. Det er en henvisning — og det er også derfor placering og citering er to forskellige spil.

At møde den henvisning med «Beklager, siden findes ikke» er blandt de dyreste tab per besøg i hele din funnel. Og i modsætning til et tabt organisk klik får du ingen ny chance. Brugeren går ikke tilbage til chatten for at bede om et alternativ. De går til konkurrenten, modellen nævnte i samme sætning.

404-loggen som indholdsdata, og hvorfor den har en udløbsdato

Her er en vinkel, der har været reelt nyttig, og som er værd at bruge lige nu.

Når en model gentagne gange gættede på en URL, du ikke havde, fortalte den dig noget værdifuldt: hvad den forventede, at en virksomhed som din tilbyder. Peger flere modeller uafhængigt af hinanden mod /priser, har du et transparensproblem. Peger de mod en beregner, du aldrig har bygget, har du et indholdshul valideret af selve det system, du forsøger at blive citeret i.

Men vær ærlig om holdbarheden. Grundlaget for denne metode forsvinder i takt med, at modellerne holder op med at gætte URL'er. Brug den, så længe den varer. Byg ikke en metodik på den.

Det, der erstatter den, er fan-out. Når en bruger stiller ét spørgsmål, bryder modellen det ned i en række delspørgsmål, den søger på internt, før den svarer. Det er der, den faktiske efterspørgsel ligger, og det er langt rigere data end en håndfuld gættede URL'er. Fan-out fortæller dig, hvilke spørgsmål du skal besvare. 404-loggen fortalte dig kun, hvilke URL'er nogen troede, du havde.

Sådan gør du i praksis

Tjek først, om du overhovedet måler 404-siden. 404-sider kan sagtens måles. Problemet er, at næsten ingen gør det. Nogle sender alle 404-besøg videre til forsiden med en omdirigering, hvilket ser ryddeligt ud og samtidig sletter det eneste datagrundlag, der ville vise dig, at det sker. Andre har en 404-side, der ligger uden for det almindelige skabelonsystem og derfor mangler analytics-tagging. I begge tilfælde findes problemet ikke i dine rapporter. Det findes kun i virkeligheden. Serverlogs eller Cloudflare-analytics fanger det, GA4 ikke ser.

Identificér AI-trafikken. Filtrér på henvisninger fra chatgpt.com, perplexity.ai, gemini.google.com og copilot.microsoft.com. Enkelte assistenter tilføjer også UTM-parametre automatisk — ChatGPT bruger utm_source=chatgpt.com, hvilket gør sporingen lettere. Vær opmærksom på, at en betydelig andel af AI-henvisninger kommer ind helt uden referrer, fordi brugeren kopierer linket manuelt. Serverloggen er sandheden her, ikke analyseværktøjet.

Regn med, at fordelingen er skæv. Over tolv uger på et andet kundewebsite (14. maj til 8. august 2026) registrerede GA4 594 sessioner fra AI-kilder. 559 af dem — 94 % — kom fra chatgpt.com. Perplexity stod for seks. Claude.ai for én. Lægger du målingen op omkring fire platforme med lige vægt, læser du forkert på noget, der i praksis er én platform plus en hale.

Regn også med falske positive. Den fjerde «AI-kilde» i samme rapport var slet ikke AI-trafik: et Vercel-preview-domæne, der tilfældigvis havde teksten «gemini» i værtsnavnet, fanget af et filter, der matchede på tekststreng. 28 sessioner, placeret forkert. Et værtsnavnsfilter er et udgangspunkt, ikke et svar — læs kildelisten, før du stoler på totalen.

GA4-rapport over sessioner fra AI-kilder: 594 sessioner fordelt på fire kilder, hvor chatgpt.com står for 559, et fejlklassificeret Vercel-preview-domæne for 28, Perplexity for seks og Claude.ai for én.
Sessioner fra AI-kilder på et andet kundewebsite, 14. maj til 8. august 2026. Række to er en falsk positiv, ikke en AI-platform.

Kør en gennemgang af omdirigeringer mod historiske URL-strukturer. Dette er den største og hurtigste gevinst, og den følger direkte af årsag nummer et. Find sitemap eller crawl fra før sidste migrering og tjek, hvad der faktisk svarer i dag. Omdirigér til nærmeste tilsvarende side, ikke til forsiden.

Gør 404-siden til et navigationspunkt. Søgefelt. Hovedkategorier. Ét tydeligt næste skridt. Ikke en undskyldning og et link til forsiden. Bevar statuskode 404. Lav den ikke om til en soft 404, der returnerer 200, det skaber indekseringsproblemer uden at løse noget som helst.

Håndtér mønstre, ikke enkeltbesøg. Går en URL igen over tid? Fandtes siden før: sæt et 301-redirect. Har den aldrig eksisteret: overvej faktisk at bygge den. Enkeltbesøg er støj.

Byg ikke en side til hvert gæt. Så laver du doorway-sider og indeksoppustning, og har byttet ét problem ud med et større.

Hvor du begynder

Træk de seneste 90 dages 404-besøg ud af serverloggene, sortér efter frekvens, og start med de URL'er, der faktisk fandtes før — det er omdirigeringer, du skylder dig selv, og de følger af den årsag, der betyder mest. Vil du se, hvilke sider modellerne tror, du har, før du graver i loggene, så kør et gratis AI-synlighedstjek, eller følg det løbende med AI Monitor.

Ofte stillede spørgsmål

Hallucinerer modellerne stadig URL'er?
Ja, men langt sjældnere end før. Leverandørerne har lagt egne mekanismer ind til linkhåndtering, og assistenterne henter i høj grad URL'er fra faktiske søgninger i stedet for at konstruere dem. Den mest almindelige årsag til AI-drevne 404'er i dag er forældet hukommelse, ikke opdigtede URL'er.
Skal 404-siden returnere statuskode 404 eller 200?
404. En side, der ligner en fejlmeddelelse, men returnerer 200, er en soft 404, og både søgemaskiner og AI-crawlere håndterer det dårligt. Optimér indholdet på siden, ikke statuskoden.
Hjælper det at sætte omdirigeringer op for gamle URL'er fra 2023?
Ja, og det er ofte den hurtigste gevinst, der findes. Gamle URL'er i træningsdata forsvinder ikke, fordi du migrerer. Omdirigér til nærmeste tilsvarende side, ikke til forsiden, som ikke bevarer noget af relevansen.
Hvordan ved jeg, hvilke AI-værktøjer der sender trafik til mig?
Kombinér referrer-analyse, UTM-parametre og serverlogs. Ingen af dem giver hele billedet alene — en betydelig andel AI-henvisninger kommer ind helt uden referrer, fordi brugeren kopierer linket manuelt ud af chatvinduet.

Var dette nyttigt?

Del:

Hold deg oppdatert

Få fagartikler, produktnyheter og analyser rett i innboksen.