Hopp til innhold
CitationLab
Tilbake til Måling og verktøy
Måling og verktøy

AI sender trafikk til sider du ikke har

AI-assistenter sender brukere til URL-er som ikke finnes på nettstedet ditt. Hallusinasjon får skylden, men den viktigste årsaken i dag er gammelt minne — en modell som peker mot URL-strukturen du forlot for to migreringer siden.

KR
Krister Ross
Grunnlegger og daglig leder, CitationLab
Publisert 8 min lesetid
Nysgjerrig på hvordan AI omtaler merkevaren din?Kjør en gratis synlighetssjekk

404 er ikke et nytt problem. Brukeren er ny

404 betyr ganske enkelt at ressursen ikke finnes. Statuskoden ble laget for å svare på forespørsler mot innhold som ikke er der, ikke for å håndtere skrivefeil.

Volumet kom heller aldri fra folk som skrev feil i adressefeltet. Det kom fra oss selv. Nytt design, ny URL-struktur, flyttet innhold, og plutselig pekte alt det gamle ut i løse luften. Google begynte tidlig å vekte dette, og allerede rundt 2012 var 404-jakt standard i all seriøs webanalyse. De dyreste tilfellene var alltid de samme to: en URL som lå i søkeresultatet og ledet til ingenting, og en annonse du betalte for som landet på en feilside.

Siden har vi blitt langt bedre på redirects. Men ikke nødvendigvis på riktige redirects. Svært mange nettsteder løser 404 ved å sende alt til forsiden. Det fjerner feilkoden og bevarer null relevans.

Det holdt så lenge trafikken kom fra en crawler som fulgte lenker. Nå kommer den fra noe annet.

Hallusinasjon er ikke lenger hovedforklaringen

Dette er verdt å slå fast, fordi halve bransjen fortsatt gjentar det.

Tidlige modeller konstruerte URL-er på ren mønstergjenkjenning. De visste hvordan et nettsted pleier å se ut, og gjettet. Det ble et stort nok problem til at leverandørene bygde egne lag rundt lenkehåndtering. Moderne assistenter henter i langt større grad URL-er fra faktiske søk og hentede sider i stedet for å regne dem ut fra minnet. Gjettede URL-er finnes fortsatt, men andelen har falt kraftig, og den fortsetter å falle.

Det som ikke har falt, er alt det andre.

Fire grunner som fortsatt gjelder

1. Modellen husker riktig, men gammelt. Dette er den viktigste, og den ingen snakker om. En modell har ingen god intern tidsstempling. Den vet ikke alltid hva den lærte i 2023 og hva den lærte i 2025. Lanserte du et nytt nettsted i 2025, lever den gamle strukturen fra 2023 videre i minnet og kan bli brukt som om den var gjeldende. Det er ikke hallusinasjon. Det er teknisk gjeld som plutselig får trafikk igjen.

2. Modellen siterer noe du har fjernet. En kampanjeside, en gammel artikkel, en produktside du avpubliserte. Den lever videre i modellens minne og i tredjeparts sitater lenge etter at den forsvant fra nettstedet ditt.

3. Lenken brekker på veien. Trailing parenteser, avkuttede URL-er, markdown-formatering som ikke overlever kopiering ut av chatvinduet. Trivielt, men målbart.

4. Modellen gjetter fortsatt av og til. Sjeldnere enn før, men det skjer. Særlig på nettsteder med lite hentbart innhold, der modellen har lite annet å gå på.

Dette er et utvalg, ikke en fullstendig liste. 404 oppstår også av intern feillenking, ødelagte kanoniske URL-er, tredjeparter som lenker feil, utløpte kampanje-URL-er og en lang rekke andre grunner. Poenget her er ikke å dekke alle, men å peke på de som er nye.

Slik ser det ut i én logg

Vi kjørte tallene på vårt eget nettsted. Tabellen under er et øyeblikksbilde av bot-loggen for citationlab.no per 10. august 2026, sortert etter antall treff. Hver rad går opp: 200-svar pluss 404-svar er lik totalt antall forespørsler, så dette er komplette tall per bot, ikke et utvalg.

BotKategoriTreff404Andel 404
BingbotSøkemotor2 1191396,6 %
Unknown BotUkjent1 9041 63185,7 %
CCBotAI-crawler1 5241 52299,9 %
GooglebotSøkemotor1 18331326,5 %
BaiduspiderSøkemotor56818632,7 %
ChatGPT-UserAI-crawler1838747,5 %
PerplexityBotAI-crawler1494530,2 %
SemrushBotSEO-verktøy1463221,9 %
YandexBotSøkemotor682638,2 %
TwitterbotSosiale medier1700,0 %
DuckDuckBotSøkemotor14321,4 %
LinkedInBotSosiale medier500,0 %
Alle bots7 8803 98450,6 %
Bot-logg, citationlab.no, øyeblikksbilde 10. august 2026. AI-crawlere uthevet.

Halvparten av all bot-trafikk traff en side som ikke finnes. Men fordelingen er det interessante. Søkemotorene samlet lå på 16,9 % — Bingbot, den største enkeltkilden til forespørsler, på 6,6 %. AI-crawlerne samlet lå på 89,1 %.

Én rad bærer det tallet. CCBot, Common Crawls crawler, bommet på 1 522 av 1 524 forespørsler. Common Crawl er ett av korpusene som mater treningsdata til modellene, og den jobber seg gjennom en URL-liste som er år gammel — altså årsak nummer én over, observert direkte i stedet for argumentert for. Holder vi CCBot utenfor, ligger de resterende AI-crawlerne på 39,8 %, fortsatt mer enn dobbelt så høyt som søkemotorene. Den ærlige lesningen er at én crawler dominerer overskriftstallet, og at mønsteret overlever at den fjernes.

Raden som betyr mest kommersielt er likevel ChatGPT-User: 87 av 183 forespørsler, 47,5 %. Det er ikke en crawler som indekserer i bakgrunnen. Det er agenten som henter en side fordi et faktisk menneske sitter i chatten og venter på svaret. Nesten halvparten av dem fikk en feilside.

Dette er ett nettsted på ett tidspunkt, ikke en bransjemåling. Tallet du skal handle på, er ditt eget.

Volumargumentet holder ikke lenger

For et år siden var det rimelig å avfeie dette. AI-referrals var marginale for de aller fleste nettsteder, og 404-treff var en brøkdel av det igjen.

Det har endret seg raskt. Vi ser nettsteder der AI-drevet trafikk har mangedoblet seg på seks måneder, og der den nå er blant de viktigste organiske kildene. Ikke i volum på nivå med Google, men i betydning.

Og selv om volumet fortsatt var lavt, ville argumentet holdt. Fordi det egentlige argumentet er verdi per treff.

En bruker som klikker seg inn fra ChatGPT eller Perplexity har allerede vært gjennom research- og vurderingsfasen, med modellen som rådgiver. De har stilt oppfølgingsspørsmål. De har fått en anbefaling. De kommer ikke for å orientere seg. De kommer for å handle.

Det er ikke et klikk fra posisjon fire i søkeresultatet. Det er en henvisning — og det er også derfor rangering og sitering er to ulike spill.

Å møte den henvisningen med «Beklager, siden finnes ikke» er blant de dyreste tapene per treff i hele funnelen din. Og i motsetning til et tapt organisk klikk, får du ingen ny sjanse. Brukeren går ikke tilbake til chatten for å be om et alternativ. De går til konkurrenten modellen nevnte i samme setning.

404-loggen som innholdsdata, og hvorfor den har en utløpsdato

Her er en vinkel som har vært reelt nyttig, og som er verdt å bruke akkurat nå.

Når en modell gjentatte ganger gjettet på en URL du ikke hadde, fortalte den deg noe verdifullt: hva den forventet at et selskap som ditt tilbyr. Peker flere modeller uavhengig av hverandre mot /priser, har du et transparensproblem. Peker de mot en kalkulator du aldri har bygget, har du et innholdsgap validert av selve systemet du prøver å bli sitert i.

Men vær ærlig om holdbarheten. Grunnlaget for denne metoden forsvinner i takt med at modellene slutter å gjette URL-er. Bruk den så lenge den varer. Ikke bygg en metodikk på den.

Det som erstatter den er fan-out. Når en bruker stiller ett spørsmål, bryter modellen det ned i en rekke underspørsmål den søker på internt før den svarer. Det er der den faktiske etterspørselen ligger, og det er langt rikere data enn en håndfull gjettede URL-er. Fan-out forteller deg hvilke spørsmål du må svare på. 404-loggen fortalte deg bare hvilke URL-er noen trodde du hadde.

Slik gjør du det i praksis

Sjekk først at du i det hele tatt måler 404-siden. 404-sider kan måles helt fint. Problemet er at nesten ingen gjør det. Noen sender alle 404-treff videre til forsiden med en redirect, noe som ser ryddig ut og samtidig sletter det eneste datagrunnlaget som ville vist deg at dette skjer. Andre har en 404-side som ligger utenfor det vanlige malsystemet og derfor mangler analytics-tagging. I begge tilfeller finnes ikke problemet i rapportene dine. Det finnes bare i virkeligheten. Serverlogger eller Cloudflare-analytics fanger det GA4 ikke ser.

Identifiser AI-trafikken. Filtrer på referrer fra chatgpt.com, perplexity.ai, gemini.google.com og copilot.microsoft.com. Enkelte assistenter legger også på UTM-parametere automatisk — ChatGPT bruker utm_source=chatgpt.com, som gjør sporingen enklere. Vær oppmerksom på at en betydelig andel AI-referrals kommer inn helt uten referrer, fordi brukeren kopierer lenken manuelt. Serverloggen er sannheten her, ikke analyseverktøyet.

Regn med at fordelingen er skjev. Over tolv uker på vårt eget nettsted (14. mai til 8. august 2026) registrerte GA4 594 økter fra AI-kilder. 559 av dem — 94 % — kom fra chatgpt.com. Perplexity sto for seks. Claude.ai for én. Legger du opp målingen rundt fire plattformer med lik vekt, leser du feil av noe som i praksis er én plattform pluss en hale.

Regn også med falske positive. Den fjerde «AI-kilden» i samme rapport var ikke AI-trafikk i det hele tatt: et Vercel-preview-domene som tilfeldigvis hadde teksten «gemini» i vertsnavnet, fanget opp av et filter som matchet på tekststreng. 28 økter, feilplassert. Et vertsnavnfilter er et utgangspunkt, ikke et svar — les kildelisten før du stoler på totalen.

GA4-rapport over økter fra AI-kilder: 594 økter fordelt på fire kilder, der chatgpt.com står for 559, et feilklassifisert Vercel-preview-domene for 28, Perplexity for seks og Claude.ai for én.
Økter fra AI-kilder, citationlab.no, 14. mai til 8. august 2026. Rad to er en falsk positiv, ikke en AI-plattform.

Kjør en redirect-revisjon mot historiske URL-strukturer. Dette er den største og raskeste gevinsten, og den følger direkte av årsak nummer én. Hent frem sitemap eller crawl fra før forrige migrering og sjekk hva som faktisk svarer i dag. Redirect til nærmeste tilsvarende side, ikke til forsiden.

Gjør 404-siden til et navigasjonspunkt. Søkefelt. Hovedkategorier. Ett tydelig neste skritt. Ikke en unnskyldning og en lenke til forsiden. Behold statuskoden 404. Ikke gjør den om til en soft 404 som returnerer 200, det skaper indekseringsproblemer uten å løse noe som helst.

Behandle mønstre, ikke enkelttreff. Går en URL igjen over tid? Fantes siden før: sett en 301. Har den aldri eksistert: vurder å faktisk bygge den. Enkelttreff er støy.

Ikke bygg en side for hver gjetning. Da lager du doorway-sider og indeksoppblåsing, og du har byttet ett problem mot et større.

Hvor du begynner

Hent ut de siste 90 dagene med 404-treff fra serverloggene, sorter på frekvens, og start med URL-ene som faktisk fantes før — det er redirects du skylder deg selv, og de følger av årsaken som betyr mest. Vil du se hvilke sider modellene tror du har før du graver i loggene, kjør en gratis AI-synlighetssjekk, eller følg det løpende med AI Monitor.

Ofte stilte spørsmål

Hallusinerer modellene fortsatt URL-er?
Ja, men langt sjeldnere enn før. Leverandørene har lagt inn egne mekanismer for lenkehåndtering, og assistentene henter i stor grad URL-er fra faktiske søk i stedet for å konstruere dem. Den vanligste årsaken til AI-drevne 404-er i dag er utdatert minne, ikke oppdiktede URL-er.
Skal 404-siden returnere statuskode 404 eller 200?
404. En side som ser ut som en feilmelding men returnerer 200 er en soft 404, og både søkemotorer og AI-crawlere håndterer det dårlig. Optimaliser innholdet på siden, ikke statuskoden.
Hjelper det å sette opp redirects for gamle URL-er fra 2023?
Ja, og dette er ofte den raskeste gevinsten som finnes. Gamle URL-er i treningsdata forsvinner ikke når du migrerer. Redirect til nærmeste tilsvarende side, ikke til forsiden, som ikke bevarer noe av relevansen.
Hvordan vet jeg hvilke AI-verktøy som sender trafikk til meg?
Kombiner referrer-analyse, UTM-parametere og serverlogger. Ingen av dem gir hele bildet alene — en betydelig andel AI-referrals kommer inn helt uten referrer, fordi brukeren kopierer lenken manuelt ut av chatvinduet.

Var dette nyttig?

Del:

Hold deg oppdatert

Få fagartikler, produktnyheter og analyser rett i innboksen.