Så blir ni citerade av ChatGPT och Perplexity
För att bli citerad av en språkmodell behöver tre saker stämma: innehållet måste finnas i serversvaret utan att kräva JavaScript, roboten måste vara insläppt i robots.txt, och stycket måste gå att lyfta ur sidan utan att tappa mening. Det tredje är det som skiljer mest, eftersom en modell sällan citerar en hel sida utan ett enskilt stycke.
Kan AI-robotarna ens läsa er sida?
Hämta er egen sida utan att köra JavaScript och läs vad som kommer tillbaka. Är brödtexten där är grunden i ordning. Är svaret ett tomt element som fylls av ett skript ser flera AI-robotar ingenting alls. Googles sökrobot klarar att rendera JavaScript, men flera av de robotar som matar språkmodeller gör det inte. Det här är det första steget och det är förvånande ofta det enda som behövs.
Släpper ni in rätt robotar?
Många standarduppsättningar och säkerhetsleverantörer blockerar AI-robotar som förval. Vill ni bli citerade behöver de vara uttryckligen insläppta i robots.txt. Robotarna att känna till just nu:
- GPTBot och OAI-SearchBot, för ChatGPT.
- ClaudeBot och Claude-SearchBot.
- PerplexityBot.
- Google-Extended, som styr användning i Googles AI-svar separat från vanlig sökning.
- Applebot-Extended och Meta-ExternalAgent.
Vilka robotar är det som hämtar?
De är inte en grupp utan flera, och de styrs var för sig i robots.txt. Att släppa in Googlebot säger ingenting om de andra.
| Robot | Matar | Kör JavaScript |
|---|---|---|
| GPTBot | ChatGPT, träning och index | Nej |
| OAI-SearchBot | ChatGPT sökresultat | Nej |
| ClaudeBot | Claude | Nej |
| PerplexityBot | Perplexity | Delvis |
| Google-Extended | Googles AI-svar, separat från sök | Via Googlebot |
| Googlebot | Vanlig sökning och AI Overviews | Ja |
Hur skriver man ett citerbart stycke?
Det här är den förändring som ger mest och kostar minst. Ett stycke som börjar med "Det här betyder att..." och syftar bakåt blir obegripligt när det lyfts ut ur sammanhanget. Inled i stället med att upprepa ämnet och ge svaret direkt. Skriv "AI-automation innebär att..." i stället för "Det innebär att...". Det känns övertydligt när man skriver det och läser helt normalt på sidan.
Vilken struktur hjälper maskinen välja?
Rubriker som är faktiska frågor, ett svar direkt under rubriken, listor där innehållet är en uppräkning. Schema.org i JSON-LD talar om vem som står bakom innehållet och vilka frågor sidan besvarar. Det är samma data som driver rika sökresultat och som modellerna använder för att bedöma om en källa är trovärdig nog att citera.
Hur mäter man något som inte syns i analysen?
Trafik från AI-svar saknar ofta referens och dyker därför inte upp som en kanal i analysen. Två saker går ändå att mäta. Serverloggen visar vilka AI-robotar som faktiskt hämtar era sidor och hur ofta. Och ni kan ställa samma tjugo frågor om er kategori till modellerna varje månad och spara svaren. Det andra är trubbigt men det är det enda som visar om ni faktiskt nämns.
Bör ni blockera AI-robotarna i stället?
Det beror på vad ni säljer. Ett förlag som lever på sitt innehåll har ett verkligt skäl att blockera. Ett tjänsteföretag som vill bli rekommenderat har det inte, eftersom en blockerad sajt inte kan citeras. För de flesta B2B-företag är AI-svar en kanal och inte en läcka.
Vanliga frågor
Hur vet jag om min sida går att läsa av AI-robotar?
Hämta sidan utan att köra JavaScript, till exempel med curl, och läs vad som kommer tillbaka. Finns rubriker, brödtext och länkar i svaret är grunden i ordning. Kommer det tillbaka ett tomt element som fylls av ett skript ser flera AI-robotar ingenting alls. Det tar trettio sekunder och är den enskilt viktigaste kontrollen.
Hur lång tid tar det innan man syns i AI-svar?
Betydligt längre än i vanlig sökning, och det går inte att lova en tidpunkt. Robotarna hämtar om med olika intervall, och att bli citerad kräver dessutom att modellen bedömer er som en rimlig källa för just den frågan. Räkna i månader snarare än veckor, och mät genom att ställa samma frågor med jämna mellanrum.
Måste vi ha llms.txt för att bli citerade?
Nej. llms.txt är ett förslag, inte en etablerad standard, och stödet varierar mellan leverantörer. Den tar en halvtimme att generera ur data ni redan har, så den är billig att lägga till, men den större effekten kommer från att innehållet finns i HTML och är skrivet i avgränsade stycken.
Blockerar Cloudflare eller vår brandvägg AI-robotarna?
Ofta ja, som förval, och det syns inte i robots.txt eftersom blockeringen sker ett lager ovanför. Det är den vanligaste förklaringen jag ser till att en sajt inte hämtas alls trots att robots.txt ser korrekt ut. Kontrollera botinställningarna hos er CDN eller säkerhetsleverantör, och verifiera sedan i serverloggen att besöken faktiskt kommer fram.
