Heartspace
Handbok i AI-synlighet . Kapitel 6 av 8

Golvet i praktiken

Börja med crawlbarhet, indexering, tydliga företagsuppgifter och läsbart innehåll. Det är grunden för webbaserade AI-svar, men ingen teknisk åtgärd garanterar att ni blir nämnda.

13 min . Uppdaterad 3 september 2026 . Sohrab Fadai
Börja här

Kolla att AI-tjänsterna får läsa er sajt

  1. Skriv er-domän.se/robots.txt i webbläsaren. Sök efter GPTBot, ClaudeBot, PerplexityBot och Google-Extended. Står det Disallow under någon av dem?
  2. Öppna en av era viktigaste sidor, högerklicka och välj Visa källkod. Sök efter ordet noindex.
  3. Skriv in era subdomäner i webbläsaren, alltså adresser som press.er-domän.se, karriar.er-domän.se och blogg.er-domän.se. Fungerar de, och vad visar de?

Tjugo minuter. Punkt tre brukar ge överraskningar.

Robots.txt: filen som släpper in eller stänger ute

Om en tjänst inte får hämta en sida kan den sidan inte användas som en aktuell webkälla i den tjänsten. Företaget kan fortfarande nämnas utifrån andra källor, så robots.txt är en viktig kontroll men inte hela förklaringen till synlighet.

Robots.txt ligger på er domän och anger vilka delar olika crawlers får hämta. Blockeringar kan vara avsiktliga, men de kan också följa med från en äldre mall, ett säkerhetsverktyg eller en testmiljö. Kontrollera därför den faktiska filen i stället för att anta hur den ser ut.

Exempel på sökcrawlers att kontrollera
User-agent: OAI-SearchBot Allow: / User-agent: ClaudeBot Allow: / User-agent: PerplexityBot Allow: / User-agent: Googlebot Allow: /

Google-Extended styr inte om en sida kan visas i vanlig Google Search, AI Overviews eller AI Mode. För de funktionerna är Googlebot, indexering och vanliga Search-regler relevanta. Google-Extended är en separat kontroll för användning i vissa andra generativa Google-system.

Kärnan

Vanliga tekniska hinder är sådant som blivit kvar av misstag: blockerade crawlers, noindex på viktiga sidor, trasiga redirects eller gammalt innehåll som fortfarande går att hitta.

Tre blockeringar som brukar ligga kvar

Vanligast

Pressrummet

Pressrum och andra externa publiceringslösningar kan ibland råka vara noindex eller ligga bakom andra åtkomsthinder. Kontrollera de faktiska sidorna i stället för att anta att publicerat betyder indexerbart.

Näst vanligast

Testmiljön som blev kvar

En testversion av sajten där allt blockerades, som aldrig togs bort när den riktiga sajten lanserades. Eller en gammal subdomän som ger ett felmeddelande i stället för att skicka vidare.

Svårast att se

Text som laddas in efteråt

Innehåll som kräver mycket klientkod kan vara svårare för vissa crawlers att hämta eller tolka. Viktiga texter och fakta bör därför finnas i den HTML som söksystemen faktiskt kan läsa.

Gamla subdomäner och trasiga sidor kan fortsätta dyka upp i sökindex, länkar och andra källor. När innehållet inte längre ska finnas bör adresserna hanteras med rätt statuskod eller redirect till en relevant aktuell sida. Det minskar risken att gamla beskrivningar fortsätter cirkulera.

Se till att modellen förstår vilket bolag ni är

När de viktigaste sidorna går att hämta är nästa fråga om grundfakta om organisationen och personerna är tydliga och konsekventa. Det hjälper både människor och söksystem att förstå vad innehållet handlar om.

Skriv tydligt vad ni gör, för vem och inom vilket område. Grundfakta bör vara konsekventa på den egna sajten och i viktiga företagsprofiler, men formuleringarna behöver inte vara identiska överallt.

Strukturerad data kan hjälpa sökmotorer att tolka vissa fakta om organisationer, personer och artiklar. Den ska stämma med det synliga innehållet och är ett komplement, inte ett särskilt krav för att få synlighet i generativa AI-svar.

Det minsta ni behöver
Organization namn, beskrivning, ort, logotyp sameAs länkar till LinkedIn, bolagsregister, egna profiler Person namngivna talespersoner, kopplade till bolaget Article författare och datum på varje publicerad text FAQPage frågor och svar där sådana finns på sidan

sameAs kan användas i relevant strukturerad data för att länka till officiella profiler eller identiteter. Det kan hjälpa sökmotorer att tolka relationen, men ska bara användas när länken faktiskt beskriver samma organisation eller person.

Låt inte AI skriva beskrivningen av er

AI kan hjälpa till med första utkast, men generiska formuleringar gör det svårare att se vad som faktiskt skiljer er från andra. Förankra texten i konkreta tjänster, målgrupper, erfarenheter och belägg, och läs den högt innan ni publicerar.

Skriv sidorna så att ett stycke kan lyftas ut som svar

Skriv så att en stressad läsare snabbt kan hitta svaret: tydliga rubriker, raka inledningar och ett resonemang som går att följa. Samma egenskaper gör också texten lättare att indexera, sammanfatta och citera.

Gör så härVarför
En fråga per rubrikRubriken matchar det kunden frågar, och svaret står direkt under.
Svaret i första meningenEtt stycke som börjar med slutsatsen går att lyfta ut helt. Ett stycke som bygger upp till slutsatsen gör det inte.
Rubriknivåer i ordningHoppar ni från huvudrubrik till minsta rubriknivå förstår maskinen inte vilka avsnitt som hör ihop.
Siffror som textSiffror i en bild kan inte läsas. Samma siffror i löptext eller i en tabell kan citeras.
Datum på varje sidaModellerna föredrar färska källor. En sida utan datum går inte att bedöma och väljs lättare bort.
Innehållet på sidan, inte i en pdfFiler bakom en nedladdningsknapp läses sällan. Lägg det viktigaste som vanlig text på sidan.

llms.txt är en föreslagen frivillig konvention för att beskriva en sajt för språkmodeller. Stödet är inte enhetligt och filen ersätter inte crawlbarhet, indexering eller bra innehåll. Om ni använder den bör den därför komma efter grunderna.

Ordlista . begrepp i kapitlet
robots.txt
En textfil på er domän som talar om för robotar vilka sidor de får hämta. De flesta robotar följer den, men den är en anvisning, inte ett lås.
noindex
En inställning på en sida som säger att den inte ska tas med i sökresultat. Ligger ofta kvar i pressrum och testmiljöer.
Strukturerad data
En beskrivning av sidan i sajtens kod, skriven för maskiner. Besökaren ser den inte.
sameAs
Ett fält i strukturerad data som kan länka till andra officiella profiler eller identiteter för samma organisation eller person.
llms.txt
En föreslagen frivillig textfil för att beskriva en sajt för språkmodeller. Stödet är inte enhetligt och filen är ingen förutsättning för AI-synlighet.

Vad ni gör åt det

Börja med de kontroller som går att göra utan utveckling. Ta därefter hjälp av den som förvaltar sajten för sådant som kräver kod, DNS eller serverinställningar.

1

Läs er robots.txt Själv

För ChatGPT Search kontrollerar ni OAI-SearchBot och eventuella bot- eller brandväggsregler. För Google kontrollerar ni att Googlebot kan crawla och att sidan får indexeras. Andra tjänster har egna regler. Dokumentera vilka crawlers ni aktivt tillåter eller blockerar och varför.

2

Gå igenom era subdomäner Själv

Lista alla adresser utanför huvudsajten och öppna var och en. Gamla pressrum, rekryteringssidor, kampanjsajter. Det som ger fel ska skickas vidare till en fungerande sida, inte lämnas.

3

Kontrollera er kärnbeskrivning Själv

Skriv tydligt vad ni gör, för vem och inom vilket område. Kontrollera att kärnfakta håller ihop på sajten och i viktiga profiler; formuleringarna behöver inte vara identiska överallt.

4

Öppna pressrummet Med er webbyrå

Kontrollera robots.txt, noindex, inloggning och canonical på pressrummet. Om samma material finns både i pressrum och på huvudsajten ska det vara tydligt vilken adress som är huvudversion.

5

Lägg in strukturerad data Med er webbyrå

Använd Organization, Person och Article där de passar det synliga innehållet, och sameAs när ni behöver länka till officiella profiler. Validera markupen, men behandla den som strukturhjälp snarare än en genväg till AI-synlighet.

6

Flytta siffrorna ur bilderna Med er webbyrå

Diagrammen får vara kvar, men samma siffror ska också stå som text eller i en tabell. Det gäller också pdf-filer bakom en nedladdningsknapp.

7

Lägg llms.txt sist Sist

När allt ovan är gjort. Den är billig och löser inget på egen hand.

Kan modellerna läsa er sajt?

Kryssa i det ni vet stämmer. Gissa inte. Alla punkter går att kontrollera på under en timme.
Källor och underlag
  1. Robotnamnen är hämtade från respektive leverantörs egen dokumentation och ändras över tid. Kontrollera mot aktuell dokumentation innan ni skriver om er robots.txt.
  2. Aggarwal med flera (2024). GEO: Generative Engine Optimization. Princeton University och Georgia Tech, SIGKDD 2024. Statistik i innehållet förbättrar synligheten i AI-svar med omkring trettio procent, och citat från namngivna källor med omkring fyrtio. Det är skälet till att siffror bör ligga som text.
  3. Exemplet med den trasiga subdomänen är Heartspaces eget, dokumenterat i augusti 2026 med skärmdump av AI-svaret före åtgärd.

Nu är sajten lättare att hämta och förstå

Det garanterar inte att ni blir nämnda. Nästa kapitel handlar om externa källor och hur ni skapar material som andra faktiskt har skäl att skriva om.

Läs kapitel 7
Vill ni att vi går igenom er sajt? Det ingår i kursen.