Frågan går inte att besvara helt. Ingen utanför OpenAI ser hur urvalet görs, och OpenAI beskriver det i två meningar.
Men det betyder inte att det är en svart låda. Det går att ta reda på vad som händer före urvalet, och det är där de flesta sajter faller bort. Den här artikeln bygger på OpenAIs egen dokumentation, på en studie från IIT Delhi och Princeton, och på mätningar i min egen serverlogg.
Kort svar: fyra steg, och det första avgör oftast
ChatGPT väljer inte källor i ett steg utan i fyra.
- ChatGPT måste bestämma sig för att söka. Gör den inte det finns ingen källa alls, hur bra sidan än är.
- Sidan måste vara hämtbar för OpenAI. Det styrs av roboten
OAI-SearchBoti robots.txt, och av att servern släpper in OpenAIs publicerade adresser. - Sidan måste komma med i den sökning ChatGPT faktiskt gör. Det är sällan den fråga användaren skrev.
- Sidan måste väljas ur träfflistan. Här säger OpenAI att flera faktorer vägs in och att placering inte kan garanteras.
De tre första går att göra något åt, och de går att kontrollera på en kvart. Det fjärde går inte att styra.
Steg 1: ChatGPT söker inte alltid
OpenAIs hjälpartikel formulerar det så här: ChatGPT kan söka på webben automatiskt när frågan skulle ha nytta av aktuell information.
Kan, inte gör. Sökning är en bedömning ChatGPT gör från fråga till fråga, inte ett läge som alltid är på.
Jag mätte skillnaden på den här sajten den 7 september 2026. Samma fråga, samma dag, samma konto:
| Läge | Antal källor i svaret |
|---|---|
| Standardläge, körning 1 | 0 |
| Standardläge, körning 2 | 0 |
| Med sökning påslagen | 23 |
Noll mot 23.
Det här är värt att stanna vid, för slutsatsen är tvärtemot vad man tror. Frågar du ChatGPT om ditt företag och får ett svar helt utan källhänvisningar, är det oftast inte din sajt som saknas. Det är sökningen som aldrig kördes. Du har mätt ChatGPTs minne, inte din synlighet.
Så slår du på den manuellt: välj View all tools under skrivrutan, sedan Search. Snedstreck i skrivrutan följt av Search gör samma sak. Kontrollen efteråt är att knappen Sources ska finnas under svaret. Saknas den skedde ingen sökning.
Steg 2: bara en robot avgör om du kan citeras
OpenAI har fyra namngivna robotar, och de gör olika saker. Det här är den vanligaste missuppfattningen i hela ämnet.
| Robot | Vad den gör | Avgör den om du syns i ChatGPTs sökning? |
|---|---|---|
OAI-SearchBot | Hittar sidor och lyfter fram dem i ChatGPTs sökfunktioner | Ja, den enda |
GPTBot | Hämtar innehåll som kan användas för att träna modellerna | Nej |
ChatGPT-User | Besöker en sida när en användare begär det | Nej, uttryckligen inte |
OAI-AdsBot | Kontrollerar landningssidor för annonser | Nej |
OpenAI skriver att inställningarna är oberoende av varandra: en webbansvarig kan släppa in OAI-SearchBot för att synas i sökresultaten och samtidigt stänga ute GPTBot.
Det betyder att beslutet om träningsdata och beslutet om synlighet är två skilda beslut. Vill du inte att dina texter ska träna modeller kan du blockera GPTBot utan att förlora möjligheten att citeras. De två blandas ihop i nästan allt jag läst om ämnet. Hur de olika robotarna hänger ihop och vad som händer när man stänger dem har jag gått igenom i artikeln om AI-robotar och robots.txt.
Om ChatGPT-User skriver OpenAI rakt ut att den inte används för att avgöra vad som får visas i Search, och hänvisar till OAI-SearchBot för den saken. Den följer inte heller nödvändigtvis robots.txt, eftersom besöket är begärt av en människa. En blockering ger alltså inte den tystnad man tror.
En ändring i robots.txt tar omkring ett dygn innan OpenAIs system ställer om. Kontrollerar du direkt efteråt ser du ingenting, och det är väntat.
Det andra villkoret som alla glömmer: brandväggen
Robots.txt är bara halva villkoret. OpenAI skriver att servern eller innehållsnätverket dessutom ska släppa in trafik från deras publicerade adresser, och listan ligger öppet på openai.com/searchbot.json.
Jag läste den 13 september 2026. 39 adressintervall, samtliga i Microsofts adressrymder, med tidsstämpeln 2 januari 2026.
En sajt bakom ett aggressivt botskydd kan alltså vara helt öppen i robots.txt och ändå aldrig hämtas. Det är en verklig felkälla, och jag har inte sett den nämnas i någon svensk text om ämnet.
Steg 3: ChatGPT söker inte på din fråga
Det här är det mest användbara i hela artikeln, och OpenAI redovisar det själv.
ChatGPT skriver om frågan till en eller flera egna, mer riktade sökfrågor innan den skickar dem vidare. Exemplet i dokumentationen: frågan om det senaste inom läkemedel som riktar sig mot CCR8 vid cancer blir sökfrågan ”CCR8 immunotherapy drug development 2025”. Därefter kan smalare följdsökningar skickas utifrån vad första omgången gav.
Tre saker påverkar omskrivningen:
- Plats. ChatGPT uppskattar ungefärlig plats ur IP-adressen. ”Bra restauranger nära mig” kan bli ”top restaurants San Francisco”. Själva IP-adressen delas inte vidare.
- Minnet. Är minnet påslaget kan sparade uppgifter väva sig in. Har användaren berättat att hon är vegan blir sökningen en annan.
- Flera sökningar i följd. Första träfflistan kan utlösa nya, smalare frågor.
Konsekvensen för den som bygger en sajt: sidan konkurrerar inte om frågan besökaren ställde, utan om en söksträng ingen människa har skrivit.
Att jaga exakta frasmatchningar är därför bortkastat arbete. Det som fungerar är att sidan täcker sitt ämne så pass brett att den håller för flera olika omskrivningar av samma fråga. Omskrivningen byter dessutom ofta språk, vilket jag skrivit om i artikeln om engelsk version av en svensk sajt.
Steg 4: urvalet, och de två meningar OpenAI ger
Här är hela OpenAIs svar på rubrikfrågan, återgivet på svenska: ChatGPT rangordnar sökresultat med flera faktorer som ska hjälpa användare att hitta relevant och tillförlitlig information. Placering kan inte garanteras. För att en webbplats ska kunna komma i fråga ska OAI-SearchBot släppas in och servern tillåta trafik från de publicerade adresserna.
Det är allt. Ingen lista över faktorer, ingen viktning, ingen algoritmbeskrivning. Två meningar om vad du kan göra, och ett besked om att placering inte går att lova.
Det beskedet är artikelns viktigaste, och det hör inte hemma i en fotnot. Varje verktyg och varje byrå som säljer en garanterad plats i ChatGPT-svar lovar något leverantören själv säger sig inte kunna leverera. Yoast skriver samma sak om sin egen produkt: inget verktyg kan garantera placering i AI-svar.
Vad forskningen säger om själva texten
Det finns forskning på vilka egenskaper i en text som hänger ihop med att bli citerad. Den ska hållas isär från OpenAIs rangordning, för den mäter något annat.
Studien *GEO: Generative Engine Optimization* från IIT Delhi och Princeton, antagen till KDD 2024, visar att vissa skrivsätt kan öka synligheten i generativa motorers svar med upp till 40 procent. Det som lyfte mest var att lägga in citat från källor, statistik och tydliga hänvisningar. Det som inte gav något var att stoppa in fler nyckelord.
Men studien mäter generativa motorer i allmänhet, inte ChatGPTs urval. Den svarar alltså inte på rubrikfrågan. Den svarar på en annan och också användbar fråga: vad i en text hänger ihop med att den citeras. Den frågan har jag brutit ut i en egen artikel om att skriva texter som AI citerar.
Bing eller inte Bing
Det sägs ofta att ChatGPT söker via Bing. Jag har skrivit det själv, och det är starkare än vad källan bär.
OpenAI namnger aldrig Bing. De skriver att ChatGPT ibland samarbetar med andra söktjänster, och hänvisar till två integritetspolicyer för de partner som kan behandla sökfrågorna: Microsofts och Shopifys. Att Microsoft är sökpartner följer av det. Att det är Bings index som används är en rimlig slutsats, inte ett uttalande från OpenAI.
Skillnaden är liten men den spelar roll. Det praktiska rådet ändras inte: är Microsoft sökpartner har Bings index betydelse, alltså är det vettigt att kontrollera sin sajt i Bing Webmaster Tools.
Bilden är dessutom mer sammansatt än ”ChatGPT använder Bing”. Det finns två vägar in till en sida: OpenAIs egen robot, som hämtar och indexerar, och resultat från sökpartnern. Att bara finnas hos partnern räcker inte om den egna roboten är utestängd, och tvärtom.
Vad jag ser på den här sajten
Här blir det konkret, och utfallet var inte det jag väntade mig.
Min robots.txt är öppen. Ingen AI-robot är blockerad, kontrollerat 13 september 2026. Villkoret i steg 2 är alltså uppfyllt.
Sedan läste jag serverloggen för perioden 7 augusti till 13 september och sökte på OAI-SearchBot. 306 hämtningar. Därefter jämförde jag varje avsändaradress mot OpenAIs 39 publicerade intervall.
| Grupp | Hämtningar | Vad de hämtade |
|---|---|---|
| Från OpenAIs publicerade adresser | 165 | /robots.txt, samtliga 165 |
| Från andra adresser | 141 | /service-account.json, /.env.local, /@fs/var/www/.aws/credentials med flera |
Nästan hälften av trafiken i OpenAIs namn var någon annan. De 141 kom från Google Cloud och letade efter läckta lösenordsfiler. 132 av dem fick svaret att filen inte finns, vilket den inte gör.
Och den äkta roboten har hämtat robots.txt 165 gånger utan att någonsin hämta en artikel. Den kontrollerar reglerna ungefär fem gånger per dygn sedan den 7 augusti, och går aldrig vidare. Filen är öppen, alltså har den inte hindrats.
Det förklarar något jag mätt tidigare: i promptpanelen i augusti citerade ChatGPT inte den här sajten en enda gång, vilket står i case-studien om experimentets mätdata. OpenAIs egen indexering har aldrig haft innehållet att citera.
Två reservationer, båda viktiga. Den andra vägen in, via sökpartnern, är inte mätt här och kan fungera oberoende av detta. Och en robot kan börja hämta när som helst, alltså är detta ett läge och inte ett slutresultat.
Så kontrollerar du din egen sajt på en kvart
1. Robots.txt. Öppna dindoman.se/robots.txt i webbläsaren. Leta efter OAI-SearchBot och efter Disallow: / under User-agent: *. Hittar du ingen blockering är villkoret uppfyllt.
2. Serverloggen. Sök på OAI-SearchBot i åtkomstloggen. Träffar betyder att OpenAI faktiskt hämtar, inte bara att de får. Kommer du inte åt loggen är webbhotellets statistiksida näst bäst.
3. Kontrollera adressen, inte namnet. Det här steget saknas i alla guider jag läst, och min egen mätning visar varför: nästan hälften av träffarna var någon annan. Jämför avsändaradressen mot openai.com/searchbot.json. Stämmer den inte är det inte OpenAI, oavsett vad namnet säger.
4. Hänvisningarna. ChatGPT lägger själv på utm_source=chatgpt.com på länkar i sina svar. Klick därifrån syns alltså i Google Analytics utan tillägg, och var du hittar dem har jag skrivit om i artikeln om att mäta AI-trafik. Med en stor reservation: kopierar någon adressen ur svaret i stället för att klicka hamnar besöket under Direkt, och det mörkertalet kan ingen mätning nå.
5. Prompttestet. Slå på Search manuellt och fråga sedan. Utan påslaget läge mäter du ingenting, vilket steg 1 visar. Hur ett sådant test läggs upp så att det går att upprepa månad efter månad står i artikeln om att testa sin AI-synlighet.
Sammanfattning
ChatGPT väljer källor i fyra steg, och de flesta sajter faller på det första: sökningen kördes aldrig. Av de tre steg du kan påverka handlar två om teknik, alltså robots.txt och brandväggen, och ett om hur texten är skriven.
Om själva urvalet säger OpenAI bara att flera faktorer vägs in och att placering inte kan garanteras. Den som lovar dig mer lovar mer än leverantören.
Och kontrollera adressen, inte namnet. På den här sajten var 141 av 306 hämtningar i OpenAIs namn någon annan.
Hur vet jag att det här stämmer?
Allt om hur ChatGPT fungerar kommer från OpenAIs egen dokumentation, läst 13 september 2026. Inga tredjepartsguider används som belägg för hur tjänsten arbetar.
Siffrorna om den här sajten kommer ur min egen serverlogg för 7 augusti till 13 september 2026, jämförd mot OpenAIs publicerade adresslista samma dag. De går att kontrollera av vem som helst som har tillgång till en egen server.
Det jag inte vet: vilken sökpartner som används för svenska frågor, om adresslistan är fullständig och aktuell, och hur urvalet i steg fyra faktiskt går till. Adresslistan är daterad 2 januari 2026, alltså kan nya adresser ha tagits i bruk utan att listan uppdaterats. Det är skälet till att jag kontrollerade beteendet också och inte bara adressen: de 141 hämtade uteslutande lösenordsfiler, vilket ingen sökrobot gör.
Perioden är fem veckor och en enda sajt. Det är ett stickprov.
Källor
- OpenAI, *Searching the web with ChatGPT*. https://help.openai.com/en/articles/9237897-chatgpt-search
- OpenAI, *Overview of OpenAI Crawlers*. https://developers.openai.com/api/docs/bots
- OpenAI, *Publishers and Developers FAQ*. https://help.openai.com/en/articles/12627856-publishers-and-developers-faq
- OpenAI, publicerade adresser för sökroboten. https://openai.com/searchbot.json
- Aggarwal m.fl., *GEO: Generative Engine Optimization*, arXiv 2311.09735, KDD 2024. https://arxiv.org/abs/2311.09735
- Egen serverlogg, erkensten.se, 7 augusti till 13 september 2026
- Eget mekaniktest av ChatGPTs sökläge, 7 september 2026