Kort svar: en engelsk version behövs förmodligen inte, och nästan aldrig som första åtgärd. ChatGPT söker visserligen på engelska i bakgrunden även när frågan ställs på svenska, men samma modeller föredrar källor på frågans eget språk när det finns bra sådana. Kontrollera att dina sidor alls finns i sökmotorernas index innan du börjar översätta, eftersom en sida som inte finns i indexet inte citeras oavsett språk.
Hellre fråga en AI om den här sidan? Öppna den i ChatGPT eller Perplexity, så får du en sammanfattning och kan ställa följdfrågor. Sajten anges som källa i svaret.
Rådet att ett svenskt företag behöver en engelsk version för att synas i AI-svar återkommer i svenska guider. Det anges sällan någon källa till det, och det är synd, eftersom det finns riktiga mätningar bakom halva påståendet.
Den här artikeln går igenom vad de mätningarna faktiskt visar, var de tar slut, och vilken kontroll du ska göra först. Jag redovisar också vad jag själv gör på den här sajten, som är helt svenskspråkig och inte citeras i ChatGPT. Det är en del av mitt öppna experiment om AI-SEO.
Vad frågan egentligen gäller
När du frågar ChatGPT om något aktuellt svarar den inte bara ur minnet. Den bryter ned din fråga i flera mindre sökningar, hämtar sidor och bygger svaret av dem. De där bakgrundssökningarna kallas fan-outs, och de är osynliga för dig.
Frågan om engelsk version handlar alltså inte om vilket språk ChatGPT svarar på. Den svarar på svenska när du frågar på svenska. Frågan handlar om vilket språk den söker på, eftersom det avgör vilka sidor som ens är kandidater till att bli citerade.
ChatGPT söker på engelska i bakgrunden, även när du frågar på svenska
Den största mätningen på området kommer från Peec AI och publicerades den 12 februari 2026. De analyserade över tio miljoner ChatGPT-frågor och över tjugo miljoner bakgrundssökningar, och filtrerade materialet så att användarens plats och frågans språk stämde överens. Polska frågor från Polen, tyska från Tyskland, alltså inte tyska frågor ställda från London.
Tre siffror ur den mätningen:
- I varje analyserad session på annat språk än engelska gjordes minst en bakgrundssökning på den engelska webben.
- I nära 78 procent av fallen bedömde ChatGPT att källor på frågans eget språk inte räckte, och kompletterade med engelsk research.
- 43 procent av samtliga bakgrundssökningar för icke-engelska frågor gjordes på engelska.
Spridningen mellan språk är stor. Turkiska växlar oftast till engelska, 94 procent, och spanska minst, 66 procent. Inget icke-engelskt språk i deras material ligger under 60 procent. Svenska redovisas inte separat, alltså vet vi inte var vi ligger i den skalan.
Exemplen är tydligare än siffrorna. En polsk användare som frågar på polska efter de bästa auktionssajterna får eBay, medan Allegro, Polens dominerande handelsplats, saknas eller hamnar långt ned. En spansk användare som frågar efter kosmetikamärken får noll spanska märken, eftersom ChatGPT hämtade svaret ur engelskspråkiga källor. I det fallet lade ChatGPT dessutom till ordet ”globala” i sin egen bakgrundssökning, vilket är ett designval som sorterar bort just det lokala.
Två saker ska sägas om den här källan. Den kommer från ett företag som säljer bevakning av synlighet i AI-tjänster, alltså stödjer fyndet deras egen produkt. Och den mäter vilket språk ChatGPT söker på, inte vilket språk de citerade sidorna till slut är skrivna på. Det är närliggande men inte samma sak.
Motkraften: modellerna föredrar källor på ditt eget språk
Det finns en akademisk studie som pekar åt andra hållet, och den är minst lika viktig. Den heter Faux Polyglot och är gjord av Nikhil Sharma, Kenton Murray och Ziang Xiao vid Johns Hopkins. Den publicerades på NAACL 2025 och omfattar tretton flerspråkiga modeller, 170 dokument, fem språk och sju frågetyper.
De byggde ett påhittat material, alltså texter om fiktiva händelser som ingen modell kan ha sett under träningen, och kontrollerade att modellerna inte kände till namnen. Därefter mätte de två saker separat: vilka dokument som hämtades, och vilka dokument svaret faktiskt byggdes av.
Vid hämtningen var 68 procent av de tio högst rankade dokumenten på frågans eget språk. Vid själva svarsgenereringen kom svaret från källor på frågespråket i 42 procent av fallen, mot 29,6 procent för främmande språk. Bara 8,55 procent av svaren använde båda källorna, och 19,8 procent ingen av dem.
Först när det inte finns något på frågespråket tar modellerna det största språket. Deras rangordning: engelska 49,3 procent, tyska 44,5, kinesiska 42,1, hindi 40,8 och arabiska 39,8. Det följer nästan exakt hur mycket material som finns på varje språk.
De två fynden tillsammans är svaret på frågan i rubriken. Finns det bra material på svenska på den fråga någon ställer, gynnas det svenska materialet. Finns det inte, hämtas engelskt material in, och då vinner den som skrivit på engelska.
Begränsningarna ska sägas ut. Svenska ingick inte i studien, språken var engelska, tyska, kinesiska, arabiska och hindi. Materialet var syntetiskt. Hämtningen byggde på ett enda tillvägagångssätt, likhet mellan inbäddningar, alltså inte på hur ChatGPT eller Google faktiskt arbetar i dag. Modellerna var 2024 års generation.
Hur liten är svenskan egentligen?
Det sägs ofta att svenska är underrepresenterat i språkmodellernas träningsdata. Det stämmer, men bara i jämförelse med engelska. I Common Crawl, den genomsökning av webben som de flesta modeller tränas på, är svenska 0,72 procent av sidorna mot engelskans 40,5. Det är femtiosex gånger mindre.
Ställd mot andra språk ser det tvärtom ut. Svenska är nittonde största språket i samma mätning, större än danska, finska och norska, och svenskspråkiga Wikipedia är femte största Wikipedia i världen. Sverige är ungefär en tusendel av jordens befolkning men står för nästan en hundradel av webben.
Det som faktiskt saknas är volym i förhållande till vad en modellträning behöver. AI Sweden, som byggt den största träningsdatamängden för de skandinaviska språken, skriver att de skandinaviska delarna av de vanliga datamängderna är små i sammanhanget när modeller tränas på biljoner tokens.
Slutsatsen som brukar dras av detta, att svensk text därför möter lägre konkurrens, är däremot ingen mätning utan en gissning. Den kan lika gärna slå åt andra hållet: när det svenska materialet är tunt hämtar ChatGPT engelskt i stället, vilket är precis det Peec AI:s mätning visar.
En reservation som gäller alla siffrorna ovan. Common Crawl är inte samma sak som en modells träningsdata. Det är den vanligaste råvaran, men varje modellbyggare filtrerar, viktar och kompletterar, och ingen av de stora leverantörerna publicerar sin faktiska spräkfördelning. Webbstatistiken är alltså en indikator, inte en avläsning av vad ChatGPT innehåller.
När språket är problemet, och när det inte är det
Sammanställt blir det tre lägen, och de kräver olika saker av dig.
Spräket är sannolikt inte problemet om ditt ämne redan har gott om bra svenskt innehåll, om dina kunder är svenskar som frågar på svenska, och om dina sidor finns i indexet. Då konkurrerar du med andra svenska sidor på samma villkor, och det avgörs av innehållet.
Spräket kan vara problemet om ditt ämne är tunt bevakat på svenska. Då är sannolikheten större att ChatGPT byter till engelska och hämtar sitt svar därifrån, och då spelar det ingen roll hur bra din svenska sida är.
Språket är definitivt inte problemet om dina sidor inte finns i indexet. Det är det vanligaste läget för en ny eller nyligen omgjord sajt, och det är därför nästa avsnitt kommer före avsnittet om hur man gör en engelsk version.
Kontrollera det här först: finns sidorna alls i indexet?
ChatGPT hämtar sina webbsökningar via Bing. En sida som Bing inte har indexerat kan alltså inte citeras av ChatGPT, oavsett vilket språk den är skriven på. Kontrollen tar fem minuter och är gratis.
- Sök på
site:dindoman.sei Bing. Antalet träffar är en grov indikator på vad som är indexerat. - Skapa ett konto i Bing Webmaster Tools och verifiera din sajt. Under Site Explorer ser du hur många adresser Bing känner till och hur många som är indexerade.
- Gör samma sak i Google Search Console, under Sidor. Där ser du både indexerade sidor och skälen till att övriga inte är det.
- Jämför de två. Är sidorna indexerade i Google men inte i Bing är det ett Bing-problem och inte ett språkproblem.
En varning om siffrorna i panelerna. När jag jämförde Bings egen rapport med min serverlogg den 6 september 2026 stod det i panelen att startsidan senast genomsökts den 23 augusti. Serverloggen visade Bingbot på samma adress den 5 september, alltså tolv dagars skillnad på ett mått som ser exakt ut. Panelerna är användbara, men de är efterhandsrapporter och inte grundsanning.
Jag går igenom hela den kontrollen steg för steg i artikeln om att testa din synlighet i ChatGPT.
Om du ändå vill göra en engelsk version: så gör du
Blir slutsatsen att en engelsk version är värd att prova, gör den som en riktig språkversion och inte som en översättningsknapp. Det som följer är Googles egen anvisning, som gäller oavsett vad du gör det för.
- Egen adress för varje språk. Till exempel
dindoman.se/en/sidan/bredviddindoman.se/sidan/. Ett skript som byter text på samma adress ger ingen ny sida att indexera. - Rätt språk i
lang-attributet på varje sida, alltsålang="sv-SE"på den svenska ochlang="en"på den engelska. - Fullständig
hreflang. Varje version måste lista sig själv och alla andra versioner. Google är uttrycklig: pekar inte båda sidorna på varandra ignoreras taggarna, just för att någon annan inte ska kunna utse sin sida till alternativ version av din. - En
x-defaultsom pekar på den sida en besökare ska landa på när inget av språken matchar hennes inställningar. - Egen kanonisk adress per språkversion, alltså inte den svenska sidan som kanonisk för den engelska.
I WordPress finns tillägg som sätter det här åt dig, till exempel Polylang och WPML. Det viktiga är inte vilket du väljer utan att resultatet blir separata adresser med korrekta korsvisa hreflang-taggar.
Två saker som är värda att veta. Google använder varken hreflang eller lang-attributet för att avgöra vilket språk en sida är skriven på, utan bestämmer det med egna algoritmer. Taggarna talar om att sidorna hör ihop, inget mer. Och en översatt sida räknas inte som en dubblett av originalet, alltså är risken för dubbletter inget skäl att låta bli.
Översätt inte heller allt. Peec AI:s egen rekommendation är att välja ut de sidor som faktiskt kan bli citerade, alltså där du har något att säga som inte redan står på hundra engelska sidor.
Vad det kostar att hålla två språk aktuella
Det som sällan står i råden är underhållet. Varje sida du översätter blir en sida till som ska hållas aktuell. Ändrar du ett pris, en öppettid eller ett faktapåstående ska det ändras på två ställen.
För en enmansfirma är det den verkliga kostnaden, inte översättningen i sig. Två sidor som säger olika saker är sämre än en sida som säger rätt, både för en läsare och för en AI som ska avgöra vad som gäller.
Räkna därför i sidor du orkar underhålla, inte i sidor du orkar översätta en gång. Fem engelska sidor som stämmer är bättre än femtio som halkat efter. Samma sak gäller titel och metabeskrivning, som ska sättas separat på varje språkversion.
Vad jag gör på den här sajten och varför
Den här sajten är helt svenskspråkig. lang-attributet är sv-SE, det finns ingen hreflang och ingen engelsk version, kontrollerat den 7 september 2026.
Läget i mätningen: sajten citeras inte i ChatGPT på ämnesfrågorna, och ChatGPT gick från 1 poäng i juli till 0 i augusti i min egen månadsmätning. Det är precis det utfall som gör språkspåret frestande.
Jag gör ändå ingen engelsk version nu, och skälet är mätdata. Den 6 september kontrollerade jag serverloggen: Bingbot har hämtat sajten drygt 530 gånger sedan den 13 augusti, och samtliga anrop besvarades med 200. Men bara 7 av 12 kända adresser är indexerade i Bing, och 112 av hämtningarna gällde sitemapen medan omkring 25 gällde faktiska sidor. Roboten läser alltså kartan om och om igen och hämtar nästan inga artiklar.
Så länge fem tolftedelar av sajten inte finns i det index ChatGPT söker i, går det inte att avgöra om språket spelar roll. Att översätta nu vore att åtgärda den andra förklaringen innan den första är utesluten.
Nästa avstämning är månadsmätningen omkring den 22 september. Är indexeringen då hel och citeringarna fortfarande noll, blir en engelsk version av en enda sida ett rimligt och avgränsat test. Jag skriver upp utfallet hur det än går, och det syns i vad som fungerar och inte.
Sammanfattning
- ChatGPT söker på engelska i bakgrunden även när du frågar på svenska, i 43 procent av bakgrundssökningarna enligt den största mätning som finns.
- Samtidigt föredrar modellerna källor på frågans eget språk när det finns bra sådana, 68 procent vid hämtning i den akademiska studien.
- Svenska är litet jämfört med engelska men medelstort på webben i övrigt, alltså är ”underrepresenterat” en jämförelse som måste ange mot vad.
- Kontrollera indexeringen i Bing och Google innan du drar slutsatser om språket.
- Gör du en engelsk version: egna adresser, korrekt
hreflangåt båda håll och bara de sidor du orkar hålla aktuella. - Ingen av källorna mäter svenska direkt. Det är den ärliga gränsen för vad som går att säga i dag.
Hur vet jag att det här stämmer?
Siffrorna kommer från två oberoende underlag som pekar åt olika håll, och båda är länkade nedan. Peec AI:s mätning är stor men kommer från en kommersiell avsändare vars produkt gynnas av slutsatsen. Faux Polyglot är granskad forskning men bygger på syntetiskt material, äldre modeller och fem språk där svenska inte ingår. Jag anger båda begränsningarna hellre än att välja den källa som passar.
Anvisningarna om hreflang är hämtade ur Googles egen dokumentation, som senast uppdaterades den 22 december 2025. Språkstatistiken kommer från Common Crawls egna sammanställningar, W3Techs och AI Swedens artikel om SWEb.
Mätvärdena från min egen sajt är avlästa direkt ur serverloggen, Bing Webmaster Tools och Google Search Console den 5 och 6 september 2026.
Det jag inte kan visa är om en engelsk version skulle ha hjälpt. Jag har inte gjort en, och när jag gör det kommer det att vara ett test med ett känt utgångsläge. Fram tills dess är det här en genomgång av vad andras mätningar visar, inte ett resultat från mitt eget experiment.
Källor
- Peec AI, Tomek Rudzki: ChatGPT searches in English, even when you don’t (2026-02-12)
- Sharma, Murray, Xiao: Faux Polyglot: A Study on Information Disparity in Multilingual Large Language Models, NAACL 2025
- Google Search Central: Tell Google about localized versions of your page (senast uppdaterad 2025-12-22)
- Common Crawl: Distribution of Languages, CC-MAIN-2026-34
- W3Techs: Usage statistics of Swedish for websites, september 2026
- Norlund m.fl., AI Sweden: SWEb: A Large Web Dataset for the Scandinavian Languages, ICLR 2025
- Egna mätningar på erkensten.se, juli 2026 och framåt