Når “Rødgrød med fløde” står som Rødgrød med fløde, er filen gemt i tegnkodningen UTF-8, men Excel har læst den som Windows-1252. Løsningen er at importere filen igen og fortælle Excel, at den er UTF-8: Data › Fra tekst/CSV og Filoprindelse sat til UTF-8.

Står der i stedet R�dgr�d med fl�de med sorte ruder eller spørgsmålstegn, er det omvendt: filen er Windows-1252, og den er læst som UTF-8.

Hvorfor bogstaverne bliver til to tegn

En tekstfil gemmer bogstaver som tal (bytes). Almindelige bogstaver som a–z har samme tal i alle udbredte tegnkodninger. Æ, ø og å har ikke:

Tegn Windows-1252 UTF-8 UTF-8 læst som Windows-1252
æ E6 C3 A6 æ
ø F8 C3 B8 ø
å E5 C3 A5 Ã¥
Æ C6 C3 86 Æ
Ø D8 C3 98 Ø
Å C5 C3 85 Ã…
80 E2 82 AC €

I UTF-8 fylder ø to bytes. Læses de som Windows-1252, bliver hver byte sit eget tegn, og derfor begynder alle danske bogstaver med Ã. Går det den anden vej, er byten F8 ikke et gyldigt tegn i UTF-8, og Excel viser et erstatningstegn i stedet.

En BOM (byte order mark) er tre bytes, EF BB BF, helt forrest i filen. De er usynlige, men fortæller programmer, at filen er UTF-8.

Vores test: samme tekst i tre tegnkodninger

Vi skrev den samme opdigtede vareliste som UTF-8 uden BOM, UTF-8 med BOM og Windows-1252 og åbnede hver fil på tre måder i Excel på dansk: med Excels almindelige åbn-funktion, med Power Query-importens tegnkodning sat til UTF-8 eller Windows-1252, og med den ældre tekstimport med samme to valg. Sådan blev “Rødgrød med fløde” vist:

Fil Åbnet i Excel Power Query, UTF-8 Power Query, 1252 Ældre import, UTF-8 Ældre import, 1252
UTF-8 uden BOM Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde
UTF-8 med BOM Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde Rødgrød med fløde
Windows-1252 Rødgrød med fløde R�dgr�d med fl�de Rødgrød med fløde R�dgr�d med fl�de Rødgrød med fløde

Tre ting er værd at hæfte sig ved:

  • Det er kun UTF-8 uden BOM, der går galt, når filen åbnes. Filen med BOM og Windows-1252-filen blev begge vist korrekt. Microsoft skriver også, at en UTF-8-fil normalt kan åbnes direkte, hvis den er gemt med BOM.
  • Power Query lod BOM’en vinde. Selv med tegnkodningen sat til Windows-1252 blev filen med BOM læst korrekt. Den ældre tekstimport fulgte derimod valget og gav ø.
  • Windows-1252 læst som UTF-8 giver tab af bogstaver. “ÆØÅ med store bogstaver” blev til “��� med store bogstaver”. Alle tre bogstaver blev til samme tegn, så du kan ikke regne dig tilbage til, hvad der stod.

Et script åbnede og importerede filerne med de samme indstillinger, som du vælger i dialogboksene, men uden at klikke i dem (sådan afprøver vi). Et dobbeltklik på filen i Stifinder har vi ikke målt. Maskinen havde Windows-1252 som standardtegnsæt, hvilket er det normale på en dansk Windows.

Sådan importerer du filen korrekt

  1. Luk den forkerte udgave uden at gemme. Gemmer du ø tilbage i CSV-filen, er fejlen skrevet ind i filen.
  2. Vælg Data › Hent data › Fra fil › Fra tekst/CSV (ifølge Microsoft), og vælg filen.
  3. I Filoprindelse vælger du 65001: Unicode (UTF-8), hvis du så ø, eller 1252: Vesteuropæisk (Windows), hvis du så . Brug forhåndsvisningen til at se, hvilken der er rigtig.
  4. Kontrollér afgrænseren og datatyperne, før du indlæser. Det gennemgår vi i guiden om at åbne en CSV-fil fra banken korrekt.

Bruger du den ældre Guiden Tekstimport, sidder den samme indstilling i første trin og hedder også Filoprindelse.

Hvis du kun har den forkerte tekst

Er originalfilen væk, og står der ø i regnearket, kan du reparere de danske bogstaver med UDSKIFT (engelsk: SUBSTITUTE). Find først de berørte celler:

B2 =ER.TAL(SØG("Ã";A2))
SAND, hvis teksten indeholder Ã.

Erstat derefter de seks tegnpar:

C2 =UDSKIFT(UDSKIFT(UDSKIFT(UDSKIFT(UDSKIFT(UDSKIFT(A2;"æ";"æ");"ø";"ø");"Ã¥";"å");"Æ";"Æ");"Ø";"Ø");"Ã…";"Å")
Arket Reparer. Resultater som Excel viste dem.
Række ABC
1 Forkert tekst Har tegnfejl Repareret
2 Rødgrød med flødeSANDRødgrød med fløde
3 BlÃ¥bærsyltetøjSANDBlåbærsyltetøj
4 ÆØÅ med store bogstaverSANDÆØÅ med store bogstaver
5 Rødgrød med flødeFALSKRødgrød med fløde
Arket Reparer. Resultater som Excel viste dem.

Formlen retter kun de danske bogstaver. Andre tegn som é og € bliver også forkerte i en UTF-8-fil, der læses som Windows-1252 (€ for €), så en ny import er altid det sikreste. Tegnet kan ingen formel rette.

Når du selv skal gemme en CSV-fil

Vi har gemt et lille regneark med “Rødgrød med fløde”, beløbet 1.234,50 og en dato i de to CSV-formater og kigget på de bytes, Excel skrev:

Filtype i Gem som Tegnkodning Skilletegn Beløb og dato i filen
CSV UTF-8 (kommasepareret) UTF-8 med BOM semikolon 1.234,50 og 01-08-2026
CSV (kommasepareret) Windows-1252 semikolon 1.234,50 og 01-08-2026

To ting overrasker mange:

  • “Kommasepareret” skrev semikolon. Med danske landeindstillinger brugte begge formater semikolon mellem felterne.
  • Tallene gemmes, som de vises. Beløbet med formatet #.##0,00 blev skrevet som 1.234,50, med tusindtalspunktum. Skal filen ind i et system, der ikke forstår det, så giv kolonnen et talformat uden tusindtalsseparator, før du gemmer.

Skal filen bruges af et andet system, så spørg, hvad det forventer. Vil det have UTF-8, er CSV UTF-8 det rigtige valg. Vil det have komma og decimalpunktum, gav ingen af de to formater det i vores test på en maskine med danske landeindstillinger.