Hvorfor en CSV viser rare tegn i Excel
Forvekslingen av tegnkoding som ødelegger bokstaver, og tre måter å fikse det på.
Du åpner en CSV i Excel, og navn som Müller, José eller Søren vises med merkelige symboler der de spesielle bokstavene skulle stått. Eurotegn og apostrofer blir også til klynger av rare tegn. Det er ingenting galt med dataene dine. Excel leser filen med feil tegnkoding.
Hva som skjer
En tekstfil er bare byte, og en tegnkoding er regelen for å gjøre byte om til bokstaver. Nesten alle moderne systemer skriver CSV-filer i UTF-8, som håndterer alle språk. Når du dobbeltklikker på en CSV i Excel på Windows, antar Excel fortsatt en eldre regional tegnkoding som Windows-1252, med mindre filen starter med en liten markør som kalles byte order mark, eller BOM. Uten BOM dekodes alle tegn utenfor vanlig engelsk med feil regel, og hver spesialbokstav blir til to eller tre søppeltegn.
Dataene er intakte. Åpner du den samme filen i Google Regneark, Numbers eller et tekstredigeringsprogram, ser den helt fin ut.
Løsning 1: legg til BOM
Er filen korrekt UTF-8 og det bare er Excel som viser den feil, kjører du den gjennom verktøyet for å fikse tegnkoding med BOM-alternativet slått på. Tegnene endres ikke, men markøren forteller Excel at filen skal leses som UTF-8, og fra da av åpnes den riktig ved dobbeltklikk.
Løsning 2: konverter til en ekte Excel-fil
En .xlsx-fil har ingen tvetydighet rundt tegnkoding i det hele tatt. CSV til Excel-konvertereren leser CSV-filen riktig og lagrer en arbeidsbok som åpnes riktig overalt. Den beholder også innledende nuller i postnumre og telefonnumre, som Excel fjerner når den åpner en CSV direkte.
Løsning 3: importer i stedet for å dobbeltklikke
I Excel går du til Data, Fra tekst/CSV, og setter filopprinnelsen til 65001: Unicode (UTF-8). Da leser Excel filen riktig. Det fungerer, men du må huske det hver gang, og derfor er de to første løsningene mer praktiske for filer du deler.
Når selve filen er skadet
Noen ganger er de ødelagte tegnene lagret i filen. Det skjer når noen har åpnet en UTF-8-fil i Excel, sett rotet og lagret den på nytt. Nå er søppeltegnene selve dataene. Du ser problemet i alle programmer, ikke bare i Excel. Verktøyet for å fikse tegnkoding har en reparasjonsmodus for akkurat dette: den reverserer den doble kodingen og gjenoppretter de opprinnelige bokstavene. Den automatiske modusen oppdager dette tilfellet i de fleste filer.
Rask diagnose
| Det du ser | Sannsynlig årsak | Løsning |
|---|---|---|
| Feil bare i Excel, fint andre steder | BOM mangler | Legg til BOM, eller konverter til .xlsx |
| Feil i alle programmer | Filen ble lagret etter å ha blitt lest feil | Reparer dobbel koding |
| Spørsmålstegn eller bokser | Filen er lagret i en gammel Windows-koding | Konverter fra Windows-1252 til UTF-8 |
Slik unngår du det
- Når du eksporterer fra Excel, velger du CSV UTF-8 i stedet for vanlig CSV.
- Når du eksporterer fra andre systemer til Excel-brukere, tar du med BOM hvis alternativet finnes.
- Lagre aldri på nytt en CSV som ser ødelagt ut. Fiks tegnkodingen først.