Miksi CSV näyttää Excelissä outoja merkkejä
Merkistösekaannus sotkeutuneiden ääkkösten takana ja kolme tapaa korjata se.
Avaat CSV-tiedoston Excelissä, ja nimissä kuten Müller tai José näkyy outoja symboleita kirjainten tilalla. Myös euromerkit ja heittomerkit muuttuvat oudoiksi merkkiryppäiksi. Tiedoissasi ei ole mitään vikaa. Excel lukee tiedostoa väärällä merkistöllä.
Mistä on kyse
Tekstitiedosto on pelkkiä tavuja, ja merkistö on sääntö, jolla tavut muutetaan kirjaimiksi. Lähes jokainen nykyaikainen järjestelmä kirjoittaa CSV-tiedostot UTF-8-merkistöllä, joka käsittelee kaikki kielet. Windowsin Excel olettaa kuitenkin yhä CSV-tiedostoa kaksoisnapsautettaessa vanhemman alueellisen merkistön, kuten Windows-1252:n, ellei tiedosto ala pienellä merkillä, jota kutsutaan tavujärjestysmerkiksi eli BOM:ksi. Ilman BOM:ia jokainen pelkän englannin ulkopuolinen merkki puretaan väärällä säännöllä, ja jokainen ääkkönen tulee näkyviin kahtena tai kolmena roskamerkkinä.
Tiedot ovat tallessa. Avaa sama tiedosto Google Sheetsissä, Numbersissa tai tekstieditorissa, ja se näyttää oikealta.
Korjaus 1: lisää BOM
Jos tiedosto on oikeaa UTF-8:aa ja vain Excel näyttää sen väärin, aja se merkistön korjaustyökalun läpi BOM-valinta päällä. Merkit eivät muutu, mutta merkki kertoo Excelille, että tiedosto on luettava UTF-8:na, ja siitä lähtien se aukeaa oikein kaksoisnapsautuksella.
Korjaus 2: muunna oikeaksi Excel-tiedostoksi
.xlsx-tiedostossa ei ole mitään merkistöön liittyvää epäselvyyttä. CSV Exceliksi -muunnin lukee CSV-tiedoston oikein ja tallentaa työkirjan, joka aukeaa kunnolla kaikkialla. Se säilyttää myös etunollat postinumeroissa ja puhelinnumeroissa, jotka Excel poistaa avatessaan CSV-tiedoston suoraan.
Korjaus 3: tuo tiedosto kaksoisnapsautuksen sijaan
Valitse Excelissä Tiedot ja sitten Tekstistä/CSV:stä, ja aseta tiedoston alkuperäksi 65001: Unicode (UTF-8). Excel lukee tiedoston silloin oikein. Tämä toimii, mutta se on muistettava joka kerta, ja siksi kaksi ensimmäistä korjausta ovat käytännöllisempiä tiedostoille, joita jaat.
Kun itse tiedosto on vaurioitunut
Joskus sotkeutuneet merkit on tallennettu tiedostoon. Näin käy, kun joku avasi UTF-8-tiedoston Excelissä, näki sotkun ja tallensi tiedoston uudelleen. Nyt roskamerkit ovat itse tietoa. Näet ongelman jokaisessa ohjelmassa, et vain Excelissä. Merkistön korjaustyökalussa on korjaustila juuri tätä varten: se kumoaa kaksinkertaisen koodauksen ja palauttaa alkuperäiset kirjaimet. Sen automaattinen tila tunnistaa tämän tapauksen useimmista tiedostoista.
Nopea vianmääritys
| Mitä näet | Todennäköinen syy | Korjaus |
|---|---|---|
| Väärin vain Excelissä, muualla oikein | BOM puuttuu | Lisää BOM tai muunna .xlsx-muotoon |
| Väärin jokaisessa ohjelmassa | Tiedosto tallennettiin väärin luettuna | Korjaa kaksinkertainen koodaus |
| Kysymysmerkkejä tai laatikoita | Tiedosto tallennettu vanhalla Windows-merkistöllä | Muunna Windows-1252:sta UTF-8:ksi |
Ennaltaehkäisy
- Kun tallennat Excelistä, valitse CSV UTF-8 tavallisen CSV:n sijaan.
- Kun viet tietoja muista järjestelmistä Excelin käyttäjille, lisää BOM, jos vaihtoehto on olemassa.
- Älä koskaan tallenna uudelleen CSV-tiedostoa, joka näyttää sotkeutuneelta. Korjaa merkistö ensin.