Teckenkodningskonverterare för textfiler

När en text visar café som café eller naïve som naïve är tecknen felfria: det är kodningen som läses fel. Klistra in texten, tala om för konverteraren vilken kodning den ska läsa den som och vilken den ska skriva ut, så kodar den om den rent mellan UTF-8, UTF-16, ISO-8859-1 (Latin-1), Windows-1252 och andra vanliga teckentabeller. Kopiera det rättade resultatet direkt till din editor, ditt kalkylark eller din databas.

Så konverterar du textkodning

  1. 1

    Klistra in din text

    All text som ser förvanskad ut eller som du behöver koda om för ett annat program.

  2. 2

    Kontrollera detekteringen

    En ungefärlig ledtråd visar den troliga kodningen ovanför fältet.

  3. 3

    Välj källkodning

    Ställ «Från» efter hur byten ska läsas: UTF-8, Windows-1252, ISO-8859-1, SJIS med flera.

  4. 4

    Välj målkodning

    UTF-8 är den moderna standarden; UTF-16, Big5 eller GB2312 finns när ett visst program kräver dem.

  5. 5

    Konvertera och kopiera

    Texten kodas om och ett klick kopierar resultatet till urklipp.

Varifrån kodningskonflikter kommer

Källa Trolig kodning
Excel «Spara som CSV» i Windows Windows-1252
Gammal Windows-app Windows-1252
Gammalt Unix-verktyg ISO-8859-1 (Latin-1)
Modern macOS-/Linux-editor UTF-8
Japansk Windows-text Shift-JIS (SJIS)
Förenklad kinesiska i Windows GB2312
Traditionell kinesiska (Taiwan/Hongkong) Big5

De klassiska symtomen

  • café visas som café när UTF-8-byte läses som Latin-1. Ställ «Från» på UTF-8 för att tolka byten rätt igen.
  • ñ blir ñ av samma skäl.
  • Dubbel mojibake som café betyder att texten sparades om efter den första feltolkningen och att den felaktiga tolkningen kodades en andra gång.
  • Ett inledande  är en UTF-8-byteordningsmarkering som lästs som tre Latin-1-tecken.

Så snart du känner igen symtomet är vägen oftast tydlig: läs texten som det den verkligen är (Latin-1, Windows-1252 eller vad som gäller) och skriv ut den igen som UTF-8.

Byteordningsmarkeringar (BOM)

Den här konverteraren lägger varken medvetet till eller tar bort en byteordningsmarkering: beteendet följer målkodningen. UTF-8-utdata har ingen BOM. Vanlig UTF-16-utdata börjar med en BOM och är big-endian, medan UTF-16BE och UTF-16LE skriver byten utan BOM. Välj UTF-8 om inte ett visst program kräver UTF-16.

När ett tecken saknar motsvarighet

Vissa byte har ingen betydelse i den valda källkodningen, och vissa tecken kan inte representeras i målkodningen. Då ersätter konverteringen dem med en markör i stället för att stanna. Viktigast är att välja rätt källkodning: en sträng med enbart ASCII är giltig i alla kodningar, så en konflikt visar sig oftast först vid accenttecken eller icke-latinska tecken.

Vanliga frågor

Listorna «Från» och «Till» erbjuder båda UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS (Shift-JIS), GB2312 och Big5. Du kan konvertera från vilken som helst till vilken annan som helst.

För webben, databaser och nästan alla moderna flöden, ja. Undantagen är gamla Windows-appar som bara läser Windows-1252, vissa äldre stordatorverktyg och viss japansk programvara som förväntar sig Shift-JIS.

Det är en ungefärlig gissning utifrån bytemönstret, vald bland UTF-8, UTF-16, ISO-8859-1, Windows-1252 och ASCII. Den kan ha fel med kort eller ren ASCII-text, så behandla den som en ledtråd och ställ in kodningen «Från» själv när du vet bättre.

Texten skickas till vår server för att utföra konverteringen och sparas inte efter att svaret returnerats. För känsligt material är en offline-editor med inbyggd kodningskonverterare att föredra.

Relaterade verktyg

Verktyget finns på andra språk