Konwerter kodowania plików tekstowych

Gdy tekst pokazuje café jako café albo naïve jako naïve, znaki są w porządku: to kodowanie jest odczytywane błędnie. Wklej tekst, wskaż konwerterowi, w jakim kodowaniu ma go odczytać i w jakim zapisać, a on czysto przekoduje go między UTF-8, UTF-16, ISO-8859-1 (Latin-1), Windows-1252 i innymi popularnymi stronami kodowymi. Skopiuj poprawiony wynik prosto do edytora, arkusza kalkulacyjnego lub bazy danych.

Jak przekonwertować kodowanie tekstu

  1. 1

    Wklej tekst

    Dowolny tekst, który wygląda na zniekształcony lub który trzeba przekodować dla innego programu.

  2. 2

    Sprawdź wykrycie

    Orientacyjna podpowiedź pokazuje prawdopodobne kodowanie nad polem.

  3. 3

    Wybierz kodowanie źródłowe

    Ustaw «Z» zgodnie z tym, jak należy odczytać bajty: UTF-8, Windows-1252, ISO-8859-1, SJIS i inne.

  4. 4

    Wybierz kodowanie docelowe

    UTF-8 to nowoczesny standard; UTF-16, Big5 czy GB2312 są dostępne, gdy wymaga ich konkretny program.

  5. 5

    Konwertuj i kopiuj

    Tekst zostaje przekodowany, a jedno kliknięcie kopiuje wynik do schowka.

Skąd biorą się konflikty kodowania

Źródło Prawdopodobne kodowanie
Excel «Zapisz jako CSV» w Windows Windows-1252
Stara aplikacja Windows Windows-1252
Stare narzędzie Unix ISO-8859-1 (Latin-1)
Nowoczesny edytor macOS/Linux UTF-8
Japoński tekst w Windows Shift-JIS (SJIS)
Chiński uproszczony w Windows GB2312
Chiński tradycyjny (Tajwan/Hongkong) Big5

Klasyczne objawy

  • café wyświetla się jako café, gdy bajty UTF-8 są odczytywane jako Latin-1. Ustaw «Z» na UTF-8, aby ponownie poprawnie zinterpretować bajty.
  • ñ zmienia się w ñ z tego samego powodu.
  • Podwójne mojibake w rodzaju café oznacza, że tekst zapisano ponownie po pierwszym błędnym odczycie, kodując błędną interpretację drugi raz.
  • Wiodące  to znacznik kolejności bajtów UTF-8 odczytany jako trzy znaki Latin-1.

Gdy rozpoznasz objaw, droga zwykle jest jasna: odczytaj tekst jako to, czym naprawdę jest (Latin-1, Windows-1252 lub cokolwiek pasuje), i zapisz go z powrotem jako UTF-8.

Znaczniki kolejności bajtów (BOM)

Ten konwerter nie dodaje ani nie usuwa znacznika kolejności bajtów z wyboru: zachowanie wynika z kodowania docelowego. Wynik UTF-8 nie ma znacznika BOM. Zwykły wynik UTF-16 zaczyna się od znacznika BOM i jest big-endian, natomiast UTF-16BE i UTF-16LE zapisują bajty bez BOM. Wybierz UTF-8, chyba że konkretny program wymaga UTF-16.

Gdy znak nie ma odpowiednika

Niektóre bajty nie mają znaczenia w wybranym kodowaniu źródłowym, a niektórych znaków nie da się przedstawić w kodowaniu docelowym. Wtedy konwersja zastępuje je znacznikiem, zamiast się zatrzymać. Najważniejszy jest właściwy wybór kodowania źródłowego: ciąg złożony wyłącznie z ASCII jest poprawny w każdym kodowaniu, więc konflikt zwykle ujawnia się dopiero przy znakach z akcentami lub spoza alfabetu łacińskiego.

Najczęściej zadawane pytania

Listy «Z» i «Na» oferują UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS (Shift-JIS), GB2312 i Big5. Możesz konwertować z dowolnego na dowolne inne.

Dla sieci, baz danych i niemal każdego nowoczesnego procesu, tak. Wyjątki to stare aplikacje Windows, które czytają tylko Windows-1252, niektóre starsze narzędzia mainframe oraz określone japońskie oprogramowanie oczekujące Shift-JIS.

To orientacyjne przypuszczenie na podstawie układu bajtów, wybrane spośród UTF-8, UTF-16, ISO-8859-1, Windows-1252 i ASCII. Przy krótkim lub czysto ASCII tekście może się mylić, więc traktuj je jako wskazówkę i sam ustaw kodowanie «Z», gdy wiesz lepiej.

Tekst jest wysyłany na nasz serwer w celu wykonania konwersji i nie jest przechowywany po zwróceniu odpowiedzi. W przypadku materiałów poufnych lepszy jest edytor offline z wbudowanym konwerterem kodowania.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach