Konwerter kodowania plików tekstowych
Gdy tekst pokazuje café jako café albo naïve jako naïve, znaki są w porządku: to kodowanie jest odczytywane błędnie. Wklej tekst, wskaż konwerterowi, w jakim kodowaniu ma go odczytać i w jakim zapisać, a on czysto przekoduje go między UTF-8, UTF-16, ISO-8859-1 (Latin-1), Windows-1252 i innymi popularnymi stronami kodowymi. Skopiuj poprawiony wynik prosto do edytora, arkusza kalkulacyjnego lub bazy danych.
Jak przekonwertować kodowanie tekstu
-
1
Wklej tekst
Dowolny tekst, który wygląda na zniekształcony lub który trzeba przekodować dla innego programu.
-
2
Sprawdź wykrycie
Orientacyjna podpowiedź pokazuje prawdopodobne kodowanie nad polem.
-
3
Wybierz kodowanie źródłowe
Ustaw «Z» zgodnie z tym, jak należy odczytać bajty: UTF-8, Windows-1252, ISO-8859-1, SJIS i inne.
-
4
Wybierz kodowanie docelowe
UTF-8 to nowoczesny standard; UTF-16, Big5 czy GB2312 są dostępne, gdy wymaga ich konkretny program.
-
5
Konwertuj i kopiuj
Tekst zostaje przekodowany, a jedno kliknięcie kopiuje wynik do schowka.
Skąd biorą się konflikty kodowania
| Źródło | Prawdopodobne kodowanie |
|---|---|
| Excel «Zapisz jako CSV» w Windows | Windows-1252 |
| Stara aplikacja Windows | Windows-1252 |
| Stare narzędzie Unix | ISO-8859-1 (Latin-1) |
| Nowoczesny edytor macOS/Linux | UTF-8 |
| Japoński tekst w Windows | Shift-JIS (SJIS) |
| Chiński uproszczony w Windows | GB2312 |
| Chiński tradycyjny (Tajwan/Hongkong) | Big5 |
Klasyczne objawy
caféwyświetla się jakocafé, gdy bajty UTF-8 są odczytywane jako Latin-1. Ustaw «Z» na UTF-8, aby ponownie poprawnie zinterpretować bajty.ñzmienia się wñz tego samego powodu.- Podwójne mojibake w rodzaju
caféoznacza, że tekst zapisano ponownie po pierwszym błędnym odczycie, kodując błędną interpretację drugi raz. - Wiodące
to znacznik kolejności bajtów UTF-8 odczytany jako trzy znaki Latin-1.
Gdy rozpoznasz objaw, droga zwykle jest jasna: odczytaj tekst jako to, czym naprawdę jest (Latin-1, Windows-1252 lub cokolwiek pasuje), i zapisz go z powrotem jako UTF-8.
Znaczniki kolejności bajtów (BOM)
Ten konwerter nie dodaje ani nie usuwa znacznika kolejności bajtów z wyboru: zachowanie wynika z kodowania docelowego. Wynik UTF-8 nie ma znacznika BOM. Zwykły wynik UTF-16 zaczyna się od znacznika BOM i jest big-endian, natomiast UTF-16BE i UTF-16LE zapisują bajty bez BOM. Wybierz UTF-8, chyba że konkretny program wymaga UTF-16.
Gdy znak nie ma odpowiednika
Niektóre bajty nie mają znaczenia w wybranym kodowaniu źródłowym, a niektórych znaków nie da się przedstawić w kodowaniu docelowym. Wtedy konwersja zastępuje je znacznikiem, zamiast się zatrzymać. Najważniejszy jest właściwy wybór kodowania źródłowego: ciąg złożony wyłącznie z ASCII jest poprawny w każdym kodowaniu, więc konflikt zwykle ujawnia się dopiero przy znakach z akcentami lub spoza alfabetu łacińskiego.
Najczęściej zadawane pytania
Listy «Z» i «Na» oferują UTF-8, UTF-16, UTF-16BE, UTF-16LE, ISO-8859-1, ISO-8859-15, Windows-1252, ASCII, EUC-JP, SJIS (Shift-JIS), GB2312 i Big5. Możesz konwertować z dowolnego na dowolne inne.
Dla sieci, baz danych i niemal każdego nowoczesnego procesu, tak. Wyjątki to stare aplikacje Windows, które czytają tylko Windows-1252, niektóre starsze narzędzia mainframe oraz określone japońskie oprogramowanie oczekujące Shift-JIS.
To orientacyjne przypuszczenie na podstawie układu bajtów, wybrane spośród UTF-8, UTF-16, ISO-8859-1, Windows-1252 i ASCII. Przy krótkim lub czysto ASCII tekście może się mylić, więc traktuj je jako wskazówkę i sam ustaw kodowanie «Z», gdy wiesz lepiej.
Tekst jest wysyłany na nasz serwer w celu wykonania konwersji i nie jest przechowywany po zwróceniu odpowiedzi. W przypadku materiałów poufnych lepszy jest edytor offline z wbudowanym konwerterem kodowania.
Powiązane narzędzia
Tabela ASCII
Pełna tabela ASCII od 0 do 127 z zapisem dziesiętnym, szesnastkowym, ósemkowym i binarnym oraz notacją numerycznych odwołań HTML, w tym kodami sterującymi NUL, LF i DEL.
Referencja znaków HTML
Przeszukiwalna lista encji HTML wraz z ich kodami nazwanymi i liczbowymi oraz kopiowaniem jednym kliknięciem specjalnych znaków i symboli.
Skróty klawiaturowe
Wyszukuj udokumentowane skróty domyślne VS Code, Chrome i Bash z GNU Readline w macOS, Windows i Linux.
Podgląd Markdown
Pisz w Markdown i obserwuj, jak wyrenderowany HTML aktualizuje się na żywo. Składnia w stylu GitHub z tabelami, listami zadań, ogrodzonymi blokami kodu i automatycznymi odnośnikami.
Formater JavaScript
Formatuj JavaScript, JSX, TypeScript i JSON z konfigurowalnym wcięciem, stylem cudzysłowów, średnikami i przecinkami końcowymi.
Narzędzie odstępów w kodzie Python
Ujednolić wcięcia oraz proste odstępy przy przecinkach i operatorach. To lekka obróbka tekstu, a nie Black, Ruff ani parser Pythona.
Narzędzie jest dostępne w innych językach
- Teckenkodningskonverterare för textfiler [SV]
- Công cụ chuyển đổi mã hóa tệp văn bản [VI]
- Zeichenkodierung-Konverter für Textdateien [DE]
- Konverter Pengodean Berkas Teks [ID]
- テキストファイル文字コード変換ツール [JA]
- محوّل ترميز ملفات النصوص [AR]
- Conversor de codificação de arquivos de texto [PT]
- Conversor de codificación de archivos de texto [ES]
- Convertisseur d'encodage de fichiers texte [FR]
- 텍스트 파일 인코딩 변환기 [KO]
- Tekencodering-converter voor tekstbestanden [NL]
- เครื่องมือแปลงการเข้ารหัสไฟล์ข้อความ [TH]
- Text File Encoding Converter [EN]
- Convertitore di codifica per file di testo [IT]
- Конвертер кодировки текстовых файлов [RU]
- Metin Dosyası Kodlama Dönüştürücü [TR]
- 文本文件编码转换器 [ZH]