Konwerter Unicode na UTF-8
Zamień dosłowny tekst Unicode na składnię escape \u00E9, \u{1F600}, którą języki programowania osadzają w kodzie źródłowym, albo wklej ciąg z escapami i zdekoduj go z powrotem na oryginalne znaki. Działa dla znaków BMP (4-cyfrowe escapy) i płaszczyzn uzupełniających, takich jak emoji (zmiennej długości \u{...}).
Jak konwertować między escapami Unicode a UTF-8
-
1
Wybierz kierunek
Koduj znaki na escapy `\u` albo dekoduj ciąg z escapami z powrotem na tekst.
-
2
Wklej swoje dane
Zwykły tekst do kodowania; ciąg z sekwencjami `\uXXXX` albo `\u{XXXXX}` do dekodowania.
-
3
Odczytaj wynik
Znaki BMP dają czterocyfrowe escapy w stylu `\u0041`; znaki powyżej U+FFFF używają postaci ES6 `\u{...}`.
-
4
Skopiuj do swojego kodu
Wrzuć wynik do ciągu JavaScript, literału JSON, pliku konfiguracyjnego albo fikstury testowej.
Składnia escape w różnych językach
Różne języki zapisują tę samą ideę inaczej. Konwerter wypisuje powszechną formę JavaScript/JSON, ale oto na co tłumaczysz, gdy piszesz ten sam znak gdzie indziej.
Składnia escape według języka
| Język | BMP (<= U+FFFF) | Uzupełniające (> U+FFFF) |
|---|---|---|
| JavaScript | \u00E9 |
\u{1F600} (ES6+) |
| JSON | \u00E9 |
Para surogatów \uD83D\uDE00 |
| Python | \u00e9 |
\U0001F600 |
| Java | \u00e9 |
Para surogatów |
| C / C++ | \u00e9 |
\U0001F600 |
| Ruby | \u00e9 |
\u{1F600} |
| Rust | \u{00e9} |
\u{1F600} |
| Encja HTML | é |
😀 |
| CSS | \0000e9 |
\1F600 |
Dlaczego emoji potrzebują długiej formy
Podstawowa płaszczyzna wielojęzyczna (BMP) obejmuje U+0000 do U+FFFF, wszystko mieści się w pojedynczej 16-bitowej jednostce, do czego zaprojektowano starą składnię \uXXXX. Emoji żyją głównie w płaszczyźnie 1 (U+1F000 i wyżej), która nie zmieści się w czterech cyfrach szesnastkowych. Dwie opcje:
- Klamry ES6,
\u{1F600}przyjmuje dowolną długość. - Pary surogatów UTF-16, dwa escapy
\uXXXXna jeden znak. Parsery JSON to akceptują i właśnie to zwykle emitują kodery JSON.
Oba dekodują do tego samego ciągu, ale pary surogatów są kruche: pocięcie ciągu między wysokim a niskim surogatem daje nieprawidłowy UTF-16.
Najczęściej zadawane pytania
Cztery cyfry szesnastkowe sięgają maksymalnie U+FFFF. Emoji zaczynają się od U+1F000, więc potrzebują postaci z klamrami ES6 \u{...}, albo pary surogatów UTF-16, jeśli tkwisz przy starszych celach. To narzędzie używa klamr dla wszystkiego powyżej U+FFFF.
Nie jako parę. Dekoder rozumie postać z klamrami \u{1F600} oraz czterocyfrowe escapy \uXXXX, ale nie łączy pary surogatów UTF-16 (formy z dwoma escapami, której używa JSON) z powrotem w jedno emoji: każda połowa jest dekodowana osobno i nie da się jej odtworzyć. Dla wszystkiego powyżej U+FFFF wklej postać z klamrami \u{...}, czyli dokładnie to, co produkuje koder.
Nie. Escape taki jak \u00E9 reprezentuje punkt kodowy U+00E9, a nie sekwencję bajtów UTF-8 (która byłaby C3 A9). Dla widoku surowych bajtów użyj narzędzia Wyszukiwarka Unicode, które pokazuje bajty UTF-8 w HEX.
Konwersja odbywa się po stronie serwera w obrębie tego żądania, ale nic nie jest zachowywane: brak logowania, brak przechowywania konwertowanych ciągów.
Powiązane narzędzia
Tabela ASCII
Pełna tabela ASCII od 0 do 127 z zapisem dziesiętnym, szesnastkowym, ósemkowym i binarnym oraz notacją numerycznych odwołań HTML, w tym kodami sterującymi NUL, LF i DEL.
Referencja znaków HTML
Przeszukiwalna lista encji HTML wraz z ich kodami nazwanymi i liczbowymi oraz kopiowaniem jednym kliknięciem specjalnych znaków i symboli.
Skróty klawiaturowe
Wyszukuj udokumentowane skróty domyślne VS Code, Chrome i Bash z GNU Readline w macOS, Windows i Linux.
Podgląd Markdown
Pisz w Markdown i obserwuj, jak wyrenderowany HTML aktualizuje się na żywo. Składnia w stylu GitHub z tabelami, listami zadań, ogrodzonymi blokami kodu i automatycznymi odnośnikami.
Narzędzie odstępów w kodzie Python
Ujednolić wcięcia oraz proste odstępy przy przecinkach i operatorach. To lekka obróbka tekstu, a nie Black, Ruff ani parser Pythona.
Formater JavaScript
Formatuj JavaScript, JSX, TypeScript i JSON z konfigurowalnym wcięciem, stylem cudzysłowów, średnikami i przecinkami końcowymi.
Narzędzie jest dostępne w innych językach
- Konverter Unicode ke UTF-8 [ID]
- Unicode till UTF-8-omvandlare [SV]
- เครื่องแปลง Unicode เป็น UTF-8 [TH]
- Unicode zu UTF-8 Konverter [DE]
- UnicodeからUTF-8への変換ツール [JA]
- 유니코드-UTF-8 변환기 [KO]
- Convertidor de Unicode a UTF-8 [ES]
- Conversor de Unicode para UTF-8 [PT]
- Chuyển đổi từ Unicode sang UTF-8 [VI]
- Convertisseur Unicode en UTF-8 [FR]
- مُحوّل يونيكود إلى UTF-8 [AR]
- Unicode naar UTF-8 converter [NL]
- Unicode to UTF-8 Converter [EN]
- Convertitore da Unicode a UTF-8 [IT]
- Конвертер Unicode в UTF-8 [RU]
- Unicode'dan UTF-8'e Dönüştürücü [TR]
- Unicode 到 UTF-8 转换器 [ZH]