Konwerter znaków pełnej i połówkowej szerokości

Choose the target width. The converter uses explicit ASCII and Katakana character tables and leaves unsupported characters unchanged.

Target width

Zmieniaj szerokość odpowiednich znaków w tekście mieszającym japoński i alfabet łaciński bez tłumaczenia ani ogólnej normalizacji. Wybierz wynik pełnej albo połówkowej szerokości i wpisz do 10 000 punktów kodowych Unicode. Narzędzie stosuje jawne tabele ASCII, interpunkcji i katakany w bieżącej sesji przeglądarki, więc kanji, hiragana, emoji i każdy znak spoza tabeli pozostają takie jak w źródle.

Formy pełnej i połówkowej szerokości są odrębnymi znakami Unicode, a nie jedynie innym rozmiarem czcionki. Punkt 18.5 podstawowej specyfikacji Unicode 17 opisuje ich pochodzenie w systemach wschodnioazjatyckich, gdzie znaki dwubajtowe zajmowały dwie komórki, a ASCII i podobne znaki jednobajtowe jedną.

Konwerter nie uruchamia ogólnej normalizacji zgodności Unicode. Stosuje tylko mniejszy, sprawdzalny zestaw zamian.

ASCII i spacja

W kierunku pełnej szerokości każdy drukowalny znak ASCII od U+0021 do U+007E przechodzi na odpowiednik od U+FF01 do U+FF5E. Spacja ASCII U+0020 przechodzi na spację ideograficzną U+3000. Kierunek przeciwny odwraca tylko te pary. Tablica Halfwidth and Fullwidth Forms dokumentuje szerokie odpowiedniki interpunkcji, cyfr i liter łacińskich.

Kierunek Wejście Wynik
Na pełną szerokość ABC 123!? ABC 123!?
Na połówkową szerokość ABC 123!? ABC 123!?
Na pełną szerokość 東京2026 ガイド😀 東京2026 ガイド😀

W trzecim wierszu zmieniają się cyfry ASCII, spacja i obsługiwana katakana połówkowej szerokości. 東京 i emoji pozostają nietknięte.

Katakana, interpunkcja i znaki udźwięcznienia

Narzędzie używa jawnej tabeli dla katakany połówkowej szerokości, japońskiej interpunkcji i znaku przedłużenia samogłoski. Lista nazw znaków Unicode od U+FF00 do U+FFEF podaje wąskie odpowiedniki U+FF61 do U+FF9F, między innymi z , z , z oraz z .

Kierunek Wejście Wynik
Na pełną szerokość ガ パ ヴ ガ パ ヴ
Na połówkową szerokość ガ パ ヴ ガ パ ヴ
Na pełną szerokość 。、「」・ー 。、「」・ー
Na połówkową szerokość 。、「」・ー 。、「」・ー

Sylaby dźwięczne i półdźwięczne mają ustalone pary: ガ odpowiada , パ odpowiada , a ヴ odpowiada . Tabela obejmuje również obsługiwane pary ヷ i ヺ. Nieobsługiwane kana, takie jak , , , , i , pozostają bez zmian zamiast być zgadywane lub transliterowane.

U+FF9E i U+FF9F są traktowane jako ścisłe połówkowe odpowiedniki łączących znaków U+3099 i U+309A. Odstępowe znaki U+309B i U+309C są innymi znakami i nie zmieniają się.

Ważne zastrzeżenie o normalizacji i konwersji w obie strony

To nie jest NFKC. Aneks nr 15 do standardu Unicode klasyfikuje warianty szerokości jako zgodne odpowiedniki, ale pokazuje też, że NFKC zmienia wiele innych form zgodności. Jawne tabele chronią znaki spoza zakresu przed takimi skutkami.

Dla udźwięcznionej katakany występuje celowe składanie. Zarówno gotowy znak , jak i sekwencja plus łączący U+3099 zwężają się do ガ. Ponowne poszerzenie daje zwyczajowy gotowy znak . Odczyt pozostaje taki sam, ale narzędzie nie gwarantuje powrotu do identycznej sekwencji punktów kodowych.

Rodzina tyld dobrze pokazuje kolejną granicę:

Kierunek Wejście Wynik
Na pełną szerokość ~〜~ ~〜~
Na połówkową szerokość ~〜~ ~〜~

Tylda ASCII U+007E i tylda pełnej szerokości U+FF5E tworzą parę. Fala U+301C jest innym, niewymienionym znakiem i pozostaje bez zmian.

Co pozostaje bez zmian

Tabulatory, końce wierszy i twarda spacja U+00A0 są zachowywane. Tak samo hiragana, kanji, emoji, połówkowy hangul, nieobsługiwane kana, cyfry arabsko-indyjskie, cyfry wschodnioarabsko-indyjskie oraz wszystkie inne punkty kodowe spoza tabel. Konwerter nie tłumaczy słów, nie zmienia hiragany w katakanę, nie interpretuje liczb, nie transliteruje japońskiego i nie służy do ogólnego czyszczenia Unicode.

Karta JIS X 0201:1997 Japońskiego Stowarzyszenia Normalizacyjnego wskazuje historyczny kontekst 7- i 8-bitowych zestawów znaków łacińskich oraz katakany. To narzędzie nie bada jednak kodowania pliku ani nie potwierdza zgodności z JIS X 0201, prawem lub wymaganiami dokumentu. Działa wyłącznie na tekście Unicode przekazanym przez przeglądarkę.

Prywatność i limit wejścia

Konwersja odbywa się w przeglądarce. Tekst źródłowy i kierunek są zapisane w sessionStorage bieżącej sesji, aby można było przejść przez trzy etapy widoku. Tekst nie jest wysyłany przez nasze serwery, umieszczany w adresie URL ani przesyłany na serwer. Rozpoczęcie od nowa usuwa zapisaną wartość. Menedżer schowka, rozszerzenia i miejsce wklejenia wyniku pozostają poza kontrolą narzędzia.

Limit wynosi 10 000 punktów kodowych Unicode, nie jednostek UTF-16. Znak dodatkowy, na przykład emoji, liczy się raz. Obsługiwana katakana z łączącym znakiem może po konwersji stać się jednym znakiem złożonym, więc liczba punktów kodowych wyniku nie zawsze równa się liczbie punktów wejścia.

Najczęściej zadawane pytania

Nie. Narzędzie stosuje wyłącznie jawne mapowania szerokości ASCII, spacji, interpunkcji i katakany. NFKC ma szerszy wpływ na znaki zgodności spoza tego zakresu.

Nie. Hiragana pozostaje bez zmian. Konwerter zmienia tylko wymienione pary szerokości i nie tłumaczy ani nie transliteruje japońskiego.

Sekwencja rozłożona i gotowy znak ガ zwężają się do ガ. Poszerzenie tej pary daje gotowy znak ガ, więc odczyt jest zachowany, ale pierwotna sekwencja punktów kodowych nie.

Nie. Mapowane są tylda ASCII i tylda pełnej szerokości. Fala U+301C jest osobnym, niewymienionym znakiem i pozostaje bez zmian.

Nie. Narzędzie nie bada bajtów, struktury pliku ani wymagań dokumentu i nie daje certyfikatu JIS, prawnego lub urzędowego.

Nie. Jest przetwarzany lokalnie i przechowywany tylko w bieżącej sesji przeglądarki na potrzeby widoku etapowego. Nie trafia do serwera ani adresu strony.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach