Usuwanie podziałów wiersza

Tekst skopiowany z pliku PDF, treści e-maili z twardym zawijaniem oraz strony internetowe wyodrębnione kolumnami zawierają luźne podziały wiersza, które psują układ przy ponownym formatowaniu tekstu. To narzędzie czysto usuwa te podziały, możesz usunąć wszystkie, zachować granice akapitów, usuwając jednocześnie zawijanie wewnątrz akapitu, albo zastąpić je własnym separatorem, takim jak spacja lub kreska pionowa. Wklej, wybierz tryb, skopiuj wynik.

Jak usunąć podziały wiersza

  1. 1

    Wklej tekst źródłowy

    Skopiuj z pliku PDF, e-maila lub kolumny w przeglądarce, wszędzie tam, gdzie są zbędne podziały.

  2. 2

    Wybierz tryb

    Usuń wszystkie, zachowaj tylko akapity albo zastąp spacją / kreską pionową / własnym znakiem.

  3. 3

    Sprawdź spłaszczony wynik

    Białe znaki są scalane, dzięki czemu granice zdań pozostają czytelne.

  4. 4

    Skopiuj i wklej dalej

    Do dokumentu, formularza, pola bazy danych, wszędzie tam, gdzie potrzebny jest tekst w jednej linii.

CR, LF i problem miękkiego zawijania

„Podział wiersza” to w rzeczywistości jedna z trzech sekwencji bajtów, a każda z nich może pojawić się we wklejonym tekście:

Sekwencja Nazwa Występuje w
\n (0x0A) LF Unix, macOS, nowoczesny tekst internetowy
\r\n (0x0D 0x0A) CRLF Pliki Windows, treści e-maili SMTP
\r (0x0D) CR Klasyczny Mac OS, rzadkie stare pliki

Narzędzie normalizuje wszystkie trzy przed przetwarzaniem, więc nie musisz wiedzieć, której używa Twoje źródło.

Trzy tryby, trzy wyniki

Usuń wszystkie, każdy podział wiersza staje się spacją. Przydatne, aby zamienić listę punktowaną lub akapit z twardym zawijaniem w jedną ciągłą linię.

Zachowaj akapity, pojedyncze podziały wiersza stają się spacjami; podwójne podziały (granice akapitów) zostają zachowane. Najczęstszy tryb przy wyodrębnianiu tekstu z plików PDF i czyszczeniu e-booków.

Zastąp separatorem, każdy podział wiersza staje się dowolnym ciągiem znaków: |, , , //. Przydatne, gdy chcesz wkleić wielowierszową listę do komórki CSV.

Typowe zadania porządkowe

  • Ponowne formatowanie akapitów z PDF, pliki PDF twardo zawijają wiersze przy marginesie strony. Zachowanie granic akapitów przy jednoczesnym usunięciu zawijania wewnątrz akapitu przywraca tekst, który można swobodnie formatować.
  • Cytowane odpowiedzi e-mail, kopiowanie z programu Outlook lub Gmail często dodaje w każdym wierszu znaki > oraz zawijanie. Najpierw usuń zawijanie, a następnie zajmij się znakiem > za pomocą funkcji znajdź i zamień.
  • Kopia kolumnowa, skopiowanie tabeli internetowej jako tekstu może wstawić podział wiersza między każdą komórką. Zastąp go tabulatorem, aby wkleić dane do programu Excel.
  • Wklejanie w CMS, niektóre systemy CMS traktują każdy podział wiersza jako <br>. Spłaszcz tekst przed wklejeniem, aby akapity wyświetlały się naturalnie.

Kiedy podziały mają znaczenie i nie należy ich usuwać

  • Poezja i teksty piosenek, każdy wers jest odrębną jednostką. Usuwaj na własne ryzyko.
  • Kod, zachowaj dokładnie. Do porządkowania wcięć użyj narzędzia rozumiejącego kod.
  • Bloki adresowe, ulica / miasto / kod pocztowy znajdują się w osobnych wierszach nie bez powodu.
  • Markdown, pojedynczy podział wiersza jest wyświetlany jako kontynuacja akapitu, a dwa podziały jako nowy akapit. Usunięcie wszystkich zmienia strukturę.

Białe znaki Unicode, na które warto zwrócić uwagę

Pliki PDF oraz kopiowanie i wklejanie czasem pozostawiają:

  • Spacja nierozdzielająca (U+00A0), wygląda jak spacja, ale nią nie jest; wiele reguł „usuwania białych znaków” ją pomija.
  • Separator wiersza (U+2028) i separator akapitu (U+2029), oficjalne podziały wiersza Unicode, które generują niektóre edytory.
  • Miękki dywiz (U+00AD), niewidoczny punkt przenoszenia wyrazu, który psuje wyszukiwanie.

Narzędzie traktuje wszystkie te znaki jako podziały wiersza, dzięki czemu czyszczenie jest kompletne.

Najczęściej zadawane pytania

Jeśli wybierzesz tryb „Zachowaj akapity“, tak, podwójne podziały wiersza (separator akapitu) zostają, a pojedyncze są usuwane. Tryb „Usuń wszystkie“ scala całość do jednej linii.

Tak. Narzędzie normalizuje zakończenia CRLF, samego CR i samego LF przed przetwarzaniem, dzięki czemu treść wklejona z Notatnika Windows, starych plików tekstowych z Maca i stron internetowych zachowuje się tak samo.

Tak, tryb własnego separatora przyjmuje dowolny ciąg znaków: kreskę pionową |, tabulator, , albo pusty ciąg, aby w ogóle nie było separatora.

Nie. Czyszczenie odbywa się w całości w Twojej przeglądarce, a wklejony tekst nie jest przesyłany.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach