Konwerter PDF na tekst
Najszybszy sposób, by wydobyć słowa z pliku PDF. To narzędzie odczytuje warstwę tekstową już zapisaną w pliku PDF, strona po stronie, i zwraca zwykły tekst, który możesz skopiować lub zapisać jako plik .txt. Wszystko działa w Twojej przeglądarce, więc dokument nigdy nie jest nigdzie wysyłany. Jedna rzecz na wstępie: narzędzie odczytuje tekst, który już jest w pliku, więc dokument zeskanowany lub sfotografowany (obraz bez warstwy tekstowej) wyjdzie pusty. W takich przypadkach użyj zamiast tego narzędzia OCR.
Jak wyodrębnić tekst z pliku PDF
-
1
Prześlij plik PDF
Przeciągnij go lub kliknij, aby wybrać. Plik zostaje na Twoim urządzeniu i nigdy nie jest wysyłany na serwer.
-
2
Wyodrębnij tekst
Narzędzie odczytuje warstwę tekstową każdej strony i łączy je razem, umieszczając znacznik przed każdą stroną.
-
3
Sprawdź wynik
Wyodrębniony tekst pojawia się w polu, strona po stronie, gotowy do sprawdzenia.
-
4
Skopiuj lub pobierz
Skopiuj go do schowka lub zapisz jako plik .txt, aby użyć go ponownie gdzie indziej.
Co to narzędzie odczytuje, a czego nie potrafi
| Rodzaj pliku PDF | Wynik |
|---|---|
| Wyeksportowany z Worda, Google Docs, przeglądarki lub narzędzia graficznego | Pełny tekst, czysty i kompletny |
| Cyfrowy plik PDF z prawdziwą warstwą tekstową | Tekst wyodrębniony strona po stronie |
| Skan lub zdjęcie zapisane jako PDF (tylko obraz) | Pusto lub prawie pusto: nie ma tekstu do odczytu |
| Plik PDF chroniony hasłem | Nie da się odczytać, dopóki go najpierw nie odblokujesz |
Tu nie ma OCR: użyj właściwego narzędzia do skanów
Ten ekstraktor nie uruchamia OCR (optycznego rozpoznawania znaków). Kopiuje tekst, który już jest wewnątrz pliku PDF, nie odczytuje pikseli. Jeśli Twój plik to skan i nic nie otrzymujesz, przepuść go najpierw przez narzędzie OCR, które zamienia obraz w prawdziwą warstwę tekstową, a tę możesz potem wyodrębnić.
Jak ułożony jest tekst
Każdą stronę oddziela znacznik --- Page N ---, więc widzisz, gdzie kończy się jedna strona, a zaczyna następna. Tekst jest pobierany w kolejności, w jakiej zapisano go w pliku PDF. Większość dokumentów czyta się naturalnie; kilka z nietypowymi układami wielokolumnowymi może przeplatać kolumny, ponieważ narzędzie trzyma się kolejności zapisanej w pliku PDF, zamiast zgadywać ścieżkę czytania.
Typowe zastosowania
- Zasilanie modelu AI. Modele językowe przyjmują zwykły tekst, a nie pliki PDF. Wcześniejsze wyodrębnienie sprawia, że wszystko jest szybsze i przewidywalne.
- Cytowanie i wyszukiwanie. Skopiuj fragment bez walki z zaznaczaniem w przeglądarce PDF.
- Ponowne wykorzystanie treści. Przenieś tekst do dokumentu, e-maila lub notatki bez przepisywania go od nowa.
Najczęściej zadawane pytania
Nie. Odczytuje osadzoną warstwę tekstową, a skan to po prostu obraz bez warstwy tekstowej, więc wychodzi pusty. Do zeskanowanych lub sfotografowanych dokumentów użyj narzędzia OCR, a potem wyodrębnij tekst.
Nie. Wyodrębnianie odbywa się w całości w Twojej przeglądarce, na Twoim własnym urządzeniu. Plik PDF nigdy nie jest wysyłany na serwer i nic nie jest przechowywane.
Kilka plików PDF, zwłaszcza układy wielokolumnowe, przechowuje tekst w innej kolejności niż go czytasz. Narzędzie trzyma się kolejności zapisanej w pliku PDF, więc kolumny mogą się przeplatać. Dokumenty wyeksportowane z edytorów tekstu prawie zawsze wychodzą poprawnie.
Nie, dopóki są zablokowane. Najpierw usuń hasło narzędziem do odblokowywania PDF, a potem wyodrębnij tekst.
Powiązane narzędzia
OCR plików PDF
Wyodrębniaj zwykły tekst ze skanów drukowanych dokumentów w PDF za pomocą OCR w przeglądarce. 12 języków, pliki do 20 MB i 40 stron.
Formularze PDF
Wypełniaj istniejące pola AcroForm lokalnie, zachowuj wpisane wcześniej wartości i pobieraj interaktywną lub świadomie spłaszczoną kopię.
Zamazać dane w PDF
Zakryj wrażliwe obszary i utwórz w przeglądarce nowy spłaszczony PDF. Każda strona wyniku jest obrazem JPEG, więc tekst, linki, formularze, warstwy i metadane źródłowe nie są przenoszone.
Skanowanie PDF
Zamień zdjęcia dokumentów JPEG, PNG lub WebP w lokalny PDF. Dodaj maksymalnie 25 obrazów, wybierz pionowe A4 lub US Letter i nie przesyłaj plików.
Kreator przeszukiwalnego PDF
Zamień zeskanowany PDF w dokument przeszukiwalny i z zaznaczalnym tekstem, dodając niewidoczną warstwę tekstową OCR. W całości w Twojej przeglądarce; 7 języków alfabetu łacińskiego.
Word na PDF
Konwertuj dokumenty Word .doc i .docx do PDF z zachowaniem układu strony, obrazów, tabel i nagłówków. Bezpieczne przesyłanie, automatyczne usunięcie po 2 godzinach.
Narzędzie jest dostępne w innych językach
- Konverter PDF ke Teks [ID]
- Conversor de PDF para texto [PT]
- PDF-zu-Text-Konverter [DE]
- PDF テキスト変換ツール [JA]
- PDF 텍스트 변환기 [KO]
- ตัวแปลง PDF เป็นข้อความ [TH]
- محوّل PDF إلى نص [AR]
- PDF till text-konverterare [SV]
- Công cụ chuyển PDF sang văn bản [VI]
- Conversor de PDF a texto [ES]
- Convertisseur PDF en texte [FR]
- PDF-naar-tekst-converter [NL]
- PDF to Text Converter [EN]
- Convertitore da PDF a testo [IT]
- Конвертер PDF в текст [RU]
- PDF'den Metne Dönüştürücü [TR]
- PDF 转文本转换器 [ZH]