Konwerter PDF do Excela

PDF do Excela

PDF, wyodrębnione tabele i pobrane pliki pozostają w tej przeglądarce.

Przywracanie prywatnej sesji przeglądarki...

Wybierz PDF

Tekstowy PDF, do 20 MiB i 150 stron. Skany wymagają najpierw OCR.

Wyodrębnianie danych tabelarycznych z PDF

Nie znaleziono regularnej tabeli tekstowej. Skany wymagają OCR, a nieregularny układ może wymagać ręcznych poprawek.

Zamień regularne tabele z tekstowego PDF-u w arkusze bez przesyłania dokumentu. Konwerter wykorzystuje położenie zaznaczalnego tekstu, aby znaleźć prostokątne tabele, zachowuje je osobno i pozwala je przejrzeć oraz wybrać przed eksportem. Pobierz jeden skoroszyt XLSX z osobnym arkuszem dla każdej wybranej tabeli albo zapisz każdą tabelę jako CSV lub TSV. Skany wymagają wcześniejszego OCR, a nieregularne układy mogą wymagać ręcznych poprawek.

Jak przekonwertować tabelę PDF do Excela

  1. 1

    Wybierz tekstowy PDF

    Wybierz prawidłowy PDF do 20 MiB i 150 stron. Tekst musi dać się zaznaczyć; skan zawierający wyłącznie obraz wymaga najpierw OCR.

  2. 2

    Sprawdź wykryte tabele

    Lokalny detektor szuka co najmniej dwóch wierszy o stałym położeniu kolumn. Wybierz tylko tabele, których podgląd zgadza się ze źródłem.

  3. 3

    Ustaw opcje CSV

    Dla CSV lub TSV wybierz przecinek, średnik albo tabulator, zdecyduj o znaczniku UTF-8 BOM i pozostaw ochronę formuł włączoną, jeśli nie ufasz źródłu.

  4. 4

    Pobierz lokalnie

    Pobierz jeden skoroszyt XLSX z wybranymi tabelami albo każdą wybraną tabelę w osobnym pliku CSV lub TSV.

Co detektor potrafi odzyskać

Strona PDF przechowuje tekst wraz z jego położeniem, a nie komórki arkusza. Konwerter grupuje pobliski tekst w wiersze, szuka powtarzalnych punktów zaczepienia kolumn, uzupełnia brakujące komórki i odrzuca bloki, które nie przypominają regularnej tabeli. Uwzględnia też obrót i widoczny obszar strony.

Zawartość PDF Prawdopodobny wynik Co sprawdzić
Prosta tabela z co najmniej dwiema wyrównanymi kolumnami Zwykle wykryta jako prostokątna tabela Porównaj nagłówki, kolejność wierszy i puste komórki
Kilka osobnych tabel na jednej lub wielu stronach Pozostają osobnymi tabelami do wyboru Wybierz tylko tabele potrzebne w skoroszycie
Regularna tabela zapisana od prawej do lewej Zachowuje wizualną kolejność od prawej do lewej Sprawdź liczby i komórki z różnymi alfabetami
Akapity, nagłówki i elementy strony Zwykle pomijane, bo nie tworzą tabeli Upewnij się, że nie dołączono bloku spoza tabeli
Scalane komórki, tabele zagnieżdżone lub rekordy wielowierszowe Mogą się rozdzielić, przesunąć albo zostać odrzucone Popraw arkusz ręcznie lub użyj specjalistycznego ekstraktora
Skan obrazu, pismo odręczne lub zdjęcie paragonu Brak zaznaczalnego tekstu tabeli Najpierw wykonaj OCR i użyj przeszukiwalnego PDF-u

Detektor celowo działa zachowawczo. Lepiej nie zgłosić tabeli, niż zamienić niezwiązany tekst w wiarygodnie wyglądający, lecz błędny arkusz. Przed obliczeniami, importem lub uzgadnianiem zawsze porównaj ważne wartości ze źródłowym PDF-em.

Formaty eksportu

XLSX tworzy po jednym arkuszu na wybraną tabelę, maksymalnie 200 arkuszy w jednym pliku. Każda wartość jest zapisywana jako tekst. Konwerter nie rozpoznaje automatycznie liczb, dat, formuł, walut ani formatów księgowych i nie odtwarza obramowań, czcionek, scalonych komórek ani wyglądu strony.

CSV i TSV zapisują każdą wybraną tabelę osobno. Dostępne są przecinek, średnik i tabulator. Pola zawierające separator, cudzysłów lub podział wiersza są ujmowane w podwójny cudzysłów, a rekordy kończą się CRLF zgodnie z typowymi regułami RFC 4180. Znacznik UTF-8 BOM jest domyślnie włączony dla lepszej zgodności z arkuszami, ale właściwy separator zależy od programu i ustawień regionalnych.

Bezpieczeństwo formuł arkusza

Tekst w PDF-ie może zaczynać się od =, +, - lub @. Niektóre arkusze uznają taki tekst w otwartym CSV za formułę. Domyślnie włączona ochrona poprzedza komórki wyglądające jak formuły dodatkowym znakiem, także po początkowych odstępach i w przypadku pełnoszerokich odpowiedników.

To ograniczenie ryzyka, a nie uniwersalna gwarancja bezpieczeństwa. Wytyczne OWASP dotyczące CSV Injection wskazują, że programy zachowują się różnie, a zabezpieczenie może się zmienić po ponownym zapisaniu i otwarciu CSV. Dla niezaufanych PDF-ów pozostaw ochronę włączoną, sprawdź komórki i nie włączaj makr ani nie ignoruj ostrzeżeń. W XLSX wartości są zapisywane jawnie jako tekst, a nie formuły.

Limity i prywatne dane w przeglądarce

  • Jeden PDF naraz, do 20 MiB i 150 stron.
  • Pliki z nadmierną liczbą fragmentów tekstu, ilością tekstu lub danych tabel są odrzucane, zanim przeciążą przeglądarkę.
  • Podgląd pokazuje pierwsze 100 wierszy każdej tabeli, natomiast eksport obejmuje wszystkie wykryte wiersze mieszczące się w limitach.
  • Skoroszyt może zawierać do 200 wybranych arkuszy.
  • PDF-y zaszyfrowane i chronione hasłem nie są obsługiwane. Najpierw odblokuj kopię, do której masz uprawnienia.
  • Podczas trzech kroków źródłowy PDF, tabele i ustawienia pozostają prywatnie w tej przeglądarce przez 30 minut. Zachowywane są najwyżej trzy zadania i 80 MiB lokalnych danych.
  • W adresie procesu znajduje się tylko losowy identyfikator zadania. PDF, wartości i pobrane pliki nie są wysyłane przez Livewire ani na serwer wyników.
  • Wybranie Zacznij od nowa usuwa bieżące lokalne zadanie. Wygasłe lub błędne rekordy są usuwane przy kolejnym sprawdzeniu pamięci przeglądarki.

PDF jest odczytywany z lokalnych bajtów przez PDF.js. Narzędzie pobiera biblioteki jak zwykłe zasoby internetowe, ale nie dołącza do tych żądań wybranego dokumentu.

Dostępny podgląd

Pole wyboru pliku działa z klawiatury, a postęp i błędy są ogłaszane technologiom wspomagającym. Tabele mają podpisy i nagłówki kolumn. Na małych ekranach podgląd można przewijać poziomo; zachowywany jest też wykryty kierunek tabel pisanych od prawej do lewej. Ułatwienia pomagają w kontroli, ale nie zastępują porównania ze źródłem, gdy liczy się dokładność.

Najczęściej zadawane pytania

Detektor wymaga zaznaczalnego tekstu w co najmniej dwóch wierszach ze stałymi pozycjami kolumn. Skan, układ jednowierszowy, formularz narysowany poleceniami graficznymi lub nieregularna tabela mogą nie spełnić tego warunku. Wykonaj OCR stron obrazowych albo użyj specjalistycznego narzędzia do złożonych układów.

Nie. Odczytuje tylko tekst już osadzony w PDF-ie. Jeśli nie możesz zaznaczyć ani skopiować tekstu tabeli w czytniku, najpierw utwórz przeszukiwalny PDF za pomocą OCR.

Wybierz XLSX, aby umieścić wszystkie tabele w jednym skoroszycie z osobnym arkuszem dla każdej. CSV jest szeroko obsługiwanym plikiem importu tekstowego. TSV sprawdzi się, gdy dane często zawierają przecinki lub średniki albo program docelowy wymaga tabulatorów.

Konwerter zachowuje znaki zamiast odgadywać ich znaczenie. 1,234.56 lub 01/02/2026 mogą oznaczać coś innego w zależności od regionu. Po sprawdzeniu separatorów dziesiętnych i dat świadomie przekształć kolumnę w arkuszu.

Dodaje znak przed komórkami rozpoczynającymi się jak formuły, w tym od =, +, -, @ i ich pełnoszerokich odpowiedników po początkowych odstępach. Zmniejsza ryzyko uruchomienia formuły, ale nie gwarantuje bezpieczeństwa w każdym programie ani po każdym ponownym zapisie.

Nie. Źródłowy PDF, wykryte tabele oraz pliki XLSX, CSV i TSV pozostają w przeglądarce. Zadanie jest przechowywane lokalnie przez 30 minut, a w adresie znajduje się tylko losowy identyfikator. Zacznij od nowa usuwa bieżące zadanie.

Tak. Narzędzie wykrywa osobne regularne tabele w całym PDF-ie. Wybierz potrzebne i pobierz jeden XLSX z maksymalnie 200 arkuszami albo każdą tabelę osobno jako CSV lub TSV.

Nie zawsze. Obrót strony jest uwzględniany, ale pionowe etykiety, zagnieżdżone tabele, scalone komórki, rekordy wielowierszowe i ozdobne układy mogą się przesunąć lub zostać odrzucone. Sprawdź podgląd, porównaj sumy z PDF-em i popraw arkusz przed użyciem.

Powiązane narzędzia