Obraz na Excel

Przenieś drukowany tekst tabeli do edytowalnego arkusza bez wysyłania obrazu na nasz serwer. Tesseract.js rozpoznaje słowa lokalnie, a narzędzie grupuje je według położenia w pionie i oddziela kolumny w miejscach dużych odstępów poziomych. Sprawdź podgląd i pobierz XLSX albo CSV.

Jak przekonwertować obraz na Excel

  1. 1

    Prześlij obraz tabeli

    Najlepiej sprawdza się wyraźny zrzut ekranu, skan albo zdjęcie. Proste, dobrze oświetlone tabele odczytują się najdokładniej.

  2. 2

    Uruchom lokalny OCR

    Tesseract.js rozpoznaje drukowane słowa w wybranym języku OCR bez przesyłania obrazu.

  3. 3

    Sprawdź oszacowane wiersze i kolumny

    Słowa na podobnej wysokości tworzą wiersz, a duży odstęp poziomy rozpoczyna nową kolumnę. To heurystyka, a nie pełne wykrywanie struktury tabeli.

  4. 4

    Pobierz XLSX albo CSV

    Otwórz wybrany format w Excelu, Arkuszach Google lub LibreOffice i popraw ewentualne błędy rozpoznawania albo podziału kolumn.

Co składa się na dobry obraz źródłowy

Czynnik Najlepsze dla dokładności Szkodzi dokładności
Ostrość Wyraźny, w pełni ostry Rozmyty albo niskiej rozdzielczości
Oświetlenie Równe, bez odblasków Cienie, odbicia
Kąt Na wprost, poziomy Przekrzywione albo skośne zdjęcia
Odstępy kolumn Wyraźne przerwy między kolumnami Gęste, scalone lub zagnieżdżone komórki
Tekst Drukowany, wyraźna czcionka Pismo ręczne, ozdobne czcionki

Dokładne limity, języki i prywatność

Źródło musi być prawdziwym plikiem PNG, JPG/JPEG lub WebP o rozmiarze nie większym niż 20 MB, 8192 pikseli na bok i 24 megapiksele. OCR obsługuje drukowany tekst po angielsku, hiszpańsku, francusku, niemiecku, włosku, portugalsku i niderlandzku. Język strony nie zmienia automatycznie języka tekstu na obrazie, dlatego wybierz właściwą opcję OCR.

Obraz nigdy nie opuszcza tej przeglądarki. W pełnym widoku jednej strony pozostaje w pamięci. W widoku trzyetapowym obraz i rozpoznane wiersze są przechowywane w IndexedDB tej witryny maksymalnie przez 30 minut, aby przetrwały przejścia między stronami. Pobranie lub rozpoczęcie od nowa żąda wcześniejszego usunięcia. Przeglądarka może pobrać wybrany model językowy Tesseract, ale nie wysyła wraz z tym żądaniem obrazu źródłowego.

Wyniki to skoroszyt XLSX z jednym arkuszem o nazwie OCR oraz plik CSV w UTF-8. Narzędzie nie odtwarza formuł, scalonych komórek, formatowania, obramowań ani semantycznych nagłówków.

Gdzie oszczędza to realny czas

  • Zeskanowane raporty, które dostałeś tylko na papierze.
  • Zrzuty ekranu pulpitów albo tabel, z których nie możesz skopiować.
  • Zdjęcia paragonów, faktur lub wyciągów, które musisz zsumować.
  • Stare wydruki bez żadnego cyfrowego oryginału.

Zawsze sprawdzaj wynik

Optyczne rozpoznawanie znaków jest dobre, ale nie idealne. Liczby takie jak 0/O i 1/l mogą zostać błędnie odczytane, a scalone albo nietypowe komórki mogą się przesunąć. Szybko porównaj arkusz z obrazem, zanim na nim polegniesz, poprawienie paru komórek jest znacznie szybsze niż przepisanie całej tabeli.

Wskazówki dla czystszego wyodrębnienia

  • Przytnij obraz tak, by zawierał tylko tabelę, zanim go prześlesz.
  • Wyprostuj przekrzywione zdjęcie, aby wiersze były poziome.
  • Zwiększ kontrast na słabych albo wyblakłych wydrukach.

Najczęściej zadawane pytania

Zwykle większość z nich, ale optyczne rozpoznawanie znaków nie jest bezbłędne. Podobnie wyglądające znaki i nietypowe układy komórek mogą się prześliznąć. Zawsze porównuj arkusz z oryginalnym obrazem i poprawiaj wszelkie błędne wartości.

Ostre, równo oświetlone zdjęcie na wprost drukowanej tabeli z widocznymi liniami siatki. Rozmyte, przekrzywione albo odręczne tabele są znacznie trudniejsze do dokładnego odczytania.

Pismo ręczne jest niepewne. Narzędzie jest stworzone dla tekstu drukowanego albo ekranowego. Schludne wersaliki mogą zadziałać, ale spodziewaj się poprawiania większej liczby komórek.

Możesz pobrać skoroszyt XLSX albo plik CSV w UTF-8. Oba zawierają te same oszacowane wiersze i kolumny co podgląd i otwierają się w Excelu, Arkuszach Google lub LibreOffice Calc.

Powiązane narzędzia