Ekstraktor kolumny CSV

Wyodrębnij kolumny

Eksport z systemu CRM, platformy analizy lub bazy danych często zawiera 30 kolumn, podczas gdy potrzebujesz tylko trzech. Ten narzędzie odczytuje plik CSV, pobiera listę indeksów kolumn oddzielonych komami (numerowane od 1) i powraca nowy plik CSV zawierający wyłącznie te kolumny w żądanym porządku. Wiersze nagłówkowe i wiersze danych są traktowane identycznie – kolumna 1 w nagłówku odpowiada kolumnie 1 we wszystkich wierszach danych.

Jak wydobyć kolumny

  1. 1

    Wklej plik CSV

    Pełny plik lub fragment pliku. Linie są rozdzielone znakami CR, LF lub CRLF, a każda linia jest analizowana zgodnie ze standardowymi zasadami CSV.

  2. 2

    Uwzględź kolumny, które należy zachować.

    Używaj indeksów zaczynających się od 1, oddzielonych komami, na przykład `1,3,5`. Rezultat będzie ułożony w tym porządku – możesz dowolnie zmieniać kolejność kolumn podczas pracy.

  3. 3

    Uruchom ekstrakcję

    Każdy wiersz jest przepisywany wyłącznie z żądanymi komórkami. Przecinki wewnątrz komórek są obsługiwane przez automatyczne ujmowanie ich w cudzysłowy.

  4. 4

    Kopij lub zapisz

    Wklej wynik do Excela, programu do importu baz danych lub dowolnego narzędzia umożliwiającego odczytanie pliku w formacie CSV.

W jaki sposób ekstraktor radzi sobie z trudnymi elementami

Format CSV wygląda prosto, dopóki nie napotkasz komórki zawierającej przecinek lub cudzysłów. Ekstraktor analizuje każdy wiersz według reguł CSV w stylu RFC 4180.

Zasady analizy wejścia

  • Wiersze są rozdzielane na dowolnym znaku podziału wiersza Unicode, więc pliki z systemów Windows, macOS i Linux działają bez problemów.
  • Komórki w cudzysłowach mogą zawierać przecinki, znaki nowej linii oraz zmienione cudzysłowy ("").
  • Puste wiersze końcowe są usuwane.

Formatowanie wyniku

  • Kolejność kolumn w wyniku odpowiada kolejności wprowadzonej przez użytkownika, a nie kolejności w danych wejściowych.
  • Komórka zawierająca przecinek jest ponownie ujmowana w podwójne cudzysłowy, aby dalsze parsery odczytały ją poprawnie.
  • Komórki niezawierające przecinków są wysyłane bez zmian, aby wynik był zwięzły.

Pułapki, na które należy zwrócić uwagę

Scenariusz Co się dzieje
Indeks poza ostatnią kolumną W tej pozycji generowany jest pusty ciąg znaków.
Ujemny lub zerowy indeks Indeksy mniejsze niż 1 są ignorowane.
Komórka zawiera znak cudzysłowu W wyniku ponownie ujmowana w cudzysłowy zgodnie z RFC 4180 (""), aby rygorystyczne parsery odczytały ją poprawnie.
Zduplikowany indeks, np. 1,1,2 Kolumna 1 jest generowana dwukrotnie – przydatne w przypadku duplikacji kluczy w arkuszu kalkulacyjnym.

Dla bardzo dużych plików (miliony wierszy) rozważ streamowanie pliku CSV za pomocą odpowiedniej biblioteki; narzędzie przechowuje wszystkie dane w pamięci i spowolni się po przekroczeniu kilku setek tysięcy wierszy.

Najczęściej zadawane pytania

Indeksy, zaczynające się od 1 dla najlewszej kolumny. Aby wyselekcjonować dane według nazwy nagłówka, sprawdź wiersz z nagłówkami w pliku CSV i przekształć nazwy w odpowiednie pozycje.

Tak. Wyjście zachowuje kolejność listy indeksów: dla każdego rzędu, włącznie z nagłówkiem, 3,1,2 wygeneruje pierwszą kolumnę 3, potem kolumnę 1 i następnie kolumnę 2.

Komórki brakujące są wypełniane pustym ciągiem znaków. To zapewnia, że wynik ma prostokątny kształt, aby narzędzia stosowane później nie napotykali problemów z obróbką nieprawidłowych rzędów.

Tak. Aby wyodrębnić kolumny, plik CSV jest wysyłany na nasz serwer, przetwarzany, a wynik wraca do Twojej przeglądarki. Nie jest przechowywany ani dodawany do linku strony.

Powiązane narzędzia

Narzędzie jest dostępne w innych językach