עס איז קײן מאָל ניט געווען אַ טייל פֿון דער איבערזעצונג. נאָר די טאַבעלע איז אױסגעװײנט אין CSV. צו פֿאַרזיכערן דעם שרײַב־פֿאַרבינדונג, אַרײַנשרײַבן PDF אין אַ דאָקומענט־אַרײַנשרײַב־פֿאָרעם DOCX, ODT אָדער TXT, ניט אין אַ ספּרעדשיט־פֿאָרעם
ווי אַזוי פֿילט דער קאָנווערטער די טאַבעלע אין מײַן PDF?
+
דאָס איז אַפּעװענט אױף דעם מקור. אַ DOCX אָדער DOC װײַזט די טאַבעלע־אויסצוגײן װי אַ אמתער טאַבעלע־אויגענט, אַזוי זיי זײַנען לינקס און רעכטס לײדיק. אַ PDF װײַזט ניט די װידער־אויס־אויגענט, אַזוי די טאַבעלע־אויסגײן װײַזט זיך אױף די ליניעס און זײַל־אויסגעפֿילטע טעקסטן אױף װײַז
אױסגלײַכונג
+
יעדער. דער װאָלטיקער PDF איז געװײנטלעכט און יעדער טאַבעלע געפֿונען איז געשריבן אין CSV; ניטאײן איז איבערגעלאָזט װײַל עס װײַזט זיך שפּעטער אין דעם דאָקומענט
װעט דאָס אַרבעטן אויף אַ געסקאַנענער PDF?
+
Only if the PDF has a real text layer. Table extraction reads text and its position on the page; a scan is a picture of a page, so there is nothing to read. Run OCR on it first, then convert the searchable result to CSV.
טעקסט פֿאַרבundo-type
+
The structure is - rows, columns and the values in them. The decoration is not: fills, fonts and borders are not carried into the CSV, and merged cells are resolved into ordinary ones so the data stays machine-readable.
װאָס האָט מיך געזאָגט צו ניצן.xlsx אין װײַט פֿון.xls?
+
װײַל די אַלט־XLSX־פֿאָרעם קען ניט פֿיזיש האַלטן דעם טאַבעלע: עס איז פֿאַרבינדן צו 256 זײַלן און 65,536 שורות. אין װײַט פֿון זיך צו פֿאַרקירצן די דאַטן, האָט דער איבערזעצער געגעבן דעם נאָמען פֿון דער צאָלונגס־גרענעץ װאָס דו האָסט געקענט און װײַזט צו.xlsx, װאָס האָט אָרט פֿאַר אַ מיליאָן שורות
איז CSV דער רעכטער ציל פֿאַר מײַן PDF?
+
דאָס איז אױב דער PDF איז אױף דער הײך טאַבלאַץ און דו װילסט אַרבעטן מיט די באַטרעף. דאָס איז ניט אױב דו װילסט לייענען אָדער רעדאַגירן דעם דאָקומענט, אין װאָסן פאַל DOCX, ODT, RTF אָדער TXT איז דער איבערזעצונג װאָס דו װילסט