Ĝi elprenas la tabelojn el via PDF kaj skribas ilin kiel CSV. Tio estas tabela ekstraktilo, ne dokumenta konvertilo: titoloj, paragrafoj kaj bildoj en la PDF estas forlasitaj, ĉar rulanta prozo ne havas signifan formon kiel kalkultabelaj ĉeloj.
Kion fari se mia PDF ne havas tabelojn en ĝi?
+
Se ĝi ne estas konvertebla, la konvertilo diras tion anstataŭ pretendi alie. Se ne estas tabelo, ne estas io enmetinda en CSV, do vi ricevas klaran eraron petante dosieron kiu enhavas almenaŭ unu tabelon - ne validan sed malplenan kalkultabelon.
Kien iris la korpoteksto de mia PDF?
+
Ĝi neniam estis parto de tiu konverto. Nur la tabeloj estas ekstraktitaj en CSV. Por konservi la skribon, lanĉu PDF tra dokumenta konverto - DOCX, ODT aŭ TXT - anstataŭ kalkultabla celo.
Kiel la konvertilo trovas la tabelojn en mia PDF?
+
Tio dependas de la fonto. DOCX aŭ DOC konservas siajn tabelojn kiel realajn tabelobjektojn, do ili estas legata rekte kaj precize. PDF ne konservas tian strukturon, do la tabeloj estas detektitaj de linioj kaj kolumnoj sur ĉiu paĝo.
Ĉu ekstrakti ĉiun tabelon aŭ nur la unuan?
+
Ĉiu. La tuta PDF estas skanita kaj ĉiu trovita tabelo estas skribita en la CSV; nenio estas preterpasita ĉar ĝi aperas malfrue en la dokumento.
Ĉu tio funkcios sur skanita PDF?
+
Nur se la PDF havas realan tekstan tavolon. Tabela ekstraktado legas tekston kaj ĝian pozicion sur la paĝo; skanado estas bildo de paĝo, do estas nenio leginda. Lanĉu OCR sur ĝi unue, poste konvertu la serĉeblan rezulton al CSV.
Ĉu konservi la formatadon de la originala tabelo?
+
La strukturo estas - vicoj, kolumnoj kaj la valoroj en ili. La ornamado ne estas: plenigoj, tiparoj kaj randoj ne estas portitaj en la CSV, kaj kunigitaj ĉeloj estas solvitaj en ordinarajn tiel ke la datumoj restas maŝinlegendaj.
Kial oni diris al mi uzi.xlsx anstataŭ.xls?
+
Ĉar la malnova formato.xls ne povas fizike teni la tabelon: ĝi estas limigita je 256 kolumnoj kaj 65,536 vicoj. Anstataŭ silente mallongigi viajn datumojn, la konvertilo nomas la limon kiun vi atingas kaj montras al vi.xlsx, kiu havas lokon por ĉirkaŭ miliono da vicoj.
Ĉu CSV estas la ĝusta celo por mia PDF?
+
Tio estas se la PDF estas ĉefe tabeloj kaj vi intencas labori kun la valoroj. Tio ne estas se vi volas legi aŭ redakti la dokumenton, en kiu kazo DOCX, ODT, RTF aŭ TXT estas la konverto kiun vi serĉas.
Kiom kostas PDF al CSV?
+
Nenio por ordinara uzo - alŝuti la PDF, ricevi la CSV, sen aliĝi. Pagaj planoj ekzistas por pli grandaj dosieroj kaj pli pezaj grupoj anstataŭ por la konverto mem.
Ĉu mi povas ekstrakti tabelojn el pluraj PDF dosieroj samtempe?
+
Jes - ĵetu ilin ĉiujn en la alŝutan areon kaj ĉiu el ili kreos sian propran CSV. Dosieroj sen tabeloj estas raportitaj unuope, do malbona dosiero en la grupo ne kaŝas sin kiel bona.
Kio okazos al mia PDF post kiam la CSV estos kreita?
+
Ĝi estas forigita. Konvertoj okazas en izolitaj laboriloj kaj kaj la alŝutita PDF kaj la produktita CSV estas forigitaj ene de minutoj; neniu homo vidas la enhavon. Detaloj estas en / privacy /.