PDF til CSV
Udtræk tabeller fra en rapport som PDF med markerbar tekst til CSV-filer, én fil pr. tabel, til import i andre værktøjer. Filerne bliver i din browser.
Lille konverterdownload ved første brug.
Registrerede tabeller
Var dette værktøj nyttigt?
Prøv med et eksempel
Download eksempelCSV-filen skal indeholde fire rækker og tre kolonner adskilt af semikolon, med Vare, Antal, Beløb og totalen 148,50. Flere tabeller downloades som separate CSV-filer i en ZIP-fil.
Hvad du kan forvente
Til PDF-filer med indlejret tekst og regelmæssige tabelrækker. Scanninger kræver først OCR. Registreringen kan overse tabeller eller placere tekst i den forkerte celle; sammenlign den downloadede fil med din PDF. Sammensatte celler og den oprindelige formatering genskabes ikke.
Hver tabel bliver til sin egen CSV-fil eller sit eget Excel-ark. Værdierne forbliver tekst. CSV-værdier, der kunne tolkes som formler, får en apostrof foran; Excel-celler gemmes udtrykkeligt som tekst. Når du importerer CSV i et regneark, skal du vælge tekstkolonner for at bevare foranstillede nuller og talformatering.
Op til 10 MiB input, 200 sider, 100 tabeller, 100.000 celler, 256 kolonner og 8 MiB output. Behandlingen stopper efter 30 sekunder. Uregelmæssige rækker afvises i stedet for at blive flyttet i det skjulte.
Ved første kørsel kan der blive downloadet konverterfiler, og det kan tage et øjeblik. Hvis det mislykkes, skal du tjekke din forbindelse eller prøve en mindre fil. »Annuller« stopper den igangværende behandling; du kan vælge en anden fil og prøve igen.
Motorernes licenser og kildekode
En praktisk guide
Tag rapportens tabeller med over i CSV-filer.
- Vælg den rapport som PDF, der allerede har markerbar tekst.
- Start PDF til CSV for at finde tabellerne.
- Sammenlign hver CSV-fils rækker og kolonner med den oprindelige rapport.
Prøv dette eksempel
Udtræk en resultattabel med fire kolonner og ti rækker fra en rapport som PDF; CSV-filen skal gengive alle ti rækker med den samme kolonnerækkefølge.
Før du starter: Scannede rapportsider skal have OCR før udtrækningen, og tætte layouts eller sammenflettede celler kan blive fundet forkert eller overset.