Ik haal gegevens uit pdf's, facturen en documenten naar Excel of Google Sheets
Over deze dienst
Handmatig cijfers uit PDFs kopiëren is traag en vol fouten. Ik bouw een Python-extractor die je PDFs, facturen, afschriften of formulieren leest en elk veld dat je nodig hebt in een schoon Excel-bestand, CSV of Google Sheet zet.
Inbegrepen: de geëxtraheerde data, gecontroleerd tegen de bronbestanden, en bij de Standard en Premium pakketten de volledige Python-script met een korte README zodat je de volgende batch zelf kunt verwerken.
Werkt met tekst-PDF's en gescande documenten (OCR), tabellen die over meerdere pagina's gaan, en verschillende lay-outs in één batch.
Hoe ik werk: stuur me twee of drie voorbeeldbestanden en de velden die je wilt voordat je bestelt. Ik bevestig wat er geëxtraheerd kan worden en geef je een testresultaat op je eigen samples.
Je bestanden worden alleen gebruikt voor jouw bestelling en na levering verwijderd.
Technologie:
Excel
•
Google Sheets
•
Python
Veelgestelde vragen
Automatische vertaling
Kun je gescande PDFs of foto's van documenten lezen?
Ja. Gescande bestanden gaan eerst door OCR. Duidelijke scans geven de beste resultaten; ik controleer de output tegen de originele bestanden en vertel je over velden die niet betrouwbaar konden worden gelezen.
Wat heb je van me nodig?
Twee of drie voorbeeldbestanden, de lijst met velden die je wilt (bijvoorbeeld factuurnummer, datum, leverancier, totaal, regelitems), het totale aantal bestanden en het gewenste outputformaat.
Krijg ik het script?
Bij de Standard en Premium pakketten krijg je het Python-script en een README, zodat je de volgende batch zelf kunt uitvoeren zonder opnieuw te bestellen.
Zijn mijn gegevens veilig?
Je bestanden worden alleen gebruikt voor jouw order, nooit gedeeld en na levering verwijderd. Als je documenten persoonlijke gegevens bevatten, vertel het me dan en ik maskeer de velden die je kiest.

