Ik haal gegevens uit pdf's, websites of documenten en structureer ze in Excel
Over deze dienst
Ik schrijf scripts die rommelige bestanden omzetten in nette spreadsheets, PDFs, facturen, productcatalogi, soms hele sites.
Stuur een paar voorbeeldbestanden en de velden die je nodig hebt. Ik bouw een Python-pipeline voor dat patroon, test het met jouw echte data, en lever één spreadsheet met consistente kolommen, of het nu 20 bestanden of 2000 zijn.
Scans krijgen OCR. Sites krijgen Playwright. Tekst zonder vaste structuur wordt met AI-ondersteuning geparset.
Ik controleer elk resultaat zelf voordat ik het verstuur.
Weet je niet zeker of je data past? Stuur eerst een voorbeeld. Ik zeg liever upfront nee dan dat ik je geld neem en het moeilijk wordt.
Technologie:
Excel
•
Python
Veelgestelde vragen
Automatische vertaling
Met welke bestandstypen werk je?
PDF's, gescande documenten (met OCR), websites, spreadsheets, de meeste gestructureerde of semi-gestructureerde tekst. Stuur eerst een voorbeeld en ik bevestig of het past.
Wat als mijn data geen duidelijk patroon volgt?
Stuur me een bericht voordat je bestelt. Als ik geen consistente structuur zie om te extraheren, vertel ik dat eerlijk in plaats van de opdracht aan te nemen.
Krijg ik de broncode van het script?
Alleen bij het Full Pipeline pakket. Quick Extract en Structured Data leveren de voltooide spreadsheet, niet het script zelf.
Hoe snel is de levering?
2 dagen voor Quick Extract, 3 voor Structured Data, 4 voor Full Pipeline. Grotere volumes dan vermeld kunnen extra tijd nodig hebben — ik geef dat aan voordat ik begin, niet achteraf.
Blijven mijn gegevens privé?
Ja. Bestanden worden alleen voor jouw werk gebruikt, niet gedeeld of hergebruikt elders.

