Tekst en data uit afbeeldingen, pdf's en andere bestanden halen met OCR
AI en Machine Learning engineer, Data scientist
Over deze dienst
Meer dan 3 jaar ervaring in Computer Vision, OCR en Python automatisering.
MS in Computer Science met een grote passie voor Machine Learning en
Data Extractie. Bedreven in PaddleOCR en Tesseract OCR, met praktijkervaring in het bouwen van nauwkeurige OCR-pijplijnen, waaronder het uitlezen van digitale meterstanden van benzinepompen.
Mijn portfolio
Veelgestelde vragen
Automatische vertaling
Q1: Welke bestandsformaten accepteer je?
Ik accepteer JPG, PNG en PDF bestanden (gescand of op afbeelding gebaseerd). Als je bestand in een ander formaat is, stuur me dan gerust een bericht voordat je bestelt.
Q2: Kun je data uit meterstanden, facturen of bonnetjes halen?
Ja, ik ben gespecialiseerd in het extraheren van tekst en cijfers uit meterstanden, facturen, bonnetjes en andere gestructureerde documenten met PaddleOCR en Tesseract OCR.
Q3: Welke outputformaten bied je aan?
Ik lever de output als platte tekst (.txt), Word-document of Excel/CSV — afhankelijk van je pakket en wensen.
Q4: Ondersteun je handgeschreven tekstextractie?
Ik werk vooral met duidelijke, gedrukte tekst voor de beste nauwkeurigheid. Bij handgeschreven documenten kan de nauwkeurigheid variëren, dus stuur vooraf een voorbeeldafbeelding zodat ik de haalbaarheid kan bevestigen.
Q5: Hoeveel afbeeldingen/pagina's kun je verwerken?
Elk pakket bevat een specifiek aantal afbeeldingen/pagina's (zie pakketdetails). Voor grote projecten daarbuiten, neem gerust contact op voor een aangepaste offerte.
