Ik haal gegevens uit documenten en afbeeldingen met OCR, Python en AI
Over deze dienst
Ik ben een computer vision engineer met meer dan 3 jaar ervaring in de industrie. Ik run niet zomaar een standaard OCR-tool en hoop dat echte documenten rommelig zijn: slechte scans, gemengde lay-outs, handschrift, vreemde formaten. Ik bouw de extractie- en schoonmaaklogica zodat de output echt bruikbaar is, niet een muur van onleesbare tekst.
Wat ik voor je kan bouwen:
- Tekstextractie uit scans, foto's, PDFs of formulieren
- Gestructureerde output: tabellen, spreadsheets, JSON of jouw formaat
- Handling voor rommelige inputs uit de echte wereld: scheef, ruis, gemengde lay-outs
- Validatieregels zodat de data schoon en consistent uitkomt
Stuur me een paar voorbeeld documenten en vertel me welke velden je eruit wilt halen. Ik vertel je eerlijk hoe schoon het resultaat wordt voordat je bestelt. Laten we eerst de scope bespreken.
Programmeertaal:
Python
•
MATLAB
•
SQL
•
Colab
Tools:
Jupyter-notitieboek
•
opencv
•
tensorflow
•
CVAT
•
Colab
•
PyTorch
Frameworks:
Scikit-learn
•
keras
•
PyTorch
•
Panda
Andere Data science en ML diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Kun je werken met mijn specifieke documenten?
Ja. Deel een paar voorbeelden en ik vertel je precies wat haalbaar is voordat je bestelt. Ik stem alles af op jouw documenttypes.
Welke formaten kun je verwerken?
Scans, foto's, PDFs en formulieren. Output als Excel, CSV, JSON of jouw voorkeurformaat.
Geef je de broncode door?
Ja, broncode is inbegrepen in alle pakketten, met documentatie zodat je het zelf kunt uitvoeren.
Kun je handschrift of rommelige scans verwerken?
Handgeschreven, lage kwaliteit en gemengde lay-outs worden behandeld in het Premium pakket. Stuur me samples om de haalbaarheid te bevestigen.
Ik weet niet zeker welk pakket ik nodig heb. Wat moet ik doen?
Stuur me eerst een bericht. Vertel me over je documenten en de velden die je nodig hebt, en ik adviseer je over het juiste pakket of stuur een aangepaste offerte.

