Ik converteer, maak schoon en repareer je yolo, coco of voc dataset voor training

Sommige informatie is automatisch vertaald.

Vietnam

Ik spreek Vietnamees, Engels

AI Engineer voor Computer Vision en LLM Apps

Ik bouw AI-systemen die in de echte wereld werken. Mijn recente projecten zijn onder andere SYL GuardianCam, een realtime valdetectiesysteem (YOLO Pose, FastAPI, Docker) met 83% F1-score dat Top 10 ei...
Over deze dienst

Slechte data is de meest voorkomende reden dat een detectiemodel faalt. Ik maak je objectdetectie dataset schoon, converteer en valideer deze zodat hij klaar is om te trainen.


Achtergrond: voor mijn PPE-veiligheid detectieproject heb ik 5 openbare bronnen samengevoegd tot één schone dataset met 6956 afbeeldingen: uniforme klassenamen, dubbele gegevens verwijderd, train/test leakage gecontroleerd en kapotte labels gerepareerd. Samen met methodenvergelijkingen steeg de mAP50 van 0.674 naar 0.753 op een testset van 808 afbeeldingen.


Ik kan:

  • Converteer tussen YOLO TXT, COCO JSON, Pascal VOC XML en Roboflow exports
  • Beschadigde afbeeldingen, exacte en bijna duplicaten, lege of ongeldige boxen verwijderen
  • Klassen hernoemen, samenvoegen of her-mappen over meerdere datasets
  • Schoon train/val/test splits maken zonder leakage
  • Klasse-aantallen, boxgroottes en verdachte labels rapporteren met visuele voorbeelden

Wat je krijgt:

  • De schoongemaakte dataset in jouw doelbestand met data.yaml
  • Een korte auditrapportage (CSV/Markdown plus grafieken)
  • De Python-scripts die ik heb gebruikt, zodat je het proces kunt herhalen

Let op: het tekenen van nieuwe labels vanaf nul is niet inbegrepen. Stuur me een bericht voor een offerte.

Techniek:

Geautomatiseerd

Type tagging:

Afbeelding

•

Video