Ik maak je bedrijfsspreadsheet schoon en verwijder dubbele gegevens
Bedrijfsgegevens extractie en spreadsheet opschoning, met bronnen op elke rij
Over deze dienst
Je hebt een bedrijfslijst (een CRM-export, een conferentie-download, spreadsheets die een team een jaar lang heeft toegevoegd) en er zitten dubbele, inconsistente opmaak, half ingevulde kolommen en drie spellingen van hetzelfde bedrijf in. Ik lever het schoon op: één rij per entiteit, consistente opmaak en een changelog die precies laat zien wat is samengevoegd, aangepast of verwijderd, zodat niets op vertrouwen wordt gedaan.
Er wordt niets van het web gehaald. Je bestand is de enige input, en het werk is deterministisch: hetzelfde bestand geeft hetzelfde resultaat, daarom is dit mijn snelste data-gig.
Scope: alleen bedrijfsgegevens (bedrijfsnamen, adressen, contactgegevens, categorieën). Een bestand met privépersonen wordt geweigerd voordat het werk begint, zonder kosten. Geen verrijking: er wordt niets toegevoegd dat niet al in je bestand staat, omdat alles wat wordt toegevoegd een eigen bron zou vereisen.
Je ontvangt cleaned.csv en cleaned.xlsx (één rij per entiteit, genormaliseerde headers) en changes.csv (rij-identificatie, kolom, waarde vóór, waarde ná, reden). Standaard en Premium voegen een review-tab toe voor onzekere matches; Premium voegt een data dictionary en een volledigheidsrapport toe. De galerijafbeelding toont een illustratief before en after.
Technologie:
Excel
•
Python
Expertise:
Gegevensmanipulatie
•
Normalisatie
•
Transformatie
Veelgestelde vragen
Automatische vertaling
Wat als mijn bestand privépersonen bevat of anderszins buiten de scope van bedrijfsgegevens valt?
Ik weiger voordat het werk begint en er worden geen kosten in rekening gebracht. Deze service behandelt alleen bedrijfsgegevens: bedrijfsnamen, adressen en contactgegevens.
Is de schoonmaak geautomatiseerd?
Ja. Matching en normalisatie worden automatisch uitgevoerd, en ik controleer de output, inclusief alles op de review-tab, voordat ik het oplever.
Verifieer of corrigeer je de feiten in mijn bestand?
Nee. Ik maak de opmaak schoon en verwijder dubbele gegevens; ik verifieer of corrigeer de onderliggende feiten niet. Elke wijziging wordt vastgelegd in changes.csv met een before-waarde, een after-waarde en een reden, zodat je precies kunt zien wat er is gebeurd en alles kunt terugdraaien.
Voeg je persoonlijke gegevens van individuen toe aan mijn bestand?
Nee. Er wordt geen verrijking gedaan: er wordt niets toegevoegd dat niet al in je bestand staat, en er worden geen persoonlijke gegevens van privépersonen verzameld of toegevoegd.

