Ik haal gegevens van elke website met selenium en beautifulsoup

Sommige informatie is automatisch vertaald.

India

Ik spreek Engels

Student aan NIT Surat

Hoi Ik ben goed in data WebScrapping met behulp van BeautifulSoup, Selenium en Requests libraries Ik haal web data en maak het schoon in een gestructureerd Excel- of CSV-bestand Ik bouw een aangepaste...
Over deze dienst

Heb je schone, gestructureerde data nodig die wordt geëxtraheerd van dynamische websites, directories of openbare lijsten?

Ik bouw aangepaste web scrapers om data te halen van elke websitezelfs die met dynamisch JavaScript, oneindig scrollen, paginering of interactieve elementen. Met Python (Selenium/BeautifulSoup) voor scraping en Pandas voor grondige data cleaning lever ik datasets die 100% klaar zijn voor analyse.


Wat ik Kan Scrapen:

  • Openbare bedrijfsdirectories & lead lijsten (telefoonnummers, e-mails, adressen, kaarten)
  • Vastgoedvermeldingen & vacaturebanken (titels, beschrijvingen, locaties, loon)
  • E-commerce & productcatalogi (prijzen, specificaties, SKUs, beoordelingen, afbeeldings-URL's)
  • Evenementenlijsten, marktgegevens & sociale profielen


Volledige data sanitatie (Pandas cleaning):

  • Geen ruwe tekstrommel: Symbolen voor valuta ($), komma's en speciale tekens verwijderen met regex.
  • Correcte datatypes: Tekstgetallen omzetten naar juiste numerieke floats/integers zodat je meteen formules kunt gebruiken.
  • Veld parsing: Samengevoegde tekst splitsen (bijvoorbeeld volledige adressen in straat, stad, staat, postcode).
  • Net resultaat: Dubbelingen verwijderen en juiste handling van ontbrekende waarden (NaN).


Net .xlsx (Excel), .csv, .json of een volledig gedocumenteerde Python automation script

Technologie:

Python

Excel

Selenium

Beautiful Soup

Pandas

Type informatie:

Afbeeldingen

Vastgoed

E-mails

Websites

Links

Techniek:

Geautomatiseerd

Mijn portfolio