Ik doe python web scraping en data extractie naar Excel of csv
Python Backend APIs, automatisering en web scraping
Over deze dienst
De meeste scrapers breken de eerste keer dat een site zijn layout wijzigt. Die van mij niet. Ik bouw ze met retries, snelheidslimieten en een validatiestap die slechte rijen markeert voordat je het bestand ziet.
Ik schrijf fulltime Python data tools en mijn werk is openbaar op GitHub, inclusief een prijsvolgplatform dat online winkels in de loop van de tijd monitort en een crawler die respecteert robots.txt en snelheidslimieten.
WAT JE KRIJGT
Schoon Excel of CSV met echte headers, juiste types en geen dubbele gegevens
Producten, prijzen, contactgegevens, aanbiedingen, reviews, tabellen, zoekresultaten
Paginaloze sites, filters, login pagina's en JavaScript-rendered sites
De Python broncode, zodat je nooit vastzit
Een korte README zodat je het zelf opnieuw kunt uitvoeren
HOE HET WERKT
1. Stuur me de URL en de velden die je wilt
2. Ik scrape 20 rijen en stuur ze gratis, zodat je eerst het formaat kunt controleren
3. Je keurt het goed, ik voer de volledige job uit en lever het bestand
Geen LinkedIn, Facebook of Instagram. Niets achter een paywall dat jij niet bezit. Niets dat duidelijk verboden is volgens de voorwaarden van de site. Soms is het antwoord nee en ik vertel je dat voordat je betaalt.
Stuur me de site die je in gedachten hebt en ik vertel je eerlijk of het mogelijk is.
Technologie:
Python
•
Excel
•
Scrapy
•
Selenium
•
Beautiful Soup
Techniek:
Geautomatiseerd
Mijn portfolio
Veelgestelde vragen
Automatische vertaling
Kun je een site scrapen die een login vereist?
Ja, als het account van jou is en je toestemming hebt om toegang te delen. Je geeft me de inloggegevens, ik gebruik ze alleen voor jouw job en verwijder ze na levering.
Wat als de website data laadt met JavaScript?
Dat is normaal en wordt vanaf het Standard pakket ondersteund. Ik gebruik een headless browser wanneer een gewone request niet genoeg is.
Krijg ik de code of alleen het data bestand?
Standard en Premium omvatten de volledige Python broncode en een README. Starter levert alleen het data bestand.
Hoe weet ik dat de data correct is voordat ik betaal?
Stuur me eerst een bericht. Ik scrape ongeveer 20 rijen van je doelpagina en stuur ze gratis, zodat je de kolommen en het formaat kunt controleren.
Kan je de scraper automatisch elke dag laten draaien?
Ja, dat is het Premium pakket. Ik zet een geplande taak op en het schrijft verse data op je bestand volgens het schema dat je kiest.
Is webscraping legaal?
Publieke data is meestal prima, privé- en auteursrechtelijk beschermde data niet. Ik lees eerst de voorwaarden en robots.txt van de site en weiger jobs die daar overheen gaan.
Wat als de site verandert en de scraper stopt met werken?
Vertel het me binnen 30 dagen en ik fix het gratis. Voor langere dekking is er een maandelijkse onderhoudsvergoeding.

