Terug naar overzicht
Vandaag zichtbaar op IKONSNieuwPopulair

Python Data Scraping Engineer

HenegouwenRemote15 uur/week<3mnd

Deze opdracht betreft een project gericht op gespecialiseerde data scraping workflows voor real-world toepassingen. Je expertise in web scraping, data-extractie en dataverwerking is essentieel voor het leveren van nauwkeurige, betrouwbare en hoogwaardige resultaten.

Wat je doet

Als Python Data Scraping Engineer ben je verantwoordelijk voor data scraping taken die technische precisie vereisen voor webextractie en -verwerking. Je maakt gebruik van tools zoals Apify, OpenRouter en andere technologieën, naast je eigen technische expertise.

  • Beheer end-to-end data-extractie workflows over complexe websites, zorg voor volledige dekking, nauwkeurigheid en betrouwbare levering van gestructureerde datasets.
  • Benut beschikbare tools en aangepaste workflows om dataverzameling, validatie en taakuitvoering te versnellen, terwijl aan de gestelde eisen wordt voldaan.
  • Zorg voor betrouwbare extractie uit dynamische en interactieve webbronnen, pas benaderingen aan indien nodig om JavaScript-gerenderde inhoud en veranderend sitegedrag te verwerken.
  • Handhaaf datakwaliteitsstandaarden door middel van validatiecontroles, consistentiecontroles tussen bronnen, naleving van opmaakspecificaties en systematische verificatie vóór levering.
  • Schaal scraping-operaties voor grote datasets met behulp van efficiënte batching of parallelisatie, bewaak storingen en handhaaf stabiliteit tegen kleine wijzigingen in de sitestructuur.

Wat ze vragen

  • Minimaal 5+ jaar relevante ervaring in data engineering, web scraping, automatisering of softwareontwikkeling.
  • Een bachelor- of masterdiploma in engineering, toegepaste wiskunde, informatica of gerelateerde technische gebieden is een pluspunt.

Profiel

  • Sterke technische basis en praktische ervaring met scripting, automatisering en data-extractie workflows.
  • Vermogen om niet-triviale problemen op te lossen, zelfverzekerd te werken met moderne ontwikkelingstools en technologieën, en systematisch data uit diverse bronnen te verzamelen, structureren en valideren.
  • Een methodische, detailgerichte aanpak en het vermogen om zelfstandig te werken zijn essentieel.

Eisen

  • Sterke ervaring in Python web scraping (BeautifulSoup, Selenium of vergelijkbaar), inclusief dynamische inhoud (JS, AJAX, infinite scroll) en API's via proxies.
  • Aantoonbaar vermogen om data te extraheren uit complexe structuren (hiërarchieën, gearchiveerde pagina's, inconsistente HTML).
  • Solide achtergrond in data cleaning, normalisatie en validatie, met levering van gestructureerde datasets (CSV, JSON, Google Sheets).
  • Ervaring met het omgaan met anti-bot mechanismen en dynamische sitestructuren op schaal.
  • Ervaring met cloudinfrastructuur (AWS of equivalent) en containerisatie (Docker) als onderdeel van real-world workflows.
  • Praktische ervaring met LLM frameworks (LangChain, OpenRouter of vergelijkbaar) toegepast op automatiseringstaken.
  • Sterke aandacht voor detail en toewijding aan datanauwkeurigheid.
  • Zelfstandige werkethiek met het vermogen om problemen onafhankelijk op te lossen.
  • Engelse taalvaardigheid: Upper-intermediate (B2) of hoger.
  • Een link naar GitHub is een pluspunt.

Hoe solliciteren?

Bekijk de volledige opdrachttekst en sollicitatie-informatie zodra je sollicitatie op maat klaarstaat.

Bestel een sollicitatie op maat om de volledige opdracht en sollicitatie-informatie te bekijken.

Meer context, minder losse zoekuren.

Je krijgt net genoeg context om te beoordelen of deze opdracht interessant is. De volledige briefing, klantdetails en vervolgstappen blijven beschikbaar in de app.