Terug naar overzicht
Vandaag zichtbaar op IKONSNieuwPopulair

Data Scraping Engineer

HenegouwenRemote15 uur/week<3mnd

Het platform verbindt specialisten met innovatieve technologieprojecten. De missie is om hoogwaardige AI-technologieën te helpen ontwikkelen door expertise van professionals wereldwijd te combineren met geavanceerde AI-ontwikkelingsinspanningen. Dit is een freelance rol voor een technologieproject.

Als Data Scraping Engineer ben je verantwoordelijk voor data scraping taken die technische precisie vereisen voor webextractie en -verwerking, waarbij je tools zoals Apify, OpenRouter en andere technologieën gebruikt, naast je eigen technische expertise en benaderingen.

Wat je doet

  • Beheren van end-to-end data-extractieworkflows over complexe websites, waarbij volledige dekking, nauwkeurigheid en betrouwbare levering van gestructureerde datasets worden gewaarborgd
  • Gebruikmaken van beschikbare tools en aangepaste workflows om dataverzameling, -validatie en taakuitvoering te versnellen, terwijl aan de gedefinieerde vereisten wordt voldaan
  • Zorgen voor betrouwbare extractie uit dynamische en interactieve webbronnen, waarbij benaderingen indien nodig worden aangepast om JavaScript-gerenderde inhoud en veranderend sitegedrag te verwerken
  • Handhaven van datakwaliteitsstandaarden door middel van validatiecontroles, consistentiecontroles tussen bronnen, naleving van opmaakspecificaties en systematische verificatie vóór levering
  • Schalen van scraping-operaties voor grote datasets met behulp van efficiënte batchverwerking of parallelisatie, bewaken van storingen en handhaven van stabiliteit tegen kleine wijzigingen in de sitestructuur

Wat ze vragen

  • Minimaal 3+ jaar relevante ervaring in data engineering, web scraping, automatisering of softwareontwikkeling
  • Een bachelor- of masterdiploma in engineering, toegepaste wiskunde, informatica of gerelateerde technische vakgebieden is een pluspunt
  • Sterke technische basis en praktische ervaring met scripting, automatisering en data-extractieworkflows
  • Vermogen om niet-triviale problemen op te lossen, zelfverzekerd te werken met moderne webtechnologieën en dataverwerkingstools, en systematisch gegevens uit diverse bronnen te verzamelen, structureren en valideren
  • Een methodische, detailgerichte aanpak en het vermogen om zelfstandig te werken zijn essentieel

Technische vaardigheden (Essentieel).

  • Sterke ervaring in Python web scraping (BeautifulSoup, Selenium of vergelijkbaar), inclusief dynamische inhoud (JS, AJAX, infinite scroll) en API's via proxies
  • Aantoonbaar vermogen om gegevens te extraheren uit complexe structuren (hiërarchieën, gearchiveerde pagina's, inconsistente HTML)
  • Solide achtergrond in data cleaning, normalisatie en validatie, met levering van gestructureerde datasets (CSV, JSON, Google Sheets)

Aanvullende vereisten.

  • Praktische ervaring met LLM's en AI-frameworks om automatisering en probleemoplossing te verbeteren
  • Sterke aandacht voor detail en toewijding aan datanauwkeurigheid
  • Zelfstandige werkethiek met het vermogen om onafhankelijk problemen op te lossen
  • Een link naar GitHub is een pluspunt
  • Engelse taalvaardigheid: Upper-intermediate (B2) of hoger

Hoe solliciteren?

Bekijk de volledige opdrachttekst en sollicitatie-informatie zodra je sollicitatie op maat klaarstaat.

Bestel een sollicitatie op maat om de volledige opdracht en sollicitatie-informatie te bekijken.

Meer context, minder losse zoekuren.

Je krijgt net genoeg context om te beoordelen of deze opdracht interessant is. De volledige briefing, klantdetails en vervolgstappen blijven beschikbaar in de app.