Terug naar overzicht
Vandaag zichtbaar op IKONSNieuwPopulair

Site Reliability Engineer

OverijsselHybrideUren in overleg<3mnd

Een technologiebedrijf rolt in hoog tempo nieuwe AI-gedreven features en agents uit. Om dit betrouwbaar, schaalbaar en meetbaar te maken, zoeken we een Site Reliability Engineer. Je wordt de architect achter de operationele zichtbaarheid en de drijvende kracht achter de metrics. Je zorgt voor de fundamentele datalaag die bewijst dat systemen op het hoogste kwaliteitsniveau presteren. Je vertaalt complexe telemetry-data naar glasheldere inzichten voor alle belanghebbenden.

Wat je doet

  • Ontwerp en implementeer de core monitoringstructuur voor de SaaS-applicatie. Definieer heldere Service Level Indicators (SLI's) en Service Level Objectives (SLO's) in Datadog voor kritieke endpoints. Signaleer en elimineer performance-bottlenecks met behulp van error budget-alerting en real-user monitoring (RUM).
  • Bouw de operationele visibility-laag. Aggregeer bestaande OTel-signalen in Datadog en koppel dit aan PR-per-developer tracking, AI-kosten en verbruikscijfers om inzicht te geven in adoptie en doorloop vóór en na de brede uitrol van AI-tooling.
  • Til observability naar een volgend niveau door diep in te zoomen op de AI-agents zelf. Maak skill-invocations, success rates, drift en output-kwaliteit meetbaar om te controleren of alles op het juiste kwaliteitsniveau draait.

Technologieën.

  • Observability & Reliability: Datadog (APM & RUM), OpenTelemetry (OTel), StatusPage, DORA metrics frameworks.
  • Feature Management & Deployment: LaunchDarkly, GitHub Actions, Docker, Terraform.
  • AWS Services: SNS, SQS, S3, Lambda, API Gateway.
  • Core Tech & Collaboration: MySQL, OpenSearch, PHP/Laravel, Vue.js, Linear, Confluence, Slack.

Profiel

  • Een georganiseerde, planmatige en flexibele teamplayer met een passie voor data-gedreven platformbetrouwbaarheid en applicatieperformance.
  • Sterke communicatieve vaardigheden om developers te coachen en performance-data helder te visualiseren voor het hele team.
  • Ruime ervaring met moderne SRE- en observability-standaarden, specifiek met Datadog APM, synthetics en OpenTelemetry.
  • Ervaring met het definiëren en bewaken van SLI's, SLO's en het inrichten van proactieve alerting op basis van error budgets.
  • Kennis van progressive delivery tools zoals LaunchDarkly en incidentcommunicatie via StatusPage.
  • Analytisch ingesteld, proactief en altijd op zoek naar manieren om de applicatielatency en infrastructuurkosten te optimaliseren.
  • Ervaring in software engineering of DevOps/SRE, idealiter binnen een scale-up of SaaS-omgeving.

Praktisch

  • Een boeiende functie in een groeiende, internationale SaaS-scale-up.
  • Veel autonomie, platte hiërarchieën en korte besluitvormingslijnen.
  • Flexibele werkopties.
  • Teamevenementen en mogelijkheden voor persoonlijke ontwikkeling.
  • Keuze van eigen hardware (Windows, Mac, Linux).

Hoe solliciteren?

Bekijk de volledige opdrachttekst en sollicitatie-informatie zodra je sollicitatie op maat klaarstaat.

Bestel een sollicitatie op maat om de volledige opdracht en sollicitatie-informatie te bekijken.

Meer context, minder losse zoekuren.

Je krijgt net genoeg context om te beoordelen of deze opdracht interessant is. De volledige briefing, klantdetails en vervolgstappen blijven beschikbaar in de app.