Wij zijn op zoek naar een Application Reliability Specialist die verantwoordelijk wordt voor het verhogen van de betrouwbaarheid, stabiliteit en performance van onze applicaties en platformen.
In deze rol vorm je de brug tussen development, operations en release management. Je zorgt ervoor dat applicaties voorspelbaar functioneren door middel van proactieve monitoring, automatisering, performance-analyse en structurele verbeteringen.
Door jouw inzet kunnen developers zich richten op innovatie en ontwikkeling, terwijl jij zorgt voor een stabiele productieomgeving, betrouwbare releases en snelle detectie van mogelijke problemen.
Waarom deze rol?
De complexiteit van onze applicatieomgeving groeit. Met internationale samenwerking richting Zwitserland, Solution Development en toekomstige POD-gebruikers wordt releasecoördinatie steeds uitdagender.
Daarom zoeken we iemand die:
- operationele werkzaamheden bij developmentteams kan verminderen;
- een proactieve monitoringstrategie kan opzetten;
- verstoringen vroegtijdig detecteert en voorkomt;
- zorgt voor meer voorspelbare en stabiele releases.
Jouw verantwoordelijkheden
Monitoring & Application Reliability
- Ontwerpen, implementeren en verbeteren van dashboards, metrics en alerts.
- Proactief monitoren van applicatieperformance, beschikbaarheid en betrouwbaarheid.
- Analyseren van trends en identificeren van potentiële problemen voordat deze impact hebben.
- Verbeteren van observability binnen het applicatielandschap.
Release ondersteuning
- Uitvoeren van pre- en post-release controles.
- Ondersteunen bij complexe releases en deployments.
- Coördineren tussen developmentteams, operations en stakeholders.
- Signaleren van risico’s en bijdragen aan een soepel releaseproces.
Platform & Automatisering
- Automatiseren van beheerprocessen met Ansible.
- Werken met Kubernetes-gebaseerde omgevingen en ondersteunen bij troubleshooting.
- Beheren en optimaliseren van Linux-gebaseerde systemen.
- Uitvoeren van analyses en troubleshooting binnen Linux-omgevingen.
- Verbeteren van deploymentprocessen en operationele workflows.
- Bijdragen aan Infrastructure as Code en standaardisatie.
Applicatiebeheer & Continuous Improvement
- Fungeren als centraal aanspreekpunt voor applicatiebetrouwbaarheid.
- Opstellen en verbeteren van technische documentatie.
- Doorvoeren van structurele verbeteringen om incidenten te voorkomen.
- Samenwerken met engineers om de stabiliteit van het platform continu te verhogen.
Jouw technische ervaring
- Ervaring binnen een rol als Application Reliability Engineer, SRE, DevOps Engineer, Platform Engineer of Cloud Engineer.
- Sterke ervaring met Linux-systemen (beheer, troubleshooting, performance-analyse en security fundamentals).
- Ervaring met Kubernetes (beheer, deployments, troubleshooting en containerplatformen).
- Ervaring met Ansible voor configuratiebeheer en automatisering.
- Ervaring met monitoring- en observability tooling zoals:
- Prometheus
- Grafana
- ELK / Elastic Stack
- Splunk
- Datadog
- of vergelijkbare tools.
- Kennis van CI/CD processen en tooling (GitLab CI, Jenkins, GitHub Actions of Azure DevOps).
- Ervaring met scripting (bijvoorbeeld Python, Bash of PowerShell) is een pré.
- Ervaring met cloudomgevingen (AWS, Azure of Google Cloud) is een pré.
Wie ben jij?
- Je bent analytisch sterk en denkt graag vooruit.
- Je hebt een Linux-first mindset en voelt je comfortabel met technische troubleshooting.
- Je ziet problemen voordat ze incidenten worden.
- Je combineert technische kennis met goede communicatieve vaardigheden.
- Je werkt graag samen met verschillende teams en stakeholders.
- Je neemt eigenaarschap en zoekt continu naar verbetering.
Wat levert jouw werk op?
- Hogere betrouwbaarheid en betere performance van het platform.
- Snellere detectie en oplossing van verstoringen.
- Minder operationele belasting voor developmentteams.
- Efficiëntere samenwerking tussen internationale teams.
- Meer voorspelbare releases en minder operationele risico’s.