Site Reliability and Observability Engineer - Datadog/Azure
Site Reliability andamp; Observability Engineer/Datadog - Synthetic Monitoring, APM, RUM, Log Management, SLO''s, Alerting/Azure/Azure DevOps/Cloudflare/6-month contract/Hybrid - West Midlands/Remote/£450 - 600 per day Inside IR35. One of our leading clients is seeking a Lead Site Reliability andamp; Observability Engineer to build and operate a world-class monitoring, synthetic testing, and reliability platform. Location - West Midlands/Remote - 5 days per week with 1-2 days per week onsite Duration - 6 months + Day rate - £450 - 600 per day Inside IR35 This role will lead the implementation of Datadog across Azure and Cloudflare, creating a comprehensive early warning system that continuously validates APIs, integrations, and customer user journeys in production. Key Responsibilities: Own and evolve the Datadog observability platform. Design and maintain synthetic monitoring for critical API and UI workflows. Build continuous production validation covering business-critical customer journeys. Integrate monitoring, testing, dashboards, and alerting into Azure DevOps and GitHub pipelines. Develop monitoring-as-code and testing-as-code practices using Terraform. Create actionable dashboards, SLOs, SLIs, alerts, and anomaly detection. Integrate Datadog with Azure, Cloudflare, and modern SaaS architectures. Drive reliability, performance, and root-cause analysis across production systems. Required Experience: Strong hands-on Datadog expertise, including: Synthetic ..... full job details .....
Other jobs of interest...
Perform a fresh search...
-
Create your ideal job search criteria by
completing our quick and simple form and
receive daily job alerts tailored to you!