← Back to jobs

Ascendion Logo
Site Reliability Engineer

Ascendion

 

McLean, Virginia, USA

Posted On: 30+ days ago
Experience: 5+ years
Availability: Hybrid
Openings: 1
Category: Site Reliability Engineer
Tenure: Contract - Corp-to-Corp
Related Jobs

No related jobs found

Description

You will design and implement full observability frameworks, focusing on telemetry, instrumentation, and distributed tracing pipelines across distributed systems.

This role is hybrid.

Responsibilities

  • Architect end-to-end observability platforms covering logs, metrics, traces, and events.
  • Build and manage telemetry pipelines using OpenTelemetry, Prometheus, Grafana, and AWS-native tools.
  • Embed observability as code into CI/CD pipelines and infrastructure provisioning workflows.
  • Define and implement SLIs, SLOs, and error budgets alongside application and platform teams.

Required Skills

  • 5+ years of experience building observability solutions at scale.
  • Hands-on expertise with Prometheus, Grafana, ELK, CloudWatch, and X-Ray.
  • Advanced knowledge of AWS cloud architecture and services.
  • Proficiency in at least one modern programming language: Python, Go, or Java.
  • Experience with Infrastructure as Code (IaC) using Terraform or CloudFormation.
  • Deep understanding of SLI, SLO, and SLA concepts.
  • Familiarity with containerization and orchestration using Docker and Kubernetes.

Preferred Skills

  • AWS Certifications (DevOps Engineer, Solutions Architect).
  • Experience contributing to open-source observability tools.

Education

Any Gradute

Related Jobs

No related jobs found

← Back to jobs