← Back to jobs

Zyon Digital Solutions Logo
Site Reliability Engineer

Zyon Digital Solutions

 

Irvine, CA, USA

Posted On: 2 days ago
Experience: Not specified years
Availability: Onsite
Openings: 1
Category: Site Reliability Engineer
Tenure: Contract - Corp-to-Corp
Related Jobs

No related jobs found

Description

You will own the stability and automation of SRE infrastructure, focusing on Autosys administration and cloud reliability.

This role is on-site.

Responsibilities

  • Manage and troubleshoot AutoSys administration, including server upgrades, agent issues, and event server DB performance tuning.
  • Implement observability solutions using APM, distributed tracing, and monitoring tools to ensure system health.
  • Automate infrastructure provisioning and configuration using Terraform, Ansible, and Kubernetes on AWS.
  • Design and maintain high-availability and disaster-recovery (HA/DR) architectures for production systems.
  • Drive event processing efficiency using Apache Kafka and resolve complex production support issues.

Required Skills

  • 12+ years of experience in Site Reliability Engineering or DevOps roles.
  • Deep expertise in AutoSys administration, including performance tuning and troubleshooting.
  • Proficiency with AWS cloud services and infrastructure management.
  • Strong experience with infrastructure-as-code tools: Terraform and Ansible.
  • Hands-on experience with container orchestration using Kubernetes.
  • Practical knowledge of Apache Kafka for event streaming and processing.
  • Proven track record in implementing APM, distributed tracing, and general observability practices.
  • Strong background in automation, server upgrades, and production support.

Education

Not specified

Related Jobs

No related jobs found

← Back to jobs