SRE, SPC, CloudOps
Employment Information
Report this job
Job expired or something wrong with this job?
Job Description
Level 2 Site Reliability Engineer responsible for reliability and performance of Azure applications. Collaborative role involving incident management and operational excellence in a cloud environment.
Responsibilities:
- Responsible for the reliability, performance, and operational excellence of applications on Microsoft Azure.
- Provide advanced incident management, platform troubleshooting, proactive reliability improvements, and operational automation.
Requirements:
- Microsoft Azure Site Reliability Engineering principles (SLOs, SLIs, error budgets)
- Azure Kubernetes Service
- Containers & Kubernetes orchestration
- Monitoring and observability
- Operational automation
- Advanced cloud platform troubleshooting
- Distributed applications management
- High availability (HA) and scalability
- Advanced incident management
- Performance tuning and optimization
- Soft skills: Work Under pressure, Quality at work, Results Oriented.
Benefits:
- Competitive compensation and benefits package

Minor Hotels Europe and Americas
Similar Jobs

Senior DevOps Engineer – Core DevOps
Senior DevOps Engineer automating distributed infrastructure for Five9, a cloud contact center software provider. Improving platform availability, scalability, observability, and efficiency across cloud environments.

Site Reliability Engineer – SRE
Site Reliability Engineer operating Kubernetes-based identity security services for Software Mind’s enterprise clients. Monitoring production, resolving incidents, improving CI/CD, automation, resilience, and observability.

South North Network SRE Expert – SME
SRE Expert automating EVPN/BGP infrastructure for Bitdeer’s AI cloud and Bitcoin mining operations. Owning multi-site data center fabrics, WAN, internet edge, and intent-driven network workflows.

Senior DevOps Engineer – Storage
Senior DevOps Engineer operating high-performance Kubernetes storage for Mirantis, a Kubernetes-native AI infrastructure company. Automating NFS, Linux, and air-gapped storage platforms for GPU workloads at scale.

Senior DevOps Engineer – AI Cloud
Senior DevOps Engineer building and operating AI cloud infrastructure for Bitdeer’s Bitcoin mining and AI computing platforms. Automating deployments, Kubernetes infrastructure, GPU workloads, reliability, and security.

GCP DevOps Engineer
GCP DevOps Engineer designing secure infrastructure, CI/CD, and Kubernetes platforms for Sonatype. Improving developer delivery, reliability, observability, and software supply-chain security.

Senior Backend DevOps Engineer
Senior Backend DevOps Engineer operating AWS containerized microservices for the VA’s JLV clinical data viewer. Building CI/CD, observability, security, and disaster recovery capabilities.

Senior Site Reliability Engineer
Senior SRE engineering reliability for Moniepoint’s financial platform serving Nigerian businesses and individuals. Defining SLOs, leading incident response, and building scalable automation and self-healing systems.

Senior DevOps Engineer
Senior DevOps Engineer managing AWS, Kubernetes, Terraform, and CDN infrastructure. Supporting reliability, security, and potential Akamai-to-Cloudflare migration for a large-scale eCommerce platform.

Senior Reliability Engineer
Reliability Engineer bei ALTEN, einem globalen Entwicklungsdienstleister für Ingenieur- und IT-Lösungen. Entwicklung, Analyse und Optimierung zuverlässiger High-Tech-Systeme in Oberkochen.

Senior Site Reliability Engineer
Senior Site Reliability Engineer managing GCP infrastructure for an AI/ML geospatial intelligence company. Improving observability, incident response, reliability metrics, and cloud cost governance.

Site Reliability Engineer
Site Reliability Engineer operating scalable cloud infrastructure for a client's Cloud Operations team. Automating deployments, monitoring, incident response, and Kubernetes migration for high-concurrency production systems.

Site Reliability Engineer
Site Reliability Engineer operating scalable cloud infrastructure and production services for a client. Automating deployments, monitoring, incident response, and AWS-to-Kubernetes migrations.

Senior Site Reliability Engineer, AWS Cloud
Senior Site Reliability Engineer architecting reliable, scalable AWS and multi-cloud platforms for Nagarro, a digital product engineering company. Automating operations, improving observability, and leading incident response and reliability engineering.

Especialista DevSecOps
Especialista DevSecOps administrando infraestructura Azure y pipelines CI/CD automatizados. Gestionando despliegues empresariales para Periferia IT Group, multinacional de transformación digital.

Site Reliability Engineer
Staff SRE defining reliability for Yuno’s AI-powered payments infrastructure. Owning AWS architecture, messaging, observability, incident response, and resilience at scale.

Site Reliability Engineer
Site Reliability Engineer keeping user-facing services and production systems reliable for a client's cloud operations team. Automating infrastructure, improving monitoring, and scaling Kubernetes-based deployments.

Senior DevOps Consultant, all genders
Senior DevOps Consultant specializing in cloud infrastructure for a global consulting firm. Focus on AWS and client engagement to design and operate scalable solutions.

DevOps Engineer, California
DevOps Engineer automating CSDS digital product cloud platforms and delivery. Managing infrastructure, CI/CD, reliability, observability, and security across enterprise services.

FedRAMP Site Reliability Engineer – CloudVision
FedRAMP Site Reliability Engineer operating Arista Networks’ Kubernetes-native CloudVision networking SaaS. Improving reliability, scalability, security, and automation across regulated cloud environments.