Zact
Cloud DevOps & SRE Engineer
Vaga remota de Cloud DevOps Engineer com fit claro de localização do candidato.
Publicada18 de jul. de 2026
Países elegíveis1 país aceito
Sinal de senioridadeSenior
Modelo de trabalhoRemoto
Locais aceitos para candidatos
Estados Unidos
Resumo da vaga
Cloud DevOps & SRE Engineer
Requisitos e responsabilidades
Conteúdo da vaga extraído em seções para revisão mais rápida.
What You'll Do
- Champion reliability and uptime: Define, measure, and maintain Service Level Objectives (SLOs) and Service Level Indicators (SLIs) to ensure our cloud-native applications perform optimally.
- Design, implement, and maintain Infrastructure as Code across multiple environments, primarily focusing on Google Cloud (GCP).
- Manage incident response and blameless post-mortems, troubleshooting complex systemic issues and building automation to prevent recurrences.
- Implement and manage advanced observability stacks (monitoring, logging, alerting, and distributed tracing) to ensure infrastructure reliability and proactive issue detection.
- Collaborate with development teams to streamline application deployment workflows, optimize capacity planning, and enforce best practices for scalable architecture.
Required Skills
- 5+ years of experience in Site Reliability Engineering or DevOps, with a deep understanding of cloud infrastructure, high availability, and distributed systems.
- Strong expertise with Kubernetes (GKE preferred) for container orchestration, including hands-on experience with Helm for deployment management.
- Solid proficiency with Google Cloud (GCP) and hands-on experience using gcloud. Experience with AWS or Azure is also valuable.
- Proficient in scripting languages such as Python or Bash.
- Deep expertise in setting up and managing observability tools, specifically Google Cloud Operations Suite (Cloud Logging, Cloud Monitoring, Cloud Trace) and Google Managed Service for Prometheus.
- Excellent problem-solving and troubleshooting skills under pressure.
Preferred Skills
- Familiarity with configuration management tools (e.g., Terraform, OpenTofu).
- Experience with automated incident management platforms (e.g., PagerDuty, Opsgenie).
- Exposure to microservices architectures and best practices for resilient deployment.
Vagas similares
Mantenha uma lista reserva.
Stack
Use estas tags para comparar vagas remotas similares.
Elegibilidade de localização
Candidatos devem aplicar apenas quando o país do perfil estiver listado aqui.
Seu perfilPaís não definidoEntre para comparar seu país com esta vaga.
Fluxo de contratação
O WithMira mostra a vaga e depois envia candidatos para a aplicação da empresa.
1Confira fit da vaga, stack e elegibilidade de localização no WithMira.
2Abra a página de aplicação da empresa pelo link rastreado.
3Salve a vaga ou assine oportunidades similares antes de sair.