Engenheiro(A) De Confiabilidade De Sites (Sre) Sênior
Cadmus Soluções em TI
Job Description
Buscamos um(a) Site Reliability Engineer (SRE) Sênior para atuar na sustentação e evolução da infraestrutura em nuvem, garantindo alta disponibilidade, desempenho, segurança e observabilidade dos ambientes. O profissional será responsável por administrar ambientes em Oracle Cloud Infrastructure (OCI) e AWS, apoiando a implantação de novos serviços, monitoramento da plataforma e trabalhando em conjunto com os times de desenvolvimento para promover maior confiabilidade das aplicações.
Principais responsabilidades
- Gerenciar e administrar ambientes em Oracle Cloud Infrastructure (OCI) e AWS;
- Implantar, configurar e manter serviços em nuvem;
- Garantir disponibilidade, escalabilidade e performance dos ambientes;
- Implementar e evoluir soluções de monitoramento e observabilidade;
- Atuar na identificação e resolução de incidentes e problemas;
- Trabalhar em parceria com equipes de Desenvolvimento, DevOps e Infraestrutura;
- Automatizar processos operacionais sempre que possível.
Requisitos
- Experiência sólida como SRE, DevOps ou Engenharia de Infraestrutura Cloud;
- Conhecimento avançado em Oracle Cloud Infrastructure (OCI);
- Experiência comAWS;
- Vivência com monitoramento e observabilidade (Prometheus, Grafana, Datadog, Zabbix, CloudWatch,
- Dynatrace ou similares);
- Conhecimento emLinux;
- Experiência comautomação e infraestrutura como código (Terraform será um diferencial);
- Conhecimento emDocker e Kubernetes será considerado um diferencial;
Modelo de Atuação
· Prestador de Serviços
· Atuação híbrida