Ingeniero/a de Estabilidad DevOps Senior
Banco Bci
Job Description
Overview
Asegurar la continuidad operativa, disponibilidad y resiliencia del toolchain DevOps (Azure DevOps, GitHub, Jenkins, Nexus) y de la infraestructura que lo soporta, garantizando que los flujos de integración y despliegue de la organización no se vean interrumpidos ni degradados. Diseñar e implementar estrategias de alta disponibilidad, gestión de capacidad, respaldo y recuperación ante desastres para la plataforma DevOps, liderando la resolución de incidentes críticos y la gestión de problemas de causa raíz. Gobernar el ciclo de vida del toolchain (actualizaciones, parches, obsolescencia) y establecer las prácticas, procedimientos y automatizaciones que permiten sostener los indicadores de disponibilidad comprometidos con el negocio, actuando como referente técnico y mentor de los perfiles Junior/Pleno del equipo.
Responsibilities
- Diseñar, implementar y mantener estrategias de alta disponibilidad (HA) y recuperación ante desastres (DR) para el toolchain DevOps (Azure DevOps, GitHub, Jenkins, Nexus).
- Gestionar la capacidad, el desempeño y la escalabilidad de la infraestructura que soporta los pipelines CI/CD y los flujos de desarrollo.
- Liderar la resolución técnica de incidentes críticos sobre el toolchain, incluyendo diagnóstico, mitigación y análisis de causa raíz (RCA).
- Gobernar el ciclo de vida del toolchain: actualizaciones, parches de seguridad, migraciones y retiro de versiones obsoletas.
- Automatizar tareas de monitoreo, alertamiento y auto-remediación (self-healing) sobre la plataforma DevOps.
- Administrar políticas de respaldo (backup), retención y pruebas periódicas de recuperación (DR drills).
- Documentar procedimientos operativos estándar (runbooks) y promover buenas prácticas de configuración y gestión de cambios.
- Colaborar con el equipo de Plataformas DevOps en la gobernanza del proceso end-to-end, y con el equipo de DevSecOps en la articulación de controles de seguridad sobre el toolchain.
- Actuar como mentor técnico para los perfiles Junior/Pleno del equipo de Estabilidad.
- Reportar métricas de disponibilidad, capacidad e incidentes a la jefatura del área.
Modalidad de trabajo
Flexible con 4 días remotos semanales.
Para tener éxito en esta posición necesitas
- Educación: Profesional universitario del área Informática, Industrial o equivalente con grado de Ingeniero de Ejecución o Civil.
- Experiencia: +5 años en roles de administración de infraestructura, DevOps, SRE (Site Reliability Engineering) o soporte de plataformas críticas.
- Nube: Dominio avanzado de Azure (Azure DevOps, infraestructura, redes); deseable AWS o GCP.
- Sistemas Operativos / Infraestructura: Experiencia sólida en Linux (RHEL) y Windows Server, administración de infraestructura on-premise e híbrida.
- Herramientas del Toolchain: Experiencia configurando y administrando Azure DevOps, GitHub (Enterprise), Jenkins y Nexus Repository, u otras herramientas equivalentes (GitLab, TeamCity, Artifactory).
- Scripting / Automatización: Sólidos conocimientos en PowerShell, Python o Bash, y herramientas de Infraestructura como Código (Terraform, Ansible).
- Monitoreo y Observabilidad: Experiencia con herramientas como Grafana, Prometheus, Dynatrace, Zabbix o similares.
Es aún mejor si tienes
- Deseable Inglés escrito y hablado nivel intermedio.
- Certificado en DevOps o administración de plataformas.?
- Certificaciones de Infraestructura y Plataforma (Nivel Experto)
- Certificaciones Técnicas / Operación (Nivel Práctico).
- Cursos y Capacitaciones Valoradas.
Condiciones
- Indefinido.
- 4x1 (1 día presencial y 4 remotos)