Descripción del trabajo
Se busca un Ingeniero de Confiabilidad para mantener y desarrollar la infraestructura que permita que los servicios de producción funcionen de forma estable y fiable. La posición combina ingeniería de plataforma, observabilidad, gestión de infraestructura, respuesta ante incidentes y soporte a otros equipos de ingeniería, además de la implementación de nuevos servicios y sistemas automatizados.
Responsabilidades:
- Gestionar y mantener la plataforma de observabilidad, incluyendo incorporación de equipos, monitorización de costes y capacidad y gestión de alertas.
- Administrar GitLab y los sistemas de integración continua, incluyendo actualizaciones, capacidad, accesos, copias de seguridad y pruebas de restauración.
- Mantener los servicios de producción mediante sistemas adecuados de monitorización y manuales de procedimientos.
- Investigar, diseñar e implementar nuevos servicios siguiendo buenas prácticas de infraestructura como código, monitorización, copias de seguridad y documentación.
- Atender solicitudes de los equipos de desarrollo relacionadas con accesos, incorporación, pipelines, exportadores y paneles de control.
- Transformar solicitudes recurrentes en procesos de autoservicio cuando sea posible.
- Gestionar incidentes, diagnosticar problemas, mitigar su impacto y restaurar los servicios de forma segura.
- Realizar análisis de causa raíz y revisiones posteriores a los incidentes.
- Implementar mejoras destinadas a prevenir o detectar futuros incidentes.
- Gestionar la infraestructura mediante código y someter los cambios a procesos de revisión.
- Planificar y verificar los cambios antes de su implementación.
- Crear documentación técnica, manuales de procedimientos, guías de incorporación, avisos de mantenimiento y actualizaciones de estado.
- Utilizar agentes de inteligencia artificial para tareas de recopilación y redacción, revisando sus resultados y documentando los aprendizajes obtenidos.
Requisitos:
- Experiencia en ingeniería de confiabilidad de sitios (SRE), ingeniería de plataformas, DevOps o infraestructura.
- Experiencia gestionando servicios de producción y garantizando su disponibilidad y fiabilidad.
- Conocimientos de plataformas de observabilidad, monitorización y sistemas de alertas.
- Experiencia administrando GitLab y sistemas de integración.
- Conocimientos de infraestructura como código y automatización de servicios.
- Experiencia gestionando capacidad, costes, accesos, copias de seguridad y restauración de sistemas.
- Experiencia diseñando e implementando nuevos servicios siguiendo buenas prácticas de seguridad, monitorización y documentación.
- Capacidad para colaborar con diferentes equipos de ingeniería y proporcionar soporte técnico.
- Habilidades para documentar procedimientos y comunicar información técnica de forma clara.
- Capacidad para trabajar de forma estructurada, revisar cambios y verificar las implementaciones antes de ponerlas en producción.
- Interés y experiencia utilizando herramientas de inteligencia artificial para mejorar los procesos de ingeniería.
Salario a percibir
A convenir
Regístrate o identifícate
- Debes estar registrado para solicitar una oferta.
- El tener un perfil completo en Remotojob.com garantiza que tu currículum tendrá mayor exposición.
- Estar registrado nos ayuda a prevenir el spam y los convocantes fantasma.
- Las empresas otorgan mayor credibilidad a los perfiles con descripciones e imágenes completas.
Para ver el contacto directo del empleo, debes tener una cuenta regístrate ahora.



