Chat rápido, mejores ofertas — Descargar

Ingeniero de Confiabilidad del Sitio (SRE)

Indeed

Compañía

Tipo de empleoTiempo completo
Modalidad de trabajoPresencial
Nivel de experienciaSin requisito de experiencia
Nivel educativoSin requisito de título

Descripción

Resumen: Buscamos un Ingeniero de Confiabilidad del Sitio (SRE) proactivo que aplique principios de ingeniería de software para automatizar operaciones, escalar infraestructura y garantizar alta disponibilidad, resiliencia y rendimiento del sistema. Aspectos destacados: 1. Diseñar, construir y mantener infraestructura en la nube mediante Infraestructura como Código 2. Construir y optimizar canalizaciones CI/CD para automatizar la implementación de software 3. Responder a incidentes en producción y liderar los esfuerzos de resolución de problemas Nuestro equipo de ingeniería busca incorporar a un Ingeniero de Confiabilidad del Sitio (SRE) competente y proactivo. Este puesto actúa como vínculo entre el desarrollo de software y las operaciones de sistemas. Se aplicarán principios de ingeniería de software para automatizar operaciones, escalar infraestructura y mantener los sistemas altamente disponibles, resilientes y eficientes. La misión principal consiste en construir, ejecutar y proteger los entornos de producción que impulsan nuestras aplicaciones, minimizando el tiempo de inactividad mientras se permite una implementación de software rápida y segura. **Responsabilidades** * Diseñar, construir y mantener infraestructura en la nube utilizando prácticas modernas de Infraestructura como Código, como Terraform y CloudFormation * Construir y optimizar canalizaciones CI/CD para automatizar la implementación de software, la gestión de configuraciones y tareas operativas repetitivas * Diseñar e implementar sistemas sólidos de registro, supervisión y alertas mediante herramientas como Prometheus, Grafana y Datadog * Establecer Objetivos de Nivel de Servicio (SLO) e Indicadores de Nivel de Servicio (SLI) claros * Responder a incidentes en producción y liderar los esfuerzos de resolución de problemas para restablecer los servicios * Realizar análisis posteriores a incidentes sin asignación de culpas para identificar causas fundamentales y prevenir su recurrencia * Colaborar con desarrolladores de software para optimizar el rendimiento del sistema y planificar la capacidad * Garantizar que los servicios puedan escalar para soportar el crecimiento y picos de tráfico **Requisitos** * 2\+ años de experiencia en administración de sistemas, DevOps o desarrollo de software centrado en sistemas * Competencia en al menos un lenguaje de scripting o programación, como Python, Bash, Go o Rust * Experiencia con proveedores de nube pública tales como AWS, Azure o GCP, así como con herramientas de contenerización como Docker y Kubernetes * Conocimientos sobre administración de Linux/Unix y fundamentos de redes, como TCP/IP, DNS y HTTP/SSL/TLS * Pasión por la automatización, la eliminación de tareas repetitivas innecesarias (toil) y la construcción de sistemas resilientes que fallen con elegancia * Competencia avanzada en inglés (C1\+) **Ofrecemos** * Proyectos internacionales con marcas líderes * Trabajo con equipos globales de colegas altamente calificados y diversos * Beneficios médicos * Programas financieros para empleados * Días de vacaciones pagados y licencias por enfermedad * Cursos de actualización de habilidades, reconversión profesional y certificación * Acceso ilimitado a la biblioteca de LinkedIn Learning y más de 22.000 cursos * Oportunidades profesionales globales * Oportunidades de voluntariado y participación comunitaria * Grupos de empleados de EPAM * Cultura galardonada reconocida por Glassdoor, Newsweek y LinkedIn

Fuentea: indeed
Parte del contenido se ha traducido automáticamente

Publicado por

Sofía González

Indeed · HR

Ubicación

Sofía González

Indeed · HR

Empleos similares

Ingeniero de Confiabilidad del Sitio (SRE) empleo de Indeed en 2026 | ok.com