Descripción
Resumen:
Este puesto implica arquitecturar y escalar tuberías de datos modernas, construir modelos de datos resilientes y garantizar la fiabilidad y el rendimiento de las plataformas de informes de BI y de aprendizaje automático.
Aspectos destacados:
1. Arquitecturar y escalar tuberías de datos modernas y flujos de trabajo impulsados por Airflow.
2. Diseñar y optimizar transformaciones SQL y modelos de datos de alta calidad.
3. Colaborar con equipos multifuncionales para orientar la toma de decisiones ejecutiva.
#### **Acerca de Trafilea**
Trafilea es una plataforma tecnológica para consumidores centrada en el crecimiento transformador de marcas. Estamos desarrollando el motor de crecimiento basado en IA que impulsa a la próxima generación de marcas para consumidores. Con más de 1000 millones de dólares estadounidenses en ingresos acumulados, más de 12 millones de clientes y más de 500 talentos distribuidos en 19 países, combinamos tecnología, marketing de crecimiento y excelencia operativa para escalar marcas digitales nativas con propósito. Somos propietarios y operamos nuestras propias marcas D2C (no somos una agencia), con presencia en Walmart, Nordstrom, Amazon y una sólida huella global.
#### **Por qué Trafilea**
Somos un grupo de comercio electrónico dirigido por tecnología que escala nuestras propias marcas DTC admiradas a nivel mundial, mientras ayudamos a talentos ambiciosos a crecer tan rápido como lo hacemos nosotros.
Construimos y escalamos nuestras propias marcas.
Invertimos en IA y automatización como pocos en el comercio electrónico.
Probamos rápidamente, crecemos rápidamente y te ayudamos a hacer lo mismo.
Sé parte de un equipo global dinámico, diverso y talentoso.
Trabajo 100 % remoto, salario competitivo en USD, días libres remunerados y más.
#### **Responsabilidades del puesto**
Este puesto se encuentra en la intersección de la ingeniería de datos, la analítica, la inteligencia empresarial y la infraestructura de aprendizaje automático. Tú arquitecturarás y escalarás tuberías de datos modernas, construirás modelos de datos resilientes y garantizarás la fiabilidad, precisión y rendimiento operativo de nuestra capa de informes de BI y de nuestras plataformas de aprendizaje automático.
**Responsabilidades clave**
* **Arquitectura de tuberías y sistemas:** Arquitecturar, escalar y mantener tuberías ETL/ELT de extremo a extremo y flujos de trabajo impulsados por Airflow a lo largo del ciclo de vida completo de los datos (extracción, transformación, modelado de ML, informes).
* **Modelado de datos y entrega de BI:** Diseñar y optimizar transformaciones SQL, conjuntos de datos y modelos de datos de alta calidad. Crear, centralizar y mantener paneles de control y herramientas analíticas para traducir necesidades empresariales en soluciones escalables de BI.
* **Calidad de los datos y gobernanza:** Establecer una sólida gobernanza, monitoreo, alertas, acuerdos de nivel de servicio (SLA), validación de datos y detección de anomalías. Realizar análisis de causa raíz para garantizar alta precisión, fiabilidad y confianza empresarial en las métricas.
* **Soporte para aprendizaje automático y analítica:** Operacionalizar modelos de aprendizaje automático en entornos por lotes o en tiempo real y construir herramientas internas de datos para potenciar a los equipos de Ciencia del Marketing, Analítica y comerciales.
* **Optimización del rendimiento y costos:** Optimizar consultas SQL complejas y conjuntos de datos a gran escala para lograr rendimiento, eficiencia de costos y escalabilidad en el ecosistema en la nube de AWS.
* **Colaboración con partes interesadas:** Colaborar con equipos multifuncionales para definir e informar sobre métricas empresariales fundamentales (por ejemplo, CAC, ROAS, LTV, embudos de conversión) con el fin de orientar directamente la toma de decisiones ejecutiva.
* **Experiencia:** 4 años o más en Ingeniería de Datos, Ingeniería Analítica, BI o Ingeniería de Aprendizaje Automático en entornos productivos.
* **SQL y modelado:** Competencia avanzada en SQL (joins, expresiones comunes tabulares - CTE, funciones ventana, optimización) y experiencia comprobada diseñando y manteniendo modelos de datos y tuberías productivas.
* **Pila de AWS:** Experiencia práctica con servicios centrales de datos de AWS (por ejemplo, Redshift, S3, Glue, Athena, Lambda).
* **Orquestación:** Experiencia práctica con Apache Airflow para la gestión de flujos de trabajo.
* **Programación y estándares de ingeniería:** Fuertes habilidades en Python (énfasis en programación orientada a objetos), experiencia con prácticas de CI/CD (GitHub Actions/GitLab) y contenerización (Docker, Kubernetes/ECS/EKS).
* **BI y calidad de los datos:** Competencia con plataformas de BI (Tableau, Quicksight o similares) y responsabilidad directa sobre informes productivos, calidad de los datos y análisis de causa raíz.
* **Habilidades blandas:** Pensamiento sistémico con altos estándares en documentación, escalabilidad, precisión y comunicación de conclusiones tanto a socios técnicos como no técnicos.
**Deseable:**
* Experiencia con dbt o marcos modernos de ELT
* Conocimientos especializados en analítica de comercio electrónico y marketing (CAC, ROAS, LTV, retención y optimización de embudos).