Descripción
Resumen:
Este puesto implica ser responsable de la capa de datos para los modelos de visión por computadora, construyendo conjuntos de datos, pipelines y herramientas internas para apoyar datos de alta calidad destinados al entrenamiento de modelos de aprendizaje automático.
Aspectos destacados:
1. Trabajo con propósito: dedicado a la sostenibilidad y a poner fin al desperdicio
2. Impacto transversal: resolución de problemas complejos con resultados significativos
3. Apoyo para el éxito: respaldado por inversionistas de primer nivel
**Este puesto es COMPLETAMENTE REMOTO desde América Latina \- zona horaria del Pacífico**
¡Hola! Somos Glacier, una startup de Serie A con sede en San Francisco que aborda uno de los problemas más urgentes del mundo: la basura. ¿Sabías que, en Estados Unidos, enviamos más de la mitad de nuestros materiales reciclables a los vertederos? Estamos trabajando para solucionarlo. Al hacerlo, también reduciremos las emisiones de carbono, el consumo de energía y el agotamiento de los recursos naturales.
Glacier diseña robots personalizados de clasificación para separar materiales reciclables, así como análisis empresariales impulsados por inteligencia artificial que permiten a los centros de reciclaje potenciar sus instalaciones y mejorar la circularidad de nuestra sociedad.
**Desde grandes empresas de bienes de consumo empacados (CPG), como Colgate y Amazon**, hasta instalaciones municipales de reciclaje, nuestros clientes confían en nosotros para transformar los datos de reciclaje en conocimientos accionables. Nuestra tecnología ha sido reconocida como una de las **Mejores Invenciones de TIME** y **destacada en un documental de TIME**, además de haber aparecido en TechCrunch, Fortune y CBS.
**Aquí es donde entra en juego tu experiencia:**
Buscamos un/a ingeniero/a de datos de visión por computadora talentoso/a para hacerse cargo de la capa de datos que impulsa nuestros modelos de visión por computadora. Los buenos modelos comienzan con buenos datos, y tú construirás los conjuntos de datos, los pipelines y las herramientas internas que permitan a nuestro equipo de aprendizaje automático avanzar rápidamente y entrenar con datos de alta calidad y cuidadosamente curados. Este puesto es ideal para alguien que disfruta tanto desarrollar software y herramientas internas como trabajar con datos.
**Tus responsabilidades:**
* Gestionar el ciclo de vida de nuestros conjuntos de datos de imágenes y videos: taxonomía, curación, flujos de recolección y calidad, para garantizar que nuestros modelos se entrenen con datos limpios, bien estructurados y libres de errores.
* Diseñar y mantener los pipelines de datos que mueven, transforman, versionan y sincronizan nuestros conjuntos de datos (por ejemplo, DVC, plataformas de anotación, almacenamiento en la nube).
* Desarrollar herramientas y software internos que aceleren y mejoren la fiabilidad de la creación, etiquetado y curación de conjuntos de datos para los equipos de aprendizaje automático y de etiquetado.
* Coordinarte estrechamente con nuestro equipo de etiquetado para asegurar que los datos estén bien curados, consistentemente anotados y libres de errores.
* Mejorar progresivamente cómo recolectamos y priorizamos los datos de entrenamiento, incluidos los enfoques asistidos por modelos y de aprendizaje activo.
**Requisitos:**
* 2 o más años de experiencia en aprendizaje automático
* 2 o más años desarrollando aplicaciones de software o herramientas internas, con sólida experiencia en Python.
* 2 o más años de experiencia trabajando con conjuntos de datos de imágenes o videos.
* Experiencia práctica diseñando y manteniendo pipelines de datos (ETL/ELT, orquestación de flujos de trabajo, versionado de datos).
* Conocimientos sólidos de SQL y experiencia trabajando con datos estructurados.
* Dominio fluido del inglés, ya que trabajarás con un equipo con sede en Estados Unidos (nivel B2 o superior).
**Deseable:**
* Antecedentes o experiencia en visión por computadora o apoyando equipos de CV/ML.
* Desarrollo de aplicaciones web (React \+ Django, Nextjs)
* Experiencia con plataformas de anotación (Supervisely, CVAT, Label Studio) y herramientas de versionado de datos (DVC).
* Experiencia con almacenamiento en la nube (S3\) y desarrollo de servicios de backend (FastAPI).
* Experiencia integrando herramientas de código abierto y contribuyendo a plataformas internas.
* Experiencia trabajando con empresas o clientes estadounidenses.
**Remuneración y beneficios**
* $2.000\-$3.500 por mes, según tu experiencia y desempeño en las entrevistas
* 15 días de vacaciones pagadas \+ tus festivos nacionales
* $500 para configurar tu espacio de trabajo remoto \+ $100/mes para tu bienestar
**¿Por qué unirte a nosotros?**
* **Trabajo con propósito** – Forma parte de una empresa dedicada a la sostenibilidad y a poner fin al desperdicio.
* **Impacto transversal** – Trabaja estrechamente con los equipos de producto, ingeniería, operaciones de campo y éxito del cliente para resolver problemas complejos con resultados significativos.
* **Apoyo para el éxito** – Nuestros fundadores cuentan con experiencia previa en Facebook y Bain, y contamos con el respaldo de inversionistas de primer nivel con profunda experiencia técnica y sectorial.