Descripción
Resumen:
Únase a SafeGraph como Ingeniero Senior de Plataforma de Datos para diseñar y escalar la infraestructura global de datos que impulsa productos líderes en inteligencia de ubicación, definiendo cómo fluye la información a través de su ecosistema.
Aspectos destacados:
1. Diseñar y escalar la infraestructura global de datos para productos líderes en la industria
2. Definir cómo fluye la información a través del ecosistema, optimizando la eficiencia
3. Colaborar con ingenieros y científicos de datos de clase mundial
Únase a **SafeGraph** como **Ingeniero Senior de Plataforma de Datos**, donde diseñará y escalará la columna vertebral de nuestra infraestructura global de datos que impulsa productos líderes en inteligencia de ubicación. En este puesto, trabajará junto a **ingenieros**, **científicos de datos** y **expertos en plataformas** de clase mundial para construir los sistemas que hacen que los datos de SafeGraph sean rápidos, fiables y accesibles para los clientes en todo el mundo.
En SafeGraph, nuestra misión es desbloquear los datos geoespaciales más precisos del mundo para impulsar la innovación. Nuestra plataforma ingiere, procesa y entrega miles de millones de registros diariamente; y, como parte de nuestro equipo de Ingeniería de Plataformas, **usted definirá cómo fluye la información a través de nuestro ecosistema**. Desde la optimización de cómputo a gran escala en AWS hasta la construcción de abstracciones elegantes que simplifican el uso de sistemas distribuidos complejos, su trabajo acelerará directamente la creación de productos impulsados por datos.
### **Sus responsabilidades**
* Diseñar, construir y mantener la infraestructura central de la plataforma en **AWS (EKS, EMR, Glue, S3, Terraform)**.
* **Desarrollar sistemas escalables** para orquestar de forma eficiente y fiable decenas de miles de trabajos de procesamiento de datos.
* Colaborar con equipos de datos y de aprendizaje automático para ofrecer entornos robustos y **nativos en la nube** para cómputo a gran escala.
* **Automatizar el aprovisionamiento y las implementaciones de infraestructura** mediante Terraform, GitHub Actions, GitLab CI o Harness.
* **Optimizar** los costos, la fiabilidad y el rendimiento en clústeres, almacenes de datos y cargas de trabajo de cómputo.
* **Construir herramientas y abstracciones** para simplificar los flujos de trabajo de los desarrolladores y mejorar la usabilidad de la plataforma.
* Implementar buenas prácticas de observabilidad y monitoreo mediante **Prometheus, Grafana y Dynatrace**.
* Colaborar transversalmente para evolucionar nuestra arquitectura y escalar nuestra plataforma de datos al siguiente nivel.
**Requisitos**
* Licenciatura en Ciencias de la Computación, Ingeniería o experiencia equivalente.
* 3\+ años de experiencia construyendo y operando sistemas distribuidos o plataformas de datos.
* Conocimientos sólidos en **Scala, Java o Python**.
* Experiencia práctica con **servicios de AWS** (EKS, EMR, Glue, S3, ECR) y **infraestructura como código** (Terraform).
* Comprensión profunda de **contenerización** (Docker, Kubernetes) y tuberías de CI/CD (GitHub, GitLab CI o Harness).
* Conocimientos sólidos sobre redes en la nube, gestión de recursos y optimización de costos.
* Familiaridad con **herramientas de observabilidad** (Prometheus, Grafana, Dynatrace, LogDNA/Mezmo).
* Excelentes habilidades de resolución de problemas, comunicación y colaboración.
### **Cualificaciones preferidas**
* Experiencia con **herramientas de ingeniería de datos**, como Apache Spark, Databricks o Airflow.
* Conocimientos sobre **formatos modernos de almacenamiento de datos** (Apache Iceberg, Delta Lake) y almacenes de datos en la nube (Snowflake, Redshift).
* Familiaridad con **infraestructura de ML o IA** y tuberías de datos.
* Experiencia construyendo plataformas o marcos de desarrollo utilizados por múltiples equipos.