13 ago
|
eTribe
|
Ciudad Juárez
13 ago
eTribe
Ciudad Juárez
Diseñar, desarrollar y mantener pipelines de datos escalables y eficientes utilizando **Databricks** sobre plataformas cloud como **AWS, Azure o GCP**, contribuyendo a proyectos de analítica avanzada, machine learning y transformación digital para nuestros clientes.
**Responsabilidades Principales**
- Diseñar y desarrollar workflows de ingesta, transformación y modelado de datos utilizando Databricks y Apache Spark.
- Implementar soluciones de ETL/ELT en ambientes cloud integrados con Databricks.
- Colaborar con analistas de datos, científicos de datos y arquitectos para optimizar pipelines y mejorar la calidad y disponibilidad de los datos.
- Monitorear y mejorar el rendimiento de notebooks y clusters en Databricks.
- Integrar Databricks con herramientas como Delta Lake, MLflow, Unity Catalog, entre otras.
- Participar en el diseño de soluciones seguras, auditables y alineadas a las mejores prácticas de DataOps.
- Documentar procesos y participar en revisiones de código y sesiones de planificación ágil.
**Requisitos Técnicos**
- Experiência mínima de 2 años trabajando con Databricks (notebooks, clusters, jobs).
- Dominio de Apache Spark (especialmente PySpark).
- Experiência con SQL para exploración y transformación de datos.
- Conocimientos en arquitecturas cloud: Azure Data Lake, AWS S3 o Google Cloud Storage.
- Familiaridad con Delta Lake y formatos de almacenamiento como Parquet.
- Buen manejo de Git, integración continua (CI/CD)
y procesos de versionado.
- Deseable: experiência con MLflow, dbt, Airflow y herramientas de orquestación.
**Habilidades y Competencias**
- Capacidad para trabajar en entornos colaborativos y metodologías ágiles.
- Mentalidad analítica y orientada a la optimización.
- Alta atención al detalle en el manejo y transformación de datos.
- Deseo de aprender tecnologías emergentes en el ecosistema de datos.
**Formación Académica**
- Licenciatura en Ingeniería en Sistemas, Computación, Ciencias de Datos o campo relacionado.
**Deseables (Plus)**
- Certificación de Databricks o experiência con Databricks Lakehouse Platform.
- Conocimientos básicos de machine learning aplicado sobre pipelines.
- Experiência previa en sectores como retail, banca, salud o telecomunicaciones.
Tipo de puesto: Jornada completa
Sueldo: $70,000.00 - $80,000.00 al mes
Beneficios:
- Aumentos salariales
- Días de maternidad superiores a los de la ley
- Días de paternidad superiores a los de la ley
- Días por enfermedad
- Horarios flexibles
- Opción a contrato indefinido
- Trabajo desde casa
- Vacaciones adicionales o permisos con goce de sueldo
Tipo de jornada:
- Turno de 8 horas
Experiência:
- Cloud (AWS, GCP, AZURE): 3 años (Obligatorio)
- Databricks: 3 años (Obligatorio)
- SQL: 3 años (Obligatorio)
Lugar de trabajo: remoto híbrido en 06600, Ciudad de México
📌 Data Engineer - Especialista en Databricks (Ciudad Juárez)
🏢 eTribe
📍 Ciudad Juárez