logo source bolsa
Logo
company logo
Process & Technology Solutions S.a.c.

Ver más

Ingeniero De Datos Iii

San Isidro
  • Postular con:
    Ingeniero De Datos Iii

Resumen

Cargo: Ingeniero De Datos Iii - San Isidro, Lima, Peru
Empresa: Process & Technology Solutions S.a.c.
Ubicación: San Isidro, Lima, Peru
Área: Proyectos

¡Únete al equipo de Protecso!

Estamos en la búsqueda de un/a Data Engineer de alta prioridad para sumarse a nuestro equipo técnico. Tu principal reto será formar parte de una importante iniciativa tecnológica, impulsando la eficiencia en la ingesta, procesamiento distribuido y optimización de arquitecturas de datos a gran escala.

¿Quiénes somos?

En Protecso, no solo creamos software; diseñamos el futuro digital de las empresas B2B. Como Partner Avanzado de AWS, nos especializamos en la intersección de Cloud, Data, Inteligencia Artificial y DevOps para transformar operaciones complejas en flujos eficientes, ágiles y altamente escalables.

Conocimientos Indispensables:

  • Databricks sobre AWS: Gestión y desarrollo de arquitectura backend (Nivel Avanzado).
  • PySpark en EMR / Glue: Procesamiento distribuido enfocado en optimización de rendimiento y costos (Nivel Avanzado).
  • SQL: Construcción y optimización de consultas complejas (Nivel Avanzado).
  • Airflow o Step Functions: Orquestación y flujos de procesos ETL/ELT (Nivel Intermedio).
  • AWS Lambda: Componentes serverless para procesamiento de datos en tiempo real/batch (Nivel Intermedio).
  • Arquitecturas Data Lake / Lakehouse: Diseño conceptual e implementación (Nivel Intermedio).

Conocimientos Deseables:

  • Certificación Databricks Data Engineer Associate.
  • Certificación AWS Data Engineer Associate.
  • Pensamiento analítico con un fuerte enfoque hacia la resolución de problemas.
  • Capacidad de trabajo colaborativo y comunicación efectiva con equipos multidisciplinarios.

Responsabilidades clave:

  • Diseñar y ejecutar la ingesta y replicación de datos con AWS DMS (CDC y batch) desde fuentes on-premise y cloud.
  • Desarrollar componentes de procesamiento distribuido con PySpark en EMR/Glue, velando por la optimización de rendimiento y costos.
  • Implementar la orquestación de flujos ETL/ELT con Airflow o Step Functions.
  • Construir flujos de datos serverless utilizando Lambda, SQS y EventBridge en casi tiempo real y batch.
  • Llevar a cabo la gestión de la arquitectura backend de Databricks sobre AWS.
  • Manipular procesos de datos avanzados con Databricks (Jobs, Unity Catalog, External Components).

Beneficios Protecso:

  • 🤖 Evolución con Inteligencia Artificial: Acceso y uso de herramientas de IA de vanguardia contratadas por la empresa para potenciar tu productividad y diseño de soluciones.
  • 📈 Exposición Corporativa: Interacción directa con clientes líderes y stakeholders de proyectos reales en el sector corporativo.

Requerimientos
  • Disponibilidad para viajar
    No