Ingeniero de Datos GCP AWS & Databricks Fully Remote - US

Ingeniero de Datos GCP AWS & Databricks

Tiempo completo • Fully Remote - US

Ingeniero de Datos – GCP, AWS y Databricks

Ubicación: Remoto – Estados Unidos
Tipo de empleo: Contrato
Experiencia requerida: 6+ años

Resumen del puesto

Buscamos un Ingeniero de Datos experimentado para diseñar, desarrollar y mantener canalizaciones de datos y plataformas de datos escalables basadas en la nube. El candidato ideal tendrá una sólida experiencia práctica con GCP, AWS, Databricks, Apache Spark, PySpark, Python y SQL.

Este puesto requiere experiencia en la construcción de pipelines ETL/ELT fiables, integración de datos de múltiples fuentes y optimización de soluciones de datos en la nube para rendimiento, seguridad, escalabilidad y coste.

Responsabilidades clave

  • Diseñar, desarrollar y mantener pipelines de datos escalables ETL/ELT.
  • Crea soluciones de datos basadas en la nube utilizando los servicios GCP y AWS.
  • Utiliza Databricks, Apache Spark y PySpark para el procesamiento de datos a gran escala.
  • Integra datos estructurados, semiestructurados y no estructurados de múltiples fuentes.
  • Desarrollar y optimizar flujos de trabajo de procesamiento de datos en tiempo real y por lotes.
  • Mejorar el rendimiento, la fiabilidad, la escalabilidad y la eficiencia de costes de las tuberías de producción.
  • Implementar controles de calidad de datos, monitorización, seguridad y normas de gobernanza.
  • Diseñar y dar soporte a almacenes de datos en la nube y lagos de datos.
  • Soluciona problemas de producción y realiza análisis de causas raíz.
  • Colabora con arquitectos de datos, analistas, equipos de aplicaciones y partes interesadas del negocio.
  • Crear y mantener documentación técnica para pipelines, modelos de datos y flujos de trabajo.
Cualificaciones requeridas

  • 5+ años de experiencia profesional en ingeniería de datos.
  • Tengo una sólida experiencia práctica tanto con GCP como con AWS.
  • Experiencia en Databricks, Apache Spark y PySpark.
  • Sólidas habilidades de programación en Python y SQL.
  • Experiencia probada desarrollando pipelines ETL/ELT y plataformas de datos en la nube.
  • Experiencia con almacenes de datos, data lakes y modelado de datos dimensionales.
  • Experiencia con herramientas de orquestación como Apache Airflow o Google Cloud Composer.
  • Comprensión de la seguridad de los datos, gobernanza, monitorización y marcos de calidad.
  • Sólidas habilidades analíticas, de resolución de problemas y de resolución de problemas.
  • Excelentes habilidades de comunicación y colaboración transversal.
Cualificaciones Preferidas

  • Experiencia con servicios de GCP como BigQuery, Cloud Storage, Dataflow, Dataproc, Pub/Sub y Cloud Composer.
  • Experiencia con servicios de AWS como S3, Glue, EMR, Redshift, Lambda y Kinesis.
  • Familiaridad con la arquitectura de casas de Delta Lake y Databricks.
  • Experiencia con tecnologías de streaming como Apache Kafka.
  • Familiaridad con CI/CD, Git, Terraform y la automatización de infraestructura en la nube.
  • Experiencia trabajando en entornos de desarrollo ágil.
Habilidades imprescindibles

GCP | AWS | Databricks | Apache Spark | PySpark | Python | SQL | ETL/ELT | Airflow/Cloud Composer | Data Warehousing | Data Lakes

Este es un puesto remoto.

Compensación: 45,00 $ - 50,00 $ la hora




(si ya tienes un currículum en Indeed)

O aplicar aquí.

* campos requeridos

Ubicación
Or
Or
If no code provided, add their name instead.
Política de privacidad