Ingeniero de Datos GCP AWS & Databricks Fully Remote - US

Ingeniero de Datos GCP AWS & Databricks

Tiempo completo • Fully Remote - US

Ingeniero de Datos – GCP, AWS y Databricks

Ubicación: Remoto – Estados Unidos
Tipo de empleo: Contrato
Experiencia requerida: 6+ años

Resumen del puesto

Buscamos un Ingeniero de Datos experimentado para diseñar, desarrollar y mantener canalizaciones de datos y plataformas de datos escalables basadas en la nube. El candidato ideal tendrá una sólida experiencia práctica con GCP, AWS, Databricks, Apache Spark, PySpark, Python y SQL.

Este puesto requiere experiencia en la construcción de pipelines ETL/ELT fiables, integración de datos de múltiples fuentes y optimización de soluciones de datos en la nube para rendimiento, seguridad, escalabilidad y coste.

Responsabilidades clave

  • Diseñar, desarrollar y mantener pipelines de datos escalables ETL/ELT.
  • Crea soluciones de datos basadas en la nube utilizando los servicios GCP y AWS.
  • Utiliza Databricks, Apache Spark y PySpark para el procesamiento de datos a gran escala.
  • Integra datos estructurados, semiestructurados y no estructurados de múltiples fuentes.
  • Desarrollar y optimizar flujos de trabajo de procesamiento de datos en tiempo real y por lotes.
  • Mejorar el rendimiento, la fiabilidad, la escalabilidad y la eficiencia de costes de las tuberías de producción.
  • Implementar controles de calidad de datos, monitorización, seguridad y normas de gobernanza.
  • Diseñar y dar soporte a almacenes de datos en la nube y lagos de datos.
  • Soluciona problemas de producción y realiza análisis de causas raíz.
  • Colabora con arquitectos de datos, analistas, equipos de aplicaciones y partes interesadas del negocio.
  • Crear y mantener documentación técnica para pipelines, modelos de datos y flujos de trabajo.
Cualificaciones requeridas

  • 5+ años de experiencia profesional en ingeniería de datos.
  • Tengo una sólida experiencia práctica tanto con GCP como con AWS.
  • Experiencia en Databricks, Apache Spark y PySpark.
  • Sólidas habilidades de programación en Python y SQL.
  • Experiencia probada desarrollando pipelines ETL/ELT y plataformas de datos en la nube.
  • Experiencia con almacenes de datos, data lakes y modelado de datos dimensionales.
  • Experiencia con herramientas de orquestación como Apache Airflow o Google Cloud Composer.
  • Comprensión de la seguridad de los datos, gobernanza, monitorización y marcos de calidad.
  • Sólidas habilidades analíticas, de resolución de problemas y de resolución de problemas.
  • Excelentes habilidades de comunicación y colaboración transversal.
Cualificaciones Preferidas

  • Experiencia con servicios de GCP como BigQuery, Cloud Storage, Dataflow, Dataproc, Pub/Sub y Cloud Composer.
  • Experiencia con servicios de AWS como S3, Glue, EMR, Redshift, Lambda y Kinesis.
  • Familiaridad con la arquitectura de casas de Delta Lake y Databricks.
  • Experiencia con tecnologías de streaming como Apache Kafka.
  • Familiaridad con CI/CD, Git, Terraform y la automatización de infraestructura en la nube.
  • Experiencia trabajando en entornos de desarrollo ágil.
Habilidades imprescindibles

GCP | AWS | Databricks | Apache Spark | PySpark | Python | SQL | ETL/ELT | Airflow/Cloud Composer | Data Warehousing | Data Lakes

Este es un puesto remoto.

Compensación: 45,00 $ - 50,00 $ la hora




(si ya tienes un currículum en Indeed)

O aplicar aquí.

* campos requeridos

Text me updates about my application
Message and data rates may apply. Message frequency varies. Reply STOP to opt out. Reply HELP for help. See our User Terms of Service and Privacy Policy for details.
Ubicación
Or
Or
If no code provided, add their name instead.
Política de privacidad