Description du poste :
Dans le cadre du renforcement de son équipe Data, une entreprise recrute des Data Engineers confirmés pour concevoir et industrialiser des pipelines de données au sein d'une architecture Data Mesh.
Missions :
* Concevoir, développer et industrialiser des pipelines de données avec Python, Spark et Scala.
* Contribuer à l'architecture Data Mesh (Bronze, Silver, Gold).
* Optimiser le stockage des données sur MinIO et modéliser les bases PostgreSQL.
* Structurer les données au format **Parquet** et les exposer via Trino.
* Déployer et exploiter les services sur des environnements Kubernetes/Rancher.
* Mettre en œuvre des flux Kafka, Debezium et orchestrer les traitements avec Apache Airflow.
* Rédiger la documentation technique et contribuer aux bonnes pratiques d'ingénierie data (tests, qualité, revues de code).
Environnement technique :
* Langages : Python, Scala.
* Outils : Apache Spark, PostgreSQL, MinIO, Trino, Apache Airflow, Kafka, Debezium.
* Infrastructure : Kubernetes, Rancher, Cloud public, GitLab CI, Terraform, Prometheus, Grafana, Git.
Profil recherché :
* Bac+5 en Informatique, Data ou équivalent.
* Minimum 4 ans d'expérience en tant que Data Engineer sur des environnements de production.
* Excellente maîtrise de Python, Scala, Apache Spark et des architectures Data Mesh.
* Bonne connaissance de PostgreSQL, Trino, des environnements conteneurisés et des pratiques CI/CD.
* Bonnes capacités rédactionnelles, autonomie, rigueur et esprit d'équipe.
Pour postuler, cliquer sur le bouton « Postuler ».