Responsabilités
- Concevoir et optimiser des chaînes de traitement de données en mode batch et en continu sur la plateforme Databricks
- Traiter et analyser des volumes importants de données en utilisant PySpark ou Scala
- Appliquer des transformations complexes tout en assurant la fiabilité, la qualité et l'efficacité des traitements
- Appliquer les standards associés à Delta Lake, aux architectures de type Data Lakehouse et aux environnements cloud
- Développer selon les principes DataOps, incluant l’intégration et la livraison continues, l’automatisation, les tests et la gestion des versions
- Garantir le respect des bonnes pratiques en matière de sécurité, de gouvernance des données et d’optimisation des coûts
- Intervenir sur des projets variés dans différents secteurs tels que la finance, l’industrie, la distribution, la mobilité ou l’énergie
- Adapter les modèles de développement aux exigences spécifiques liées aux volumes, au temps réel ou aux niveaux de service
- Collaborer étroitement avec les architectes de données, les analystes, les data scientists et les équipes spécialisées cloud
- Assurer un rôle d’expert technique et accompagner les équipes de développement
- Participer activement à l’amélioration continue via la documentation, le partage de bonnes pratiques et la création d’outils internes
- Contribuer aux phases d’étude préliminaire, aux décisions technologiques et à la réalisation de prototypes ou de preuves de concept
Mode de travail
Télétravail possible depuis la France
Autres
- Tous nos postes sont accessibles aux personnes en situation de handicap
- Une maîtrise courante de l’anglais est exigée