- Construire / optimiser le datalake (standardisation, qualité, sécurité, gouvernance) - Python + Cloud public. - Développer des pipelines ETL automatisés pour ingérer, nettoyer et transformer des données physiologiques complexes - Airflow / orchestration. - Fournir aux Data Scientists des datasets versionnés, fiables et massifs - Lakehouse (Delta ou équivalent). - Garantir la conformité RGPD, l'anonymisation et la traçabilité complète des données. - Industrialiser la stack : CI/CD, monitoring, automatisation, optimisation cloud - Terraform, Git, Linux. - Jouer le rôle de référent technique : architecture, bonnes pratiques, accompagnement des profils plus juniors.
Profil recherché
🎯 Profil recherché
- 7+ ans en Data Engineering dont rôle Senior/Lead. - Maîtrise Python, pipelines, big data & architectures cloud. - Sens du produit, rigueur, autonomie. - Bonus : MLOps, données sensibles, signaux physiologiques.