Data Engineer Python Spark (H/F)

Lyon, France
Dès que possible
> 12 mois
Régie
Temps plein

Référence:
02-DEVBIG-LY
Projet :

Les modalités

Lieu : Lyon Télétravail : 50%

Démarrage : 01/01/2027

Descriptif de la mission :

Contexte

Pour un acteur majeur du secteur de l'énergie, nous recherchons un Data Scientist / Développeur Big Data Senior pour rejoindre une équipe dédiée aux études et produits data innovants, notamment sur la maintenance prédictive et la mobilité électrique. Vous interviendrez en priorité sur des thématiques métiers complexes et sur la création d'un pipeline de mise à disposition de projets cartographiques à destination des équipes opérationnelles. La mission couvre l'intégralité de la chaîne de valeur, depuis l'analyse exploratoire et l'étude jusqu'à la mise en production des traitements de data science.

Vos missions

  • Animer des ateliers avec les experts métiers pour collecter, préciser et cadrer les besoins.

  • Réaliser la recherche de données adéquates et mener des analyses exploratoires approfondies.

  • Concevoir et développer des traitements de données et réaliser des études statistiques.

  • Développer des modèles de Machine Learning selon les cas d'usage.

  • Industrialiser les codes d'expérimentation en Python ou PySpark pour leur mise en production.

  • Présenter les résultats et les synthétiser via des rapports d'étude ou des tableaux de bord interactifs.

  • Assurer une veille technologique sur les outils de data science et partager les bonnes pratiques au sein de l'équipe.

Environnement technique

Python (pandas, polars, scikit-learn, matplotlib, xgboost, pandera, geopandas), PySpark, Hadoop, PostgreSQL, GitLab, GitLab-CI/CD, PowerBI, Jira, Confluence.

Votre profil

Compétences indispensables

  • Expérience confirmée de 5 ans minimum sur un rôle de Data Scientist.

  • Maîtrise avancée de Python et de ses librairies d'analyse de données, avec une forte expertise technique sur les traitements spatiaux (geopandas).

  • Forte expérience en industrialisation et refactoring pour transformer des scripts d'étude en traitements industriels.

  • Maitrise de Spark (PySpark ou Scala) pour le traitement de données massives (plusieurs dizaines de millions de lignes).

  • Bonne maîtrise des bases de données SQL et spécifiquement de PostgreSQL.

  • Autonomie avérée pour animer des groupes de travail et recueillir des besoins sans l'intervention systématique d'un Product Owner ou Project Manager.

  • Capacité à créer des tableaux de bord pertinents (PowerBI) et à communiquer efficacement les résultats de vos travaux.

  • Compétences en rédaction de documents de cadrage de projet.

Compétences appréciées

  • Connaissance de l'outil QGIS et de son API Python.

  • Expérience préalable de manipulation de données modélisées sous forme de graphes.

  • Connaissance fonctionnelle du secteur de l'énergie.

Rémunération:
550 €/J