Lead Data Engineer (H/F) - Freelance
Collective.workÉnergiePubliée il y a 5 jours
650 €/j
- Lieu
- Colombes · Sur site
- Durée
- 6 mois
- Démarrage
- 3 octobre 2026
- Expérience
- Expert (10 ans et +)
- Langues
- Français
- Contrat
- Freelance
Situer cette mission
Repères calculés par FreelanceScope sur les missions ouvertes de son catalogue — ils ne proviennent pas de l'annonce et n'engagent pas l'entreprise.
- Le TJM de cette mission se situe au-dessus de la médiane des 47 missions de votre métier et de votre séniorité de notre catalogue dont l'annonce publie un budget, dont la médiane est de 490 €/jour (moitié centrale : 400 à 535 €/jour).
- 1 % des missions data engineer de notre catalogue sont ouvertes en télétravail total.
- Compétences peu demandées ailleurs dans le catalogue : Unity (21 missions), Kafka (172 missions). À séniorité égale, une compétence rare se négocie mieux.
Profil expert (10 ans et +) · Comment ces repères sont calculés
La mission
Taux journalier (TJM): 650
Notre client dans le secteur Énergie et ressources naturelles recherche un/une Lead Data Engineer (H/F) H/F
Description de la mission :
Fiche de poste - Lead Data Engineer (H/F)
Contexte et objectif de la mission
Dans le cadre d'un programme de replatforming B2C, une organisation internationale construit une Data Platform centralisée à l'échelle mondiale, aujourd'hui fragmentée. L'objectif est de mettre en place une plateforme cloud-native, data-centric et scalable, au service des équipes data de plusieurs géographies, notamment la France, la Belgique et l'Australie.
Le Core Model du programme repose sur un modèle de données unifié couvrant notamment les données clients, contrats et facturation. Le Lead Data Engineer intervient comme référent technique de la data platform, avec une responsabilité complète sur l'architecture, le delivery et la qualité des données.
Stack technique
- Data Platform : Databricks (lakehouse), Amazon S3, Amazon Managed Apache Flink - Gouvernance des données : Unity Catalogue, Collibra - Visualisation : Power BI - Cloud : AWS - Streaming : Confluent Kafka - Langages : Python, SQL - IA & coding : GitHub Copilot, Claude Code, outils LLM - Collaboration : Jira, Confluence, SonarQube
Missions principales
Stratégie & Architecture Data - Définir l'architecture de la data platform greenfield (lakehouse, zones bronze/silver/gold, data contracts) - Co-construire le Core Data Model commun aux différentes géographies tout en intégrant les spécificités locales - Mettre en place la gouvernance des données, la qualité et l'observabilité - Répondre aux besoins analytiques et fonctionnels des équipes métier via une approche de type catalogue as a service
Leadership & Delivery - Être le référent technique data du programme - Choisir les partenaires et structurer une feature team de 5 à 6 personnes - Assurer la responsabilité end-to-end des pipelines, de l'ingestion à la restitution - Gérer le monitoring, la performance et l'optimisation FinOps des workloads data - Mettre en place les pratiques DataOps : automatisation des tests, CI/CD data, infrastructure as code
IA & Vélocité - Exploiter GitHub Copilot, Claude Code ou équivalents pour accélérer le développement des pipelines et modèles - Intégrer des cas d'usage IA/ML dans la data platform, incluant data science, feature store et jeux de données prêts pour les LLM - Automatiser la génération de code, les tests de qualité des données et la documentation - Conserver la maîtrise technique tout en augmentant la vélocité grâce à l'IA
Spécificités de l'équipe
Le périmètre comprend un chantier amont de migration de l'ensemble des données France vers l'écosystème Kaluza, dans le cadre d'un programme de replatforming B2C.
Cette migration implique deux modules en amont : - Module d'éligibilité : définir les paramètres business pour les parcours clients/agents - Module ETL : récupérer et transformer les données provenant de nombreux systèmes d'information avant injection dans Kaluza
Complexité forte de l'ETL : - Orchestration multi-sources - Micro-batch quotidien pendant plusieurs mois - Gestion d'un service managé AWS (Glue, Step Functions, S3, Lambda.) - Connexions API pour orchestrer les flux
Profil recherché
Compétences indispensables - Services managés AWS (Glue, Step Functions, API Gateway, S3.) - Orchestration API - Expertise avancée Databricks, incluant Delta Lake, Unity Catalogue, Spark et workflows - Solide expérience AWS en environnement data, incluant S3, Glue, Kinesis ou Flink, IAM et sécurité cloud - Mindset IA natif avec usage actif de GitHub Copilot ou équivalent comme outil principal de développement - Maîtrise experte de Python, notamment PySpark, pandas et APIs - Expérience de conception d'une data platform from scratch - Culture DataOps : tests automatisés, CI/CD data, observabilité des pipelines - Approche lean et responsabilité end-to-end - Leadership et capacité à embarquer et structurer une équipe
Entreprise : Collective.work
Lieu de travail : 92 - Colombes (92700)
Type de contrat : Profession libérale — Emploi non salarié
Expérience : Débutant accepté
Rémunération : 650 € par jour
Code ROME : M1811 Data engineer
Dernière mise à jour chez France Travail : 12/09/2026
Source : France Travail — offre reprise sous la Licence de réutilisation de la base de données des offres d'emploi (francetravail.io).
Compétences attendues
Indispensables
- Unity
- Power BI
- AWS
- Kafka
- Python
- SQL
- LLM
- Jira
Appréciées
- SonarQube
- CI/CD
- Spark
- IAM
- Pandas
- Tests automatisés

