Les missions du poste
Le besoin
?? Lille - environnement hybride
?? CDI
?? Senior / confirmé
?? À propos de l'entreprise
Notre client est une scale-up technologique lilloise à dimension internationale, spécialisée dans le développement de produits digitaux dans l'univers du divertissement.
Créée il y a plus de 20 ans, l'entreprise a connu une forte accélération de sa croissance ces dernières années, tout en conservant un environnement entrepreneurial et une organisation à taille humaine.
Ses produits sont aujourd'hui utilisés quotidiennement par des millions d'utilisateurs à travers le monde, avec une activité très largement tournée vers l'international.
Dans cette phase de changement d'échelle, l'entreprise continue de renforcer ses équipes Tech & Data afin de structurer son organisation et d'accompagner durablement sa croissance.
?? Le contexte
Dans le cadre de son développement, notre client renforce son équipe Data et recherche un Senior Data Engineer capable de prendre progressivement l'ownership technique de sa plateforme Data.
La plateforme repose aujourd'hui principalement sur GCP, BigQuery, SQLMesh et Python.
Elle a initialement été construite avec l'aide d'un prestataire externe et doit désormais être pleinement maîtrisée et exploitée en interne.
Le rôle est donc particulièrement important : il ne s'agit pas de repartir d'une page blanche, mais de comprendre l'existant, d'en reprendre progressivement la maîtrise, de fiabiliser ce qui doit l'être et de faire évoluer la plateforme de manière structurée.
L'objectif est simple : garantir que les données nécessaires à l'entreprise soient disponibles, fiables, compréhensibles, correctement modélisées et observables lorsqu'un problème survient.
Tu travailleras en forte proximité avec les équipes Data, Backend et Infrastructure, notamment sur les sujets d'ingestion, de modélisation, de qualité des données, d'observabilité et de contrats avec les systèmes sources.
?? Tes missions
Tu seras notamment amené à :
Prendre l'ownership technique de la plateforme Data et du Data Warehouse.
Comprendre et faire évoluer l'architecture existante ainsi que les différents flux de données.
Maintenir et faire évoluer les pipelines d'ingestion.
Intégrer de nouvelles sources de données.
Garantir la fraîcheur, la disponibilité et la fiabilité des données.
Concevoir et maintenir les différents niveaux de modélisation : données ingérées, staging, modèles métier, dimensions, faits et marts.
Faire évoluer les transformations et modèles avec SQLMesh.
Mettre en place et renforcer les tests et contrôles de qualité : unicité, nullabilité, cohérence, complétude, fraîcheur, variations anormales...
Mettre en place une observabilité efficace afin de détecter rapidement les problèmes de données.
Diagnostiquer les incidents, identifier leur origine et remettre les traitements en fonctionnement.
Travailler avec les équipes Backend afin de définir des contrats de données suffisamment stables.
Collaborer avec le Data Analyst sur les besoins analytiques, les usages et les modèles nécessaires aux différents consommateurs.
Participer à la maîtrise et à l'optimisation des coûts de la plateforme Data.
Participer aux choix d'architecture et faire évoluer progressivement les composants présentant les risques ou limites les plus importants.
??? L'environnement technique
Cloud & Data
GCP
BigQuery
SQLMesh
Python
Engineering
Git
CI/CD
Infrastructure as Code
Pulumi
Cloud Run
Cloud Batch
? Pourquoi rejoindre cette aventure ?
Une scale-up lilloise en forte croissance avec une vraie dimension internationale.
Des produits utilisés quotidiennement à travers le monde.
Une plateforme Data avec de véritables enjeux de passage à l'échelle, fiabilité et qualité.
Un rôle avec un fort niveau d'ownership technique.
La possibilité de travailler sur une plateforme existante et de participer directement à sa transformation.
Des sujets techniques variés, concrets et stimulants.
Une équipe à taille humaine, avec une vraie culture d'échange.
Une forte proximité avec les équipes Backend, Infrastructure, Data et métiers.
Des locaux en plein centre de Lille.
Un environnement de travail flexible.
Un onboarding permettant de comprendre progressivement l'architecture et les usages.
Le processus de recrutement
1. Entretien RH
Visio - environ 30 minutes.
2. Entretien technique
En visio ou en présentiel à Lille avec les membres de ta future équipe.
3. Entretien final
Avec le CEO.
?? Le vrai challenge du poste
L'objectif n'est pas simplement de construire des pipelines.
Il s'agit de devenir le référent technique d'une plateforme Data stratégique, d'en comprendre les forces et les faiblesses, de la fiabiliser et de poser progressivement les bases qui permettront à l'entreprise de continuer à grandir sereinement.
C'est donc un poste particulièrement intéressant pour un Senior Data Engineer qui souhaite prendre de l'ownership, avoir un véritable impact sur l'architecture et construire quelque chose dans la durée.
Le profil recherché
Profil recherché
?? Le profil recherché
Nous recherchons avant tout un Data Engineer senior ayant déjà travaillé sur des plateformes Data en production.
Tu disposes notamment de :
Une expérience solide en Data Engineering, idéalement sur une plateforme exploitée en production.
Une excellente maîtrise de SQL.
Une bonne maîtrise d'un langage de programmation généraliste.
Une expérience significative en modélisation de données.
Une expérience des architectures ETL / ELT.
Une expérience avec dbt, SQLMesh ou un outil équivalent.
Une expérience de BigQuery ou d'un Data Warehouse cloud similaire.
Une bonne compréhension des problématiques de qualité, fraîcheur, complétude et fiabilité des données.
Une expérience de systèmes Data en production et de la gestion d'incidents.
Une bonne maîtrise de Git et des pratiques de développement collaboratif.
?? Au-delà de la technique
Le poste nécessite quelqu'un capable de prendre du recul sur l'existant.
Tu dois aimer comprendre un système avant de vouloir le remplacer, distinguer une dette technique acceptable d'un véritable risque et privilégier une amélioration progressive plutôt qu'une réécriture complète.
Tu apprécies également les environnements où il faut faire le lien entre enjeux techniques et besoins métier.
Autonomie, esprit critique, capacité à communiquer simplement et goût du travail collectif seront essentiels.
? Les petits plus
Une expérience sur les sujets suivants sera particulièrement appréciée :
Python
GCP
CI/CD
Infrastructure as Code
Pulumi ou Terraform
Cloud Run / Cloud Batch
Reprise et évolution d'une plateforme Data existante
Compétences requises
- Python
- ETL
- Autonomie
- Batching
- Terraform
- Git
- Contrôle qualité
- Modélisation des données
- Google cloud platform
- Langages de programmation
- SQL