Data Engineer GCP – DBT (H/F)
Data Engineer GCP – DBT (H/F)
Rejoindre Davidson, ce n’est pas seulement intégrer un groupe de 3000 consultants dans 6 pays et 2 continents, c’est intégrer LA société qui a été élue par ses salariés Great Place To Work France et Europe pendant 4 ans mais aussi une des plus grandes B Corp de France, nommée Best of the World dans la catégorie “collaborateurs” en 2022 ! (Les “B Corp” formant une communauté de sociétés qui ont décidé d’être non pas les meilleures du monde mais les meilleures POUR le monde).
Parce que notre développement repose sur des principes forts :Un profond respect de l’ensemble de nos parties prenantes : consultant(e)s, clients et fournisseurs. Car si le travail “ne fait pas le bonheur”, il peut cependant “faire le malheur”. Nous nous engageons donc à écouter et agir avec honnêteté.
Une égalité des chances dans le traitement de nos candidatures et dans la gestion de carrière de nos salarié(e)s. Nous croyons en un milieu de travail où équité F/H, inclusion et diversité sont la norme.
Une empreinte environnementale minimale, et sociétale maximale. C’est pourquoi, au-delà des missions que vous réaliserez, vous pourrez également contribuer à des projets que Davidson soutient : missions de solidarité internationale (avec Planète Urgence), bénévolat auprès d’associations (chaque Davidsonien(ne) dispose de 3 jours par an pour intervenir à leurs côtés), accompagnement d’étudiant(e)s issus de milieux peu favorisés (avec Article 1), investissement dans des startups développant des solutions innovantes, actions collectives et individuelles pour la réduction de notre impact carbone…Un Management adhocratique basé sur la mise en œuvre des principes de “l’entreprise horizontale” et du “management tribal”. Sur ce dernier point une précision d’importance : le bien-être au travail est un luxe qu’il faut pouvoir s’offrir en étant une entreprise “solide”. Ceci induit pour les Davidsonien(ne)s d’allier prises d’initiative, engagement et professionnalisme. Car “sans travail, le talent n’est qu’une sale manie”. Et cela nous incite à chercher à recruter des personnes… meilleures que nous…Nous encourageons les candidatures de personnes en situation de handicap, et nous nous engageons à répondre au mieux à leurs besoins spécifiques.
Profil / Mission
Contexte
Dans le Retail, le Luxe, le tourisme ou tout autre secteur, la data est au cœur de l’activité.
Il s’agit de maîtriser une architecture Data‑Centric, avec une plateforme de référence qui fournit des données fiables et en quasi temps réel (via API, data warehouse, data lake) pour accélérer les décisions tech, business et digitales
Davidson dispose d’un savoir‑faire reconnu et intervient sur toutes les phases d’un projet data : conseil & organisation, cadrage, définition, conception, industrialisation et optimisation. Nos consultants interviennent sur des projets Data Engineering, Data Analytics et Data IA.
Ta mission en tant que Data Engineer GCP – DBTTu contribueras à la conception et à l’industrialisation de projets data de bout en bout :Concevoir, développer et maintenir des pipelines de données ETL/ELT sur Google Cloud Platform (GCP)
Modéliser et transformer les données avec DBT (couches staging / intermediate / marts, documentation, tests de qualité)
Concevoir des data warehouses et data lakes scalables sur Big
Query, optimiser les schémas, partitions et stratégies de clustering
Optimiser les requêtes SQL, gérer le partitionnement, réduire les coûts Big
Query / Dataflow
Mettre en place des tests, contrôles de cohérence et monitoring des données (qualité, fraîcheur, complétude)
Versionner (Git) et déploiement continu via Terraform, Cloud Build, Git
Lab CIOrchestrer les workflows avec Cloud Composer (Airflow) et organiser les dépendances de façon fiable et maintenable
Collaborer avec les équipes data analytics / data science / marketing pour livrer des datasets prêts à l’usage (personnalisation, recommandation, activation marketing, reporting)
Stack technique
Cloud – GCPBig
Query, Cloud Storage, Dataflow, Dataproc, Pub/Sub, Cloud Run / GKE, Kafka (selon projets)
Cloud Composer (Airflow) pour l’orchestration
Transformation & modélisation
DBT (transformation ELT, modélisation analytique, tests, documentation)
Langages
SQL (expert), Python, Java/Scala
Dev
Ops / Data
Ops
Git, Terraform, Cloud Build, Git
Lab CITests de données, CI/CD des modèles DBT et des pipelines
Exemples de projets menés
Secteur Luxe : concevoir et automatiser des pipelines de données scalables sur GCP (Big
Query, Cloud Storage, Cloud Composer) pour alimenter la personnalisation, les recommandations produits et les tableaux de bord business.
Marketing digital : concevoir et automatiser des pipelines de données sur GCP à destination du département marketing (ciblage, activation, campagnes de dernière génération, publicité digitale ciblée, attribution, etc.).
Compétences requises ou à acquérir
Tu es le/la reine (roi) de la Data ?
Les termes Big
Query, Python, DBT, Pub/Sub, GCP n’ont plus aucun secret pour toi ?
Tu aimes travailler en équipe ?
Tu aimes la technique ?
N’hésite pas à candidater !!
Aptitudes / Savoir-être
Esprit d’équipe et de partage !
Appétence forte pour la technique
Capacité rédactionnelle
Description du pôle
La donnée est aujourd’hui un actif stratégique au cœur de la transformation digitale des entreprises et à la base de la création de multiples nouveaux services. Davidson dispose d’une expertise unique autour de la donnée qui lui permet d’intervenir de bout-en-bout pour ses clients, qu’ils soient data-driven ou cherchent « simplement » à valoriser leurs données.
Nos métiers : Accompagnement à la mise en place d’une stratégie données
Architecture Big Data
Data visualisation
Data science
Notre environnement technique :Infrastructures & Stockage : Cloud (AWS, Azure, Google Cloud Platform), Cloudera,Map
Reduce, Hortonworks, mongo
DB, Hadoop, Cassandra, Splunk, Redis, Couch
DBTraitement de données : Spark, Scala, Kafka, Logstach, Elasticsearch, Hive, Storm, Flink
Analytics : R, Python, SPSS&SAS, Tensor
Flow, Sickit learn
Dataviz : grafana, dataiku, kibana, Tableau, Qlik, Outil propre JSDevops & containers : Docker, puppet, Jenkins, Sonar, Openshift, Kubernetes, Ansible
Domaines : Machine Learning, Deep Learning
Candidature
Suivez vos rêves, ils connaissent le chemin.