Chargement en cours

Data Engineer H/F

STRASBOURG, 67
il y a 3 jours

Contexte

Plus que pro développe une nouvelle génération d’assistants virtuels basés sur l’IA, destinés à accompagner les professionnels dans leurs activités quotidiennes.

  • Ces assistants ne sont pas de simples chatbots. Ce sont des systèmes IA orientés action, capables de :

  • Comprendre le contexte métier spécifique de chaque client

  • Répondre à des questions de manière fiable et contextualisée

  • Exécuter des actions réelles telles que le paiement de factures, la planification de rendez-vous ou l’interaction avec des outils internes

Notre plateforme combine :

  • Des LLM (Large Language Models) pour l’interaction en langage naturel (texte et voix)

  • Des graphes de connaissance pour représenter les données métier nombreuses et hétérogènes de façon structurée et exploitable

  • Des systèmes de données robustes garantissant exactitude, fraîcheur, sécurité et traçabilité

Dans le cadre de notre feuille de route 2026, la data engineering et la modélisation de la connaissance deviennent des piliers stratégiques. Nous recherchons un Data Engineer pour renforcer l’équipe IA/Data avec la mission de concevoir et opérer ces fondations, ainsi que participer au développement des services IA de l’entreprise.

Votre mission

Vous serez responsable de la conception et de l’exploitation de la donnée et des connaissances de notre plateforme d’assistants IA.

Votre travail permettra à nos systèmes IA de :

  • Comprendre des contextes clients complexes via des données structurées.

  • Gérer des données fiables, à jour et avec des niveaux de droits différents.

  • Exécuter des actions métier de manière sûre, déterministe et traçable.

Vous transformerez des données brutes en produits data et graphes de connaissance de confiance, utilisés directement par des agents IA en production. Vous participez au développement des services IA de l’entreprise qui consomment les données que vous avez préalablement préparées.

Vos responsabilitésConcevoir, développer et maintenir des pipelines de données de bout en bout (batch et quasi temps réel)Développer des workflows data avec DatabricksModéliser des domaines métier sous forme de graphes de connaissance (entités, relations, permissions)Synchroniser les systèmes sources et les graphes (CDC, événements, jobs planifiés)Exposer les données et la connaissance via des services FastAPISupporter des architectures IA hybrides (graphes de connaissance + recherche vectorielle + LLM)Garantir la qualité des données, l’observabilité, la sécurité et l’isolation multi-tenantExpérience requise5 ans ou plus d’expérience en tant que Data Engineer en environnement de productionExcellente maîtrise de Python, SQL et SparkExpérience prouvée avec Azure et DatabricksExpérience dans la conception et l’exploitation de pipelines data (ETL, architectures en médaillons)Expérience avec FastAPI ou frameworks similairesCapacité à prendre en charge un système de bout en bout (design → déploiement → monitoring)Compréhension des environnements Linux et des déploiements dans des environnements cloud (Docker, Kubernetes).Maîtrise avancée de Git et des méthodes de CI/CD.Capacité à interagir au quotidien avec les profils Data/IA/métiers en comprenant les enjeux et contraintes liés à ces typologies de projets.Atouts appréciésExpérience concrète avec les graphes de connaissance (Neo4j, Neptune, ArangoDB, etc.)Modélisation de graphes et langages de requête (Cypher, SPARQL)Expérience avec des systèmes IA basés sur des LLM ou des architectures RAGConnaissance des bases de données vectorielles et de la recherche sémantiqueExpérience en environnement SaaS ou multi-tenantVotre environnement de travailCollaboration étroite avec les ingénieurs IA, les ingénieurs Data et les équipes produitForte autonomie et responsabilité techniqueAccent mis sur des systèmes robustes en production plutôt que des prototypes

Expérience requise

5 ans ou plus d’expérience en tant que Data Engineer en environnement de productionExcellente maîtrise de Python, SQL et SparkExpérience prouvée avec Azure et DatabricksExpérience dans la conception et l’exploitation de pipelines data (ETL, architectures en médaillons)Expérience avec FastAPI ou frameworks similairesCapacité à prendre en charge un système de bout en bout (design → déploiement → monitoring)Compréhension des environnements Linux et des déploiements dans des environnements cloud (Docker, Kubernetes).Maîtrise avancée de Git et des méthodes de CI/CD.Capacité à interagir au quotidien avec les profils Data/IA/métiers en comprenant les enjeux et contraintes liés à ces typologies de projets.

Atouts appréciés

Expérience concrète avec les graphes de connaissance (Neo4j, Neptune, ArangoDB, etc.)Modélisation de graphes et langages de requête (Cypher, SPARQL)Expérience avec des systèmes IA basés sur des LLM ou des architectures RAGConnaissance des bases de données vectorielles et de la recherche sémantiqueExpérience en environnement SaaS ou multi-tenant

Votre environnement de travail

Collaboration étroite avec les ingénieurs IA, les ingénieurs Data et les équipes produitForte autonomie et responsabilité techniqueAccent mis sur des systèmes robustes en production plutôt que des prototypes

#J-18808-Ljbffr
Entreprise
Plus que pro
Plateforme de publication
WHATJOBS
Offres pouvant vous intéresser
Soyez le premier à postuler aux nouvelles offres
Soyez le premier à postuler aux nouvelles offres
Créez gratuitement et simplement une alerte pour être averti de l’ajout de nouvelles offres correspondant à vos attentes.
* Champs obligatoires
Ex: boulanger, comptable ou infirmière
Alerte crée avec succès