Tech Lead Backend Python - AI Services / LLM - Freelance (H/F)
CONTEXTE
Dans le cadre de la construction d'une plateforme IA européenne destinée aux professionnels du droit, l'équipe AI Services recherche un profil senior capable de développer et d'industrialiser les services permettant aux différents produits du groupe d'exploiter des modèles de langage.
La mission porte principalement sur la couche Backend LLM : exposition des capacités IA, orchestration, streaming des réponses et mise en production de services performants et fiables.
MISSIONS PRINCIPALES
*
Concevoir et développer des APIs Python permettant d'exposer les capacités IA aux différents produits.
*
Intégrer et orchestrer plusieurs fournisseurs et modèles LLM.
*
Mettre en place le streaming des réponses et les traitements asynchrones.
*
Développer des mécanismes de function calling, tools et agents IA.
*
Participer à l'intégration des pipelines RAG et des services de Retrieval.
*
Optimiser les performances, la latence et les coûts d'utilisation des modèles.
*
Mettre en œuvre les mécanismes de résilience : timeouts, retries, fallbacks et circuit breakers.
*
Garantir la sécurité, la traçabilité et l'isolation des données.
*
Définir les contrats d'API, leur versioning et leur documentation.
*
Mettre en place l'observabilité : logs, métriques, traces, consommation de tokens et suivi des coûts.
*
Réaliser les revues de code et accompagner les développeurs sur les bonnes pratiques Python et IA.
*
Contribuer aux choix d'architecture et à l'industrialisation du socle AI Services.
ENVIRONNEMENT TECHNIQUE
*
Backend : Python 3.11+, Fast
API, Starlette, Pydantic, Uvicorn
*
Asynchrone : asyncio, httpx, Celery
*
Streaming : SSE, Web
Sockets
*
IA : Open
AI, Azure Open
AI, Mistral, AWS Bedrock
*
Orchestration : Lang
Chain, Lang
Graph, function calling, agents et tools
*
Data & Retrieval : Open
Search, Weaviate, Postgre
SQL, pgvector, Redis
*
Messaging : Kafka
*
Cloud : AWS et/ou Azure
*
Industrialisation : Docker, Kubernetes, CI/CD
*
Tests : Pytest, pytest-asyncio
PROFIL RECHERCHÉ
*
Expérience confirmée en développement Backend Python sur des services en production.
*
Maîtrise de Fast
API et de la programmation asynchrone avec asyncio.
*
Expérience concrète dans l'intégration de LLM en production.
*
Maîtrise du streaming, de la concurrence et des traitements distribués.
*
Bonne compréhension des architectures RAG, des tools et des agents IA.
*
Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.
*
Expérience dans la conception et l'exploitation d'APIs critiques.
*
Bonne culture engineering : tests, versioning, qualité du code et observabilité.
*
Capacité à rester très opérationnel dans le développement.
*
Anglais professionnel dans un contexte international.
QUALITÉS ATTENDUES
*
Autonomie et forte capacité d'exécution.
*
Leadership technique et pédagogie.
*
Rigueur sur la qualité, la sécurité et la fiabilité.
*
Sensibilité produit et compréhension des besoins des équipes consommatrices.
*
Capacité à vulgariser des sujets techniques complexes.
*
Esprit d'innovation et veille active sur l'écosystème Gen
AI.
POINTS INDISPENSABLES
Le profil doit pouvoir démontrer une expérience réelle sur :
*
des APIs Python/Fast
API en production ;
*
l'asynchronisme et le streaming de réponses LLM ;
*
l'intégration de modèles de langage dans des services critiques ;
*
la performance, la résilience et l'observabilité ;
*
une contribution directe et régulière au code.
Une expérience en Go ou Java constitue un plus.