Stage Data Scientist - F/H
pp
Fondé en 2019, Chaps
Vision est un éditeur de logiciels en pleine croissance, membre du NEXT40 de la French Tech parmi les 40 start‑ups françaises les plus prometteuses. /pp
Avec 1200 collaborateurs et plus de 1000 clients grands comptes et régaliens, nous avons pour ambition de devenir un leader européen du traitement souverain de la donnée. /pp
Notre objectif est de poursuivre notre développement en renforçant nos équipes pour concevoir, commercialiser, déployer et supporter des produits innovants de plus en plus ambitieux. /pp
Parallèlement, notre engagement social se manifeste à travers la fondation Happy
Cap, adossée au groupe, qui vise à soutenir les enfants atteints de troubles de développement mental et cognitif et leurs familles. /pp
Vous rejoignez l’équipe RD en Intelligence Artificielle de Chaps
Vision, en charge du développement de technologies de pointe autour des LLMs, des agents autonomes et de l’évaluation de systèmes complexes. /pp
Dans un contexte où l’observabilité et l’évaluation des agents IA deviennent critiques, vous contribuerez à la conception d’outils permettant d’analyser leurs traces, détecter les échecs d’exécution et qualifier la qualité des décisions. Votre travail s’appuiera sur l’état de l’art récent en évaluation des agents et LLM. /pulli
Réaliser un état de l’art complet sur les méthodes d’évaluation d’agents et de systèmes LLM. /lili
Concevoir un outil générique capable d’ingérer et d’analyser des traces d’exécution d’agents (actions, logs, états internes). /lili
Produire des métriques actionnables : qualité du raisonnement, bonne utilisation des outils, erreurs d’exécution ou d’intention. /lili
Définir et expérimenter des critères d’évaluation qualitatifs et quantitatifs. /lili(Optionnel) Proposer des méthodes d’automatisation via génération de jeux de tests, self‑play ou simulation. /lili(Optionnel) Utiliser les résultats d’évaluation pour améliorer automatiquement les agents (prompt optimization, Lo
RA…). /lili
Intérêt fort pour les LLMs, agents autonomes, observabilité ou évaluation IA. /lili
Solides compétences en Python. /lili
Connaissances en NLP ou machine learning. /lili
Curiosité, rigueur, autonomie. /lili
Connaissances Linux / bash appréciées. /lili
Carte SWILE : 10€ / jour pris en charge à 60%. /lili
Transport en commun : pris en charge à 50%. /lili
Télétravail : 3 jours/semaine maximum avec une indemnité de 26 euros par mois. /lili
Un entretien téléphonique avec l’un de nos recruteurs techniques pour faire connaissance. /lili
Un échange avec votre futur tuteur pour évaluer vos compétences et discuter du déroulement de votre futur stage. /li /ulpb
Tous nos postes sont ouverts aux personnes en situation de handicap. /b /p /p #J-18808-Ljbffr