Data Scientist - Évaluation & Sécurisation des Llms Secteur Financier H/F

LeHibou

  • Paris - 75
  • Indépendant
  • Télétravail partiel
  • 3 ans
  • Bac +5
  • Services aux Entreprises
Lire dans l'app

Les compétences pour ce job

Détail du poste

Le besoin

Type de mission : Freelance Secteur : Banque / Services financiers Localisation : Montreuil - 50% télétravail Démarrage : Dès que possible Durée : 3 ans

Contexte de la mission

Dans le cadre du déploiement de l'Intelligence Artificielle générative au sein d'un grand groupe bancaire, nous recherchons un Data Scientist spécialisé dans l'évaluation des modèles de langage (LLM). La mission vise à structurer et mettre en oeuvre un cadre rigoureux d'évaluation, de benchmark et de sécurisation des LLM utilisés ou envisagés pour des cas d'usage métiers : assistance aux collaborateurs, analyse documentaire, génération de contenus, aide à la décision et automatisation de processus.

Missions principales

Évaluation des LLM Définir les protocoles et métriques d'évaluation adaptés aux cas d'usage bancaires (exactitude, pertinence, factualité, robustesse, conformité). Mettre en place des jeux de tests représentatifs, documenter les résultats et formuler des recommandations.

Benchmark comparatif Concevoir et conduire des benchmarks entre plusieurs modèles LLM (propriétaires, open source, internes). Comparer les modèles selon des critères de performance, coût, latence, sécurité et conformité. Produire des rapports exploitables par les équipes métiers, IT, sécurité et conformité.

Red teaming et sécurité Définir et exécuter des scénarios de red teaming adaptés aux risques de l'IA générative : prompt injection, jailbreak, hallucination, data leakage, biais, toxicité. Analyser les vulnérabilités détectées et proposer des mesures de mitigation en collaboration avec les équipes sécurité, risques et conformité.

Industrialisation Mettre en place des pipelines d'évaluation automatisée, construire des datasets internes anonymisés, définir des référentiels de métriques et contribuer à l'intégration des résultats dans les outils de gouvernance IA.

Le profil recherché

Profil recherché

Expérience : 5 ans minimum en Data Science, dont au moins 2 ans sur des sujets d'IA générative et d'évaluation de LLM.

Compétences techniques attendues

  • Maîtrise des grands modèles de langage : GPT, Claude, Mistral, LLaMA et équivalents

  • Expérience en évaluation de modèles NLP : métriques automatiques et évaluation humaine

  • Connaissance des frameworks d'évaluation : RAGAS, DeepEval, Giskard, LangChain, LlamaIndex

  • Pratique du red teaming appliqué à l'IA générative

  • Maîtrise de Python, des notebooks et des pipelines de données

  • Connaissance des architectures RAG, du fine-tuning et des techniques de quantization

Compétences transverses

  • Capacité à travailler avec des équipes pluridisciplinaires (métiers, sécurité, conformité, risques)

  • Rigueur méthodologique et capacité à documenter et restituer des résultats complexes à des interlocuteurs non techniques

  • Sensibilité aux enjeux réglementaires du secteur bancaire, appréciée

Livrables attendus

Cadre méthodologique d'évaluation des LLM, protocoles de test, jeux de données documentés, corpus de prompts adversariaux, rapports de benchmark et d'évaluation, analyses de risques, recommandations de mitigation, tableaux de bord de suivi, scripts et pipelines d'évaluation automatisée.

Cette mission s'adresse à un profil senior, à l'aise dans un environnement exigeant, capable d'autonomie et de conseil auprès des parties prenantes.

Infos complémentaires

Taux journalier :650.css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(--chakra-space-1-5);padding-inline-start:var(--chakra-space-1-5);-webkit-padding-end:var(--chakra-space-1-5);padding-inline-end:var(--chakra-space-1-5);text-transform:none;font-size:var(--chakra-fontSizes-xs);border-radius:var(--chakra-radii-md);font-weight:var(--chakra-fontWeights-semibold);background:var(--chakra-colors-success-200);color:var(--chakra-colors-success-700);box-shadow:var(--badge-shadow);padding:4px 6px;--badge-bg:var(--chakra-colors-success-100);--badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{--badge-bg:rgba(226, 243, 232, 0.16);--badge-color:var(--chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(--chakra-colors-rythm-600);}

Publiée le 24/07/2026 - Réf : a662e14c47b996cd3140819cd277225d

Postuler
Créez votre compte
Hellowork et postulez

sur le site du partenaire !

Voir plus d'offres
Les sites
L'emploi
  • Offres d'emploi par métier
  • Offres d'emploi par ville
  • Offres d'emploi par entreprise
  • Offres d'emploi par mots clés
L'entreprise
  • Qui sommes-nous ?
  • On recrute
  • Accès client
Les apps
Nous suivre sur :
Informations légales CGU Politique de confidentialité Gérer les traceurs Accessibilité : non conforme Aide et contact