Data Scientist IA Générative - Cybersécurité N3 - Toulouse H/F
Espace Freelance
- Toulouse - 31
- Indépendant
- Bac +5
- Services aux Entreprises
Les compétences pour ce job
Détail du poste
Le besoin
Data Scientist IA Générative / Cybersécurité (N3) - Toulouse
Bonjour,
Pour le compte d'un grand groupe, nous recherchons un Data Scientist N3 spécialisé en IA Générative et LLM, afin d'intervenir au sein d'un SOC (Security Operations Center) sur un projet d'intégration d'IA pour l'analyse de menaces et l'assistance aux analystes cybersécurité.
Contexte de la mission
Le consultant participera à la conception et à l'amélioration de modèles de langage spécialisés en cybersécurité, avec pour objectif de réduire les hallucinations, améliorer la qualité des réponses et mettre en place des dispositifs d'évaluation avancés.
Principales missions
* Fine-tuning de LLM open source (Llama, Mistral, Qwen, etc.)
* Structuration et préparation des datasets d'entraînement
* Mise en oeuvre des techniques d'alignement et de Reinforcement Learning pour limiter les hallucinations
* Conception de protocoles d'évaluation et benchmarking des modèles
* Collaboration avec les équipes R\&D Cyber et SOC
Compétences impératives
* Fine-tuning de modèles (LoRA, QLoRA)
* Frameworks : Unsloth, Axolotl ou TRL
* Structuration des données et formats ChatML / Alpaca
* Alignement de modèles : DPO, GRPO, PPO
* Frameworks d'alignement : TRL, verl ou OpenRLHF
* Évaluation de LLM : MMLU, GSM8K, Evaluation Arena, LMSYS, LLM-as-a-Judge
* Python et PyTorch
* Français courant et anglais professionnel
Compétences appréciées
* Connaissances cybersécurité (SOC, MITRE ATT\&CK, analyse de logs, détection d'intrusions)
* MLOps : Hugging Face Hub, vLLM, Ollama, Triton
Profil recherché
* Data Scientist confirmé/senior (N3)
* Solide expérience sur l'entraînement, l'alignement et l'évaluation de modèles de langage
* Rigueur scientifique, autonomie et capacité à vulgariser des sujets IA auprès d'équipes cybersécurité
Localisation : Toulouse
Profil : Data Scientist N3
Démarrage : ASAP
Merci de me faire parvenir rapidement votre CV actualisé ainsi que votre TJM, votre disponibilité et votre localisation.
Le profil recherché
Profil recherché
Compétences impératives
Fine-tuning de modèles (LoRA, QLoRA)
Frameworks : Unsloth, Axolotl ou TRL
Structuration des données et formats ChatML / Alpaca
Alignement de modèles : DPO, GRPO, PPO
Frameworks d'alignement : TRL, verl ou OpenRLHF
Évaluation de LLM : MMLU, GSM8K, Evaluation Arena, LMSYS, LLM-as-a-Judge
Python et PyTorch
Français courant et anglais professionnel
⭐ Compétences appréciées
Connaissances cybersécurité (SOC, MITRE ATT&CK, analyse de logs, détection d'intrusions)
MLOps : Hugging Face Hub, vLLM, Ollama, Triton
Infos complémentaires
Publiée le 29/07/2026 - Réf : d6baaaf0dc2ffa42efd7d035ddbe12fe