Data Scientist IA Générative - Cybersécurité N3 - Toulouse H/F - Espace Freelance
- Indépendant
- Espace Freelance
Les missions du poste
Le besoinData Scientist IA Générative / Cybersécurité (N3) - ToulouseBonjour,Pour le compte d'un grand groupe, nous recherchons un Data Scientist N3 spécialisé en IA Générative et LLM, afin d'intervenir au sein d'un SOC (Security Operations Center) sur un projet d'intégration d'IA pour l'analyse de menaces et l'assistance aux analystes cybersécurité.Contexte de la missionLe consultant participera à la conception et à l'amélioration de modèles de langage spécialisés en cybersécurité, avec pour objectif de réduire les hallucinations, améliorer la qualité des réponses et mettre en place des dispositifs d'évaluation avancés.Principales missions* Fine-tuning de LLM open source (Llama, Mistral, Qwen, etc.)* Structuration et préparation des datasets d'entraînement* Mise en oeuvre des techniques d'alignement et de Reinforcement Learning pour limiter les hallucinations* Conception de protocoles d'évaluation et benchmarking des modèles* Collaboration avec les équipes R\&D Cyber et SOCCompétences impératives* Fine-tuning de modèles (LoRA, QLoRA)* Frameworks : Unsloth, Axolotl ou TRL* Structuration des données et formats ChatML / Alpaca* Alignement de modèles : DPO, GRPO, PPO* Frameworks d'alignement : TRL, verl ou OpenRLHF* Évaluation de LLM : MMLU, GSM8K, Evaluation Arena, LMSYS, LLM-as-a-Judge* Python et PyTorch* Français courant et anglais professionnelCompétences appréciées* Connaissances cybersécurité (SOC, MITRE ATT\&CK, analyse de logs, détection d'intrusions)* MLOps : Hugging Face Hub, vLLM, Ollama, TritonProfil recherché* Data Scientist confirmé/senior (N3)* Solide expérience sur l'entraînement, l'alignement et l'évaluation de modèles de langage* Rigueur scientifique, autonomie et capacité à vulgariser des sujets IA auprès d'équipes cybersécuritéLocalisation : ToulouseProfil : Data Scientist N3Démarrage : ASAPMerci de me faire parvenir rapidement votre CV actualisé ainsi que votre TJM, votre disponibilité et votre localisation.
Le profil recherché
Profil recherchéCompétences impérativesFine-tuning de modèles (LoRA, QLoRA)Frameworks : Unsloth, Axolotl ou TRLStructuration des données et formats ChatML / AlpacaAlignement de modèles : DPO, GRPO, PPOFrameworks d'alignement : TRL, verl ou OpenRLHFÉvaluation de LLM : MMLU, GSM8K, Evaluation Arena, LMSYS, LLM-as-a-JudgePython et PyTorchFrançais courant et anglais professionnel? Compétences appréciéesConnaissances cybersécurité (SOC, MITRE ATT&CK, analyse de logs, détection d'intrusions)MLOps : Hugging Face Hub, vLLM, Ollama, Triton
Compétences requises
- Python
- Anglais
- Intelligence artificielle
- Autonomie
- Français
- Cyber-sécurité