EU remote
Stage - AI Engineer - Sécurisation des applications agentic & Red teaming - F/H/N
About this role
Sujet de stage Red Teaming des applications agentiques : évaluation offensive des défenses LLM Sous-titre Vient formaliser les démarches de sécurisation d'agent en production. Le WHY Les agents IA ont des failles comme tout logiciel. Une défense non testée reste une illusion. Ce stage a pour objectif de développer le volet offensif de la sécurité IA : concevoir une Red Team IA dont le rôle est d'attaquer les applications agentiques pour évaluer la robustesse des protections déployées sur les applications et en identifiant leurs failles par des tests offensifs structurés et faire émerger des méthodes & standards de sécurité IA applicables de manière automatisée à tous nos projets.
Les missions Identifier les standards & méthodes existants: recenser et comparer les référentiels (OWASP, etc.), et les outils de red teaming/guardrails Expérimenter sur un cas concret: appliquer ces standards et outils à un cas d'usage représentatif pour valider leur pertinence et leurs limites Permettre à OCTO d'avoir du recul sur ce sujet Outiller la démarche: proposer un playbook opérationnel réutilisable par les missions clients Explorer l'intégration en CI: esquisser comment ces pratiques s'articulent avec les pipelines de CICD Capitaliser: formaliser les livrables et les diffuser en interne Le déroulement du stage Étape 1 - Identification des axes: cartographie des domaines métiers, croisement OWASP LLM Top 10 / Agentic Top 10, priorisation des scénarios d'attaque Étape 2 - Démarche blue team / red team : rôles, rituels, cas d'usage pilotes, protocole de mesure Étape 3 - État de l'art outils : benchmark Guardrails, Promptfoo, Garak, PyRIT, NeMo Guardrails, grille de sélection Étape 4 - Intégration CI : red teaming et audit automatisés en pipeline (lien stage AgentOps), seuils de non-régression, alerting Étape 5 - Architecture de défense : guardrails, monitoring, cut button, règles déterministes, patterns réutilisables Étape 6 - Standards et méthodes : playbook patterns d'attaque/test, grille OWASP/NIST AI RMF/ISO 27001 Étape 7 - Partage interne : restitution à la tribu Data & AI, présentations internes, mise à disposition du playbook et de la grille Stack technique : Python, Git, Linux, Cloud (Scaleway ?), OPS, Réseau, API Rest, Monitoring et Observabilité Vous préparez un BAC+5 et vous êtes à la recherche d'un stage de fin d'études.