Icône du lab

Prompt Injection : jailbreaker un assistant IA

Jailbreakez un vrai chatbot LLM, contournez ses garde-fous et capturez les flags

Difficile Mis à jour le 01 sept. 2026 Solution (Pro)
Prompt Injection LLM Security AI Red Teaming Jailbreak OWASP LLM Top 10 Guardrail Bypass System Prompt Leakage Excessive Agency

Apprenez à jailbreaker une IA en injectant des prompts dans un vrai modèle de langage pour fuiter son system prompt caché et abuser de son outil interne. Un lab pratique OWASP LLM01 et LLM06 à résoudre depuis le Terminal d'attaque avec curl.

2
Flags
700
XP
60%
Taux de Réussite

Qu'est-ce que la prompt injection ?

La prompt injection est le premier risque de sécurité des applications à base de grands modèles de langage (OWASP LLM01). Elle survient lorsqu'une entrée utilisateur non fiable atteint un modèle qui porte aussi des instructions de confiance, et que l'attaquant façonne cette entrée pour outrepasser ces instructions : fuiter des secrets, ignorer les règles de sécurité ou déclencher des actions que le développeur n'avait jamais prévues. Apprendre à jailbreaker une IA dans un cadre sûr et légal est le moyen le plus rapide de comprendre pourquoi cette classe de bugs est si difficile à éradiquer.

Comment fonctionne ce lab

Vous discutez avec Qwenly, un assistant de support client propulsé par un vrai modèle de langage exécuté en local. Rien n'est simulé ici : un modèle authentique lit un system prompt et applique son propre entraînement de sécurité, et une surcouche ajoute un filtre en entrée et un filtre en sortie, exactement comme les équipes en production greffent des garde-fous sur un LLM. En travaillant entièrement depuis le Terminal d'attaque avec curl sur son endpoint /api/chat, vous injecterez des prompts pour fuiter le flag utilisateur caché dans son system prompt, puis vous convaincrez son outil interne de base de connaissances de lire un fichier bien en dehors du périmètre qui lui a été confié (le flag root). Les astuces évidentes sont bloquées : il faut donc trouver ce qu'un petit modèle peut, ou non, se laisser convaincre de faire.

Pourquoi s'entraîner au jailbreak d'IA ?

Chaque entreprise qui livre une fonctionnalité d'IA se défend désormais contre ces attaques précises. La prompt injection et l'agentivité excessive (OWASP LLM06) sont derrière des incidents réels comme l'exploit zero-click EchoLeak de 2025 contre Microsoft 365 Copilot. Les produits de garde-fous, le durcissement du system prompt et les filtres de sortie sont les défenses standard, et ce lab pratique vous montre comment elles échouent du côté de l'attaquant. S'entraîner à la prompt injection sur HackerDNA développe l'instinct de repérer un filtre d'entrée faible, de remarquer quand la sortie d'un modèle peut passer sous un redacteur naïf, et de comprendre que donner un outil à un LLM confie cette capacité à quiconque peut lui parler.

Ce que vous apprendrez

  • Exploiter la prompt injection pour outrepasser les consignes de sécurité d'un assistant IA
  • Fuiter un system prompt caché malgré un garde-fou en entrée et un en sortie
  • Contourner un filtre de sortie par injection de délimiteurs plutôt que par encodage
  • Abuser de l'agentivité excessive d'un outil LLM pour lire des fichiers hors de son périmètre
  • Enchaîner une traversée de chemin via l'outil de lecture de fichiers d'un agent IA
  • Relier l'attaque à OWASP LLM01 prompt injection et LLM06 excessive agency

Prérequis

HTTP basics curl command line Text encodings Basic LLM concepts Curiosity

Prêt à hacker ce lab ?

Créez un compte gratuit et pratiquez la cybersécurité.

Commencer - C'est gratuit
Commencez Votre Défi
~1-2 min de configuration
Serveur dédié
Instance privée
Puissance standard
Nouveau ? Voici comment faire
1
Cliquez sur "Start Lab" ci-dessus Vous obtiendrez votre propre machine avec une adresse IP
2
Explorez la cible Ouvrez l'IP dans votre navigateur et cherchez des vulnérabilités
3
Trouvez et soumettez les flags Les flags sont des textes secrets cachés dans le système - collez-les ci-dessous pour marquer des XP

Prêt à hacker ce lab?

Créez un compte gratuit pour démarrer votre propre serveur dédié, soumettre des flags et gagner des XP au classement.

Commencer à Hacker Gratuitement
23 000+ Hackers 100+ Labs & Cours Gratuit
Commencer Gratuitement