
Keynote: Cramhole, LaFleur: Indirect Prompt Injection
Mots-clés
Résumé
191 mots
Évaluation critique
Valeur des informations & solidité de l’argumentation
La valeur des informations est élevée pour les professionnels de la sécurité : l’oratrice fournit une analyse claire et structurée des risques liés aux injections indirectes, avec des exemples concrets et des recommandations pratiques. L’argumentation est solide, s’appuyant sur des cas réels (attaque sur Salesforce, fuite de code chez Anthropic) et sur des principes architecturaux éprouvés. La présentation est convaincante, bien que certains points mériteraient d’être approfondis, comme les mécanismes précis de certaines attaques.
Rigueur scientifique, qualité des sources, adéquation du titre
La rigueur scientifique est correcte pour une conférence : l’oratrice cite des exemples et des recherches, mais sans fournir de références détaillées. La qualité des sources est bonne, mais leur traçabilité est limitée. L’adéquation entre le titre et le contenu est bonne, le titre accrocheur reflétant bien le sujet. Les commentaires ne sont pas fournis, donc aucune analyse des tendances du public n’est possible.
153 mots
Adéquation titre / contenu
Le titre, bien que ludique, reflète bien le sujet : l'analogie du 'cram hole' illustre la vulnérabilité des fenêtres de contexte aux injections indirectes.
Qualité & fiabilité
7/10
Exposé d'une experte reconnue en cybersécurité, s'appuyant sur des exemples concrets et des références à des recherches, mais sans citations formelles ni données chiffrées. Le contenu est pédagogique et pragmatique, mais la rigueur scientifique est limitée par l'absence de sources détaillées.
Moments clés
Repères établis par PSI à partir de la transcription : le créateur n'a pas défini de chapitres.
- Introduction et analogie avec le film Dodgeball
- Définition de l'injection directe et indirecte de prompts
- Explication de la fenêtre de contexte comme 'cram hole'
- Exemple d'attaque sur les agents Salesforce
- Présentation des cinq frontières de confiance
- Frontière d'instruction et exemple de Chipotle
- Frontière de connaissance et de récupération
- Frontière de mémoire et exemple personnel
- Frontière d'action et recommandations
- Conclusion et synthèse
Sources citées
- SANS Summits — Lien vers les sommets SANS pour continuer l'apprentissage
Sources concordantes
- OWASP Top 10 for LLM Applications — Liste des risques de sécurité pour les applications LLM, incluant l'injection de prompts.
Apport & nouveautés
L’apport original de cette présentation réside dans la métaphore du ‘cram hole’ pour conceptualiser la fenêtre de contexte comme un espace où toutes les informations sont mélangées sans distinction de confiance, et dans la proposition de cinq frontières de confiance concrètes pour sécuriser les systèmes agentiques. Cette approche architecturale est plus opérationnelle que les discussions théoriques sur les injections de prompts.
Pour aller plus loin :
- Injection de prompt — Article Wikipédia sur les bases de l’injection de prompts.
- OWASP Top 10 for LLM Applications — Référence pour les risques de sécurité des applications LLM.
- Agentic AI — Article Wikipédia sur les systèmes agentiques.
104 mots
Profil radar
Le profil radar montre une bonne couverture des aspects quantitatifs et qualitatifs, avec une fiabilité globale correcte. La quantité d'informations est élevée, mais la qualité et la fiabilité pourraient être améliorées par des références plus précises.