hacking copilot AI (with Tobias Diehl)

hacking copilot AI (with Tobias Diehl)

🎙 John Hammond 👥 2.2M 📅 14 octobre 2025 ⏱ 17 min 👁 24K 📄 entretien 🧭 2026-08-16
Disponible en : Français (actuel) English

Mots-clés

Copilotinjection de promptdata voidsCVEsécurité IA

Résumé

Dans cet entretien, John Hammond reçoit Tobias Diehl, chercheur en sécurité, qui présente ses travaux sur une vulnérabilité de Microsoft Copilot. Diehl explique comment il a découvert qu’il était possible d’injecter des informations dans les réponses de Copilot en exploitant les ‘data voids’, des termes de recherche pour lesquels il n’existe pas encore de résultats fiables. En publiant du contenu malveillant sur GitHub ou des sites web, il a réussi à faire répéter à Copilot des instructions dangereuses, comme des commandes PowerShell ou de fausses CVE, tout en citant des sources légitimes. Il montre des exemples concrets, notamment lors d’un événement de hacking de Microsoft, où il a empoisonné les réponses de Copilot pour d’autres chercheurs. Diehl souligne que Microsoft a partiellement corrigé le problème pour ses propres produits, mais que d’autres entreprises restent vulnérables. Il compare cette attaque à une forme d’ingénierie sociale à grande échelle et insiste sur la nécessité de vérifier les informations fournies par les IA. Il mentionne également avoir testé dix autres solutions d’IA, mais seule Copilot était vulnérable de cette manière. Enfin, il annonce la publication prochaine de ses payloads sur GitHub pour aider la communauté de la sécurité.

195 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La valeur des informations est élevée : il s’agit d’une recherche originale sur une vulnérabilité réelle et actuelle, avec des démonstrations pratiques. L’argumentation est solide, appuyée par des exemples concrets et des références à des concepts académiques comme les ‘data voids’. Le chercheur explique clairement la méthode et les implications, ce qui renforce la crédibilité. Cependant, certaines démonstrations reposent sur des captures d’écran et des observations ponctuelles, ce qui limite la reproductibilité immédiate.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est bonne : le chercheur cite des travaux de Microsoft sur les data voids et fait référence à son propre talk DEF CON. Les sources mentionnées sont pertinentes et vérifiables. Le titre est en adéquation avec le contenu, bien qu’il soit un peu générique. La qualité des sources est correcte, mais on note l’absence de sources tierces indépendantes dans la vidéo elle-même.

153 mots

Adéquation titre / contenu

Le titre est pertinent et reflète bien le contenu de l'entretien, qui se concentre sur le piratage de l'IA Copilot.

Qualité & fiabilité

8/10

L'entretien présente une recherche originale et détaillée sur une vulnérabilité réelle de Microsoft Copilot, avec des démonstrations concrètes et des références à des travaux académiques (data voids). Les informations sont cohérentes et le chercheur est identifiable. Cependant, la démonstration en direct n'est pas entièrement reproductible et certaines affirmations reposent sur des observations ponctuelles.

Moments clés

Sources citées

  • DEF CON talk de Tobias Diehl — Vidéo du talk DEF CON où Tobias présente sa recherche sur la vulnérabilité de Copilot.
  • Profil LinkedIn de Tobias Diehl — Profil LinkedIn du chercheur pour le contacter.
  • Just Hacking Training — Plateforme de formation en cybersécurité mentionnée par John Hammond.
  • Newsletter de John Hammond — Newsletter pour suivre les activités de John Hammond.

Sources concordantes

  • Data void - Wikipedia — Définition et historique du concept de data void, mentionné dans la vidéo.

Références externes

Apport & nouveautés

Cette vidéo apporte un éclairage original sur une vulnérabilité peu connue des systèmes d’IA conversationnelle : l’exploitation des ‘data voids’ pour injecter des informations malveillantes. L’entretien met en lumière une méthode d’attaque concrète et ses implications pour la sécurité, avec des exemples réels. Il souligne également la difficulté de corriger ce type de problème et la nécessité de vérifier les sources.

Pour aller plus loin :

  • Data void - Wikipedia — Concept clé expliqué par Tobias, essentiel pour comprendre la vulnérabilité.
  • Prompt injection - Wikipedia — Technique connexe, souvent confondue avec l’attaque présentée.
  • Microsoft Copilot - Wikipedia — Pour comprendre le fonctionnement de l’outil ciblé.

105 mots

Profil radar

Le profil radar montre une vidéo équilibrée avec des scores élevés en quantité et qualité d'information, ainsi qu'une bonne fiabilité. Le niveau technique est légèrement inférieur, ce qui reflète une vulgarisation accessible tout en restant précis.

Fiabilité 8/10

💬 Sur les 0 commentaires analysés, aucune tendance n'a pu être dégagée.