Hacker les GPTs sur ChatGPT est TROP facile — Voici comment

Hacker les GPTs sur ChatGPT est TROP facile — Voici comment

🎙 Ludo Salenne 👥 267K 📅 27 décembre 2023 ⏱ 22 min 👁 21K 📄 tutoriel 🧭 2026-08-21
Disponible en : Français (actuel) English

Mots-clés

GPTsinjection de promptsécuritéChatGPThacking

Résumé

Cette vidéo de Ludo Salenne, publiée en décembre 2023, est un tutoriel pratique qui démontre comment extraire les instructions et les fichiers de configuration des GPTs personnalisés sur ChatGPT. L’auteur commence par expliquer le fonctionnement des GPTs, puis présente plusieurs techniques d’injection de prompt : la demande de verbatim des instructions, l’utilisation de blocs de code pour obtenir plus de détails, et l’accès aux fichiers via le répertoire /mnt/data. Il montre ensuite comment contourner les protections d’un GPT sécurisé en utilisant des reformulations astucieuses, comme demander de formater le contenu en liste à puces. La vidéo souligne que la sécurité des GPTs est relative et qu’aucune protection n’est infaillible. Enfin, Ludo Salenne propose une méthode de sécurisation basée sur des instructions explicites interdisant la divulgation, et renvoie à un article académique sur les attaques par injection de prompt. Le ton est pédagogique, avec des démonstrations en direct, et l’auteur insiste sur l’importance de protéger ses données.

156 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La valeur principale de cette vidéo réside dans sa démonstration pratique et reproductible des failles de sécurité des GPTs. L’auteur montre concrètement, étape par étape, comment extraire des informations sensibles, ce qui est très instructif pour les créateurs de GPTs. L’argumentation est solide car elle s’appuie sur des exemples réels et sur un document académique (arXiv 2302.05733) qui référence les techniques d’injection de prompt. Cependant, l’auteur exagère quelque peu en affirmant qu’il est possible de hacker n’importe quel GPT, alors qu’il admet lui-même que certaines protections peuvent résister. La démonstration est convaincante, mais la généralisation est abusive. La vidéo a une valeur pédagogique certaine, mais elle manque de nuances sur les limites des techniques présentées.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est moyenne. L’auteur cite un article académique (arXiv 2302.05733) qui est une référence reconnue sur les attaques par injection de prompt, ce qui apporte une certaine crédibilité. Cependant, la vidéo ne fournit pas de références supplémentaires et s’appuie principalement sur des démonstrations empiriques. Le titre est accrocheur et correspond au contenu, mais il est un peu racoleur. L’adéquation titre/contenu est bonne, mais la note globale n’est pas affectée de manière significative. Les sources citées sont limitées, mais l’article académique est pertinent. La vidéo aurait gagné à citer d’autres travaux sur la sécurité des LLM.

227 mots

Adéquation titre / contenu

Le titre est accrocheur et correspond au contenu : la vidéo montre effectivement comment extraire les instructions et fichiers de GPTs via des injections de prompt.

Qualité & fiabilité

6/10

La vidéo est un tutoriel pratique qui démontre des techniques d'injection de prompt sur les GPTs. Elle s'appuie sur une démonstration concrète et renvoie à un article académique (arXiv 2302.05733) pour étayer le propos. Cependant, elle ne fournit pas de preuves formelles de l'efficacité des techniques sur tous les GPTs, et certaines affirmations sont exagérées ("hacker N'IMPORTE QUEL GPT"). La fiabilité est moyenne, car les méthodes sont réelles mais la généralisation est abusive.

Chapitres

Sources citées

Sources concordantes

Apport & nouveautés

Cette vidéo apporte une contribution pratique en montrant des techniques concrètes d’extraction d’informations depuis les GPTs, ce qui est peu documenté dans les médias grand public. Elle vulgarise des concepts de sécurité des LLM et propose une méthode de protection simple. L’originalité réside dans la démonstration en direct et la reproductibilité des attaques.

Pour aller plus loin :

116 mots

Profil radar

Le profil radar montre des scores modérés, avec une quantité d'information correcte mais une fiabilité globale limitée. La vidéo est utile pour comprendre les risques, mais elle manque de rigueur scientifique et de sources variées.

Fiabilité 5/10