He Wrote the 27-Year-Old Bug Mythos Found. Then Proved Mythos Wasn’t Necessary | Neils Provos | S2E4

He Wrote the 27-Year-Old Bug Mythos Found. Then Proved Mythos Wasn’t Necessary | Neils Provos | S2E4

🎙 Eva Benn 👥 101K 📅 10 août 2026 ⏱ 49 min 👁 6K 📄 entretien 🧭 2026-08-16
Disponible en : Français (actuel) English

Mots-clés

vulnérabilitéIAagentspolitique de sécuritéIronCurtain

Résumé

Dans cet épisode de Security Mondays, Eva Benn interviewe Niels Provos, expert en cybersécurité et créateur d’IronCurtain. Provos revient sur la découverte par Anthropic d’un bug vieux de 27 ans dans OpenBSD, bug qu’il avait lui-même commis en 1998. Plutôt que de s’émerveiller de la performance de Mythos, il a reproduit la découverte avec des modèles commerciaux et open-weight en utilisant un workflow agentique décomposé en étapes. Il démontre ainsi que la découverte de vulnérabilités est un problème d’orchestration, pas un problème de modèle frontalier. Il aborde ensuite la question des refus des modèles et des limites de débit, soulignant que les attaquants sur des modèles open-weight ne subissent pas ces contraintes. Il présente IronCurtain, un framework open-source qui traite les agents IA comme non fiables, en appliquant une politique déterministe basée sur une constitution en anglais. Il discute de l’autorité ambiante et des risques d’injection de prompts. Enfin, il présente son analyse de 70 brèches réelles, montrant que trois contrôles de sécurité (invariants) auraient pu en arrêter 65%. L’épisode se conclut sur les risques de dépendance à l’IA pour les équipes de sécurité.

184 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La valeur des informations est élevée : l’épisode fournit des insights concrets sur la découverte de vulnérabilités par IA, avec une démonstration pratique de la reproduction d’un bug célèbre avec des modèles non-frontaliers. L’argumentation de Provos est solide, appuyée par son expérience et des exemples concrets. Il remet en question l’idée que seuls les modèles frontaliers sont capables de telles découvertes, en montrant qu’un workflow bien orchestré peut suffire. Il introduit également le concept d’invariants de sécurité, avec une analyse chiffrée (65% des brèches évitées). L’argumentation est claire et bien structurée, même si certaines affirmations reposent sur des expériences personnelles non encore publiées.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est bonne : Provos cite des ressources open-source (IronCurtain, Security Blueprints) et des articles sur son site. Il mentionne des travaux d’Anthropic et des analyses de brèches. Les sources sont de qualité, mais certaines sont des publications personnelles non évaluées par des pairs. L’adéquation titre/contenu est bonne : le titre reflète le sujet principal (le bug et la démonstration que Mythos n’était pas nécessaire). Les commentaires (non fournis) ne sont pas analysés.

193 mots

Adéquation titre / contenu

Le titre est accrocheur et reflète bien le contenu : il met en avant la découverte du bug par Mythos et la démonstration de Niels Provos que ce n'était pas nécessaire.

Qualité & fiabilité

8/10

L'entretien est mené avec un expert reconnu (Niels Provos), qui présente des résultats reproductibles et des références à des travaux publiés. Les affirmations sont étayées par des démonstrations pratiques et des analyses de données (70 brèches). La rigueur est bonne, mais certaines affirmations (comme les capacités des modèles) reposent sur des expériences personnelles non encore publiées dans des revues à comité de lecture.

Chapitres

Sources citées

Sources concordantes

  • Anthropic Red Team report — Rapport d'Anthropic mentionnant la découverte du bug OpenBSD par Mythos, que Niels Provos a reproduit.

Références externes

Apport & nouveautés

L’apport original de cet épisode est la démonstration que la découverte de vulnérabilités par IA n’est pas l’apanage des modèles frontaliers, mais peut être réalisée avec des modèles commerciaux ou open-weight grâce à un workflow orchestré. Niels Provos introduit également le concept d’invariants de sécurité, des contrôles déterministes qui éliminent des classes entières d’attaques. Il propose une approche concrète pour sécuriser les agents IA via une politique déterministe (IronCurtain).

Pour aller plus loin :

  • OpenBSD — Système d’exploitation réputé pour sa sécurité, où le bug de 27 ans a été trouvé.
  • Model Context Protocol (MCP) — Protocole standardisé pour intégrer des outils aux agents IA, utilisé par IronCurtain.
  • Prompt injection — Vulnérabilité des systèmes IA, mentionnée dans l’épisode.
  • bcrypt — Fonction de hachage de mots de passe co-créée par Niels Provos.
  • Safe Browsing — Service de Google créé par Niels Provos pour protéger les utilisateurs contre les sites dangereux.

149 mots

Profil radar

Le profil radar montre un contenu équilibré avec des scores élevés en quantité et qualité d'information, ainsi qu'en fiabilité. Le niveau technique est légèrement inférieur, indiquant que le contenu est accessible mais avec des aspects techniques approfondis.

Fiabilité 8/10