I Had Fable 5.1 and 5 Build Me the Same App

I Had Fable 5.1 and 5 Build Me the Same App

J'ai demandé à Fable 5.1 et 5 de me créer la même application

🎙 Nate Herk 👥 980K 📅 3 septembre 2026 ⏱ 12 min 👁 0 📄 revue d'actualité 🧭 2026-09-04
Disponible en : Français (actuel) English

Mots-clés

Fable 5Fable 5.1comparaisoncoûttemps de développement

Résumé

Dans cette vidéo, Nate Herk compare les performances de deux versions d’un agent IA de développement, Fable 5 et Fable 5.1, en leur donnant exactement le même prompt pour créer une application de visualisation de workflows d’intervention. Il détaille le prompt utilisé, qui délègue la majeure partie du travail à des sous-agents Opus et Sonnet, puis présente les deux applications côte à côte, sans révéler laquelle est laquelle. Il effectue ensuite un test en aveugle avec un autre outil, Codeex, qui attribue une note légèrement supérieure à Fable 5.1 (9.1 contre 8.4). Cependant, l’analyse des coûts et du temps de développement montre que Fable 5.1 a coûté plus du double (1200$ contre 500$) et a pris trois fois plus de temps (36 heures contre 12 heures). La répartition des modèles utilisés est également très différente : Fable 5.1 a utilisé Opus pour 57% du travail, tandis que Fable 5 a utilisé Sonnet pour 80%. Malgré la qualité supérieure de l’application produite par Fable 5.1, l’auteur conclut que Fable 5 est le gagnant de ce test, car la différence de qualité ne justifie pas un surcoût de 700$. Il nuance toutefois son jugement en précisant qu’il préfère Fable 5.1 pour ses tâches quotidiennes.

202 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La valeur principale de cette vidéo réside dans son approche comparative concrète et chiffrée. L’auteur ne se contente pas d’opinions subjectives : il met en place un protocole de test en aveugle, mesure les coûts et les temps de développement, et analyse la répartition des modèles utilisés. L’argumentation est structurée et étayée par des données visuelles (captures d’écran, graphiques). Cependant, la méthodologie manque de rigueur scientifique : le prompt n’est pas entièrement divulgué, les conditions d’exécution ne sont pas contrôlées (variabilité possible des modèles), et les résultats ne sont pas reproductibles. L’auteur reconnaît lui-même certaines incohérences dans les données (ex : nombre de tokens d’entrée). La conclusion, qui privilégie le rapport coût/efficacité, est logique mais repose sur une évaluation subjective de la qualité des applications.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est moyenne. L’auteur s’appuie sur son expérience personnelle et des tests empiriques, mais ne fournit aucune source externe vérifiable. Les liens de la description sont principalement des liens promotionnels vers ses propres ressources (playbook, outils sponsorisés). Aucune référence à la documentation officielle de Fable ou à des études indépendantes. L’adéquation entre le titre et le contenu est bonne : le titre annonce clairement une comparaison, et la vidéo tient cette promesse. Cependant, le titre pourrait être plus précis en mentionnant le critère de coût, qui est central dans l’analyse.

232 mots

Adéquation titre / contenu

Le titre reflète bien le contenu : comparaison directe de deux versions d'un même agent IA sur une même tâche.

Qualité & fiabilité

6/10

Test comparatif empirique avec protocole clair (même prompt, test en aveugle), mais méthodologie non détaillée, résultats non reproductibles et sources non vérifiables.

Chapitres

Sources citées

Sources concordantes

Sources discordantes

  • Aucune source discordante identifiée — Aucune source externe ne contredit directement les affirmations de la vidéo, mais l'absence de sources vérifiables ne permet pas de confirmer les résultats.

Apport & nouveautés

L’apport original de cette vidéo est de fournir une comparaison concrète et chiffrée de deux versions d’un agent IA de développement, en se concentrant sur des critères économiques (coût, temps) souvent négligés dans les démonstrations. Elle met en lumière l’importance de la délégation à des sous-agents et l’impact du choix des modèles sur le coût final.

Pour aller plus loin :

102 mots

Profil radar

Le profil radar montre une vidéo équilibrée avec des scores modérés sur tous les axes. La quantité d'information est correcte, la qualité est moyenne, le niveau technique est accessible, et la fiabilité est limitée par le manque de sources externes.

Fiabilité 5/10