
J'ai testé GPT-5 : vous aviez raison d'être sceptiques ...
Mots-clés
Résumé
162 mots
Évaluation critique
Valeur des informations & solidité de l’argumentation
La valeur principale réside dans la démonstration pratique et factuelle : chaque test est montré avec le prompt exact et le résultat, ce qui permet au spectateur de juger par lui-même. L’argumentation est solide car elle s’appuie sur des exemples concrets et variés, couvrant différents aspects du développement (jeu, application, outil). L’auteur évite le parti pris en montrant aussi les réussites de GPT-5, ce qui renforce la crédibilité. Cependant, la méthodologie n’est pas parfaitement rigoureuse : pas de répétition des tests pour vérifier la reproductibilité, pas de contrôle des versions exactes des modèles, et certains tests sont subjectifs (qualité graphique). L’argument principal sur l’instabilité de GPT-5 est bien étayé par les résultats contrastés, mais il reste spéculatif sur la cause (routeur).
Rigueur scientifique, qualité des sources, adéquation du titre
La rigueur scientifique est moyenne : les tests sont reproductibles (prompts fournis), mais l’auteur ne cite aucune source externe, ni documentation officielle, ni études. Il se base uniquement sur son expérience. La qualité des sources est donc faible, mais l’honnêteté de la démarche (montrer les échecs) compense. L’adéquation titre/contenu est bonne : le titre annonce un test sceptique, et la vidéo confirme que GPT-5 déçoit sur plusieurs points. Les commentaires montrent que le public apprécie l’objectivité, mais certains regrettent le manque de tests sur des usages non-code.
223 mots
Adéquation titre / contenu
Le titre reflète bien le contenu : un test critique de GPT-5, avec une conclusion sceptique.
Qualité & fiabilité
7/10
Test comparatif factuel avec prompts et résultats montrés, mais méthodologie non standardisée (pas de répétitions, pas de contrôle des versions) et absence de sources externes.
Moments clés
Repères établis par PSI à partir de la transcription : le créateur n'a pas défini de chapitres.
- Introduction : présentation du test comparatif de GPT-5.
- Test 1 : énigme logique, GPT-5 répond correctement mais sans détail.
- Test 2 : jeu Mario, GPT-5 produit un jeu jouable mais graphiquement simple.
- Test 3 : Minecraft, GPT-5 échoue (pas de contrôle de la vue).
- Test 4 : tableur, GPT-5 échoue (erreur au lancement).
- Test 5 : synthétiseur musical, GPT-5 réussit partiellement.
- Test 6 : éditeur de shaders, GPT-5 produit un rendu animé mais limité.
- Test 7 : jeu de course 3D, GPT-5 est le seul à réussir.
- Test 8 : planificateur de repas, GPT-5 échoue.
- Conclusion : GPT-5 est instable, bon sur certains projets créatifs mais mauvais sur des applications concrètes.
Sources citées
- Newsletter Vision IA — Lien vers la newsletter mentionnée dans la description.
- Formation IA Vision IA — Lien vers la formation proposée par la chaîne.
Sources concordantes
- Commentaires de la vidéo — Plusieurs commentaires rapportent des expériences similaires de déception avec GPT-5.
Sources discordantes
- Commentaires de la vidéo — Certains commentaires disent avoir une bonne expérience avec GPT-5, ce qui contraste avec les échecs montrés.
Apport & nouveautés
L’apport original est de fournir un test comparatif concret et transparent de GPT-5, en montrant les prompts et les résultats, ce qui est rare dans les revues d’actualité. La vidéo met en évidence l’instabilité de GPT-5, un point souvent débattu mais rarement démontré par des exemples aussi variés. Elle aide les utilisateurs à choisir le modèle selon leurs besoins, en montrant que GPT-5 n’est pas le meilleur partout.
Pour aller plus loin :
- Routeur de modèles (LLM routing) — Concept clé pour comprendre l’instabilité de GPT-5.
- Vibe coding — Pratique de développement itératif avec l’IA, mentionnée dans la vidéo.
- Benchmark SWE-bench — Référence pour évaluer les capacités de codage des LLM.
111 mots
Profil radar
Le profil radar montre une bonne quantité d'information et une qualité correcte, mais une fiabilité moyenne et un niveau technique modéré. Cela reflète une vidéo riche en exemples mais manquant de rigueur méthodologique.
💬 Équilibré. Sur les 30 commentaires analysés, le public est partagé : certains expriment leur déception vis-à-vis de GPT-5, d'autres apprécient l'objectivité du test, et quelques-uns demandent plus de tests sur des usages non-code.