Je laisse ChatGPT voir tout ce que je fais — HALLUCINANT !

Je laisse ChatGPT voir tout ce que je fais — HALLUCINANT !

🎙 Ludo Salenne 👥 267K 📅 13 décembre 2024 ⏱ 18 min 👁 37K 📄 test / démonstration 🧭 2026-08-21
Disponible en : Français (actuel) English

Mots-clés

ChatGPTvisionmode vocalpartage d'écrantest

Résumé

Dans cette vidéo, Ludo Salenne teste la nouvelle fonctionnalité de ChatGPT permettant de partager en temps réel la caméra et l’écran de son téléphone, afin d’interagir avec l’IA sur ce qu’elle voit. Il commence par activer le mode vocal avancé et la caméra, puis fait visiter son studio YouTube à ChatGPT, qui identifie correctement plusieurs objets (trophée, jeu d’échecs, raquettes de tennis de table) mais se trompe sur un ballon de football. Ensuite, il partage son écran pour montrer son profil LinkedIn et demande des conseils d’optimisation ; ChatGPT répond de manière pertinente, mais certaines réponses sont interrompues par un message de modération. L’auteur teste ensuite la résolution d’un problème d’échecs, où ChatGPT échoue, montrant ses limites en matière de raisonnement visuel. Il constate que la fonctionnalité n’est pas disponible sur l’application de bureau ni sur le navigateur web, et qu’elle nécessite un abonnement ChatGPT Team. Enfin, il teste la voix du Père Noël et propose un défi final à ChatGPT pour conclure la vidéo. L’ensemble est présenté de manière dynamique et humoristique, avec des démonstrations concrètes et des avis personnels.

181 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La vidéo apporte une valeur pratique certaine en montrant concrètement les capacités et les limites de la fonctionnalité vision/voix de ChatGPT. Les tests sont variés (reconnaissance d’objets, partage d’écran, résolution de problème) et permettent de se faire une idée précise de l’outil. L’argumentation est principalement basée sur l’expérience personnelle de l’auteur, qui partage ses impressions et ses doutes. Cependant, l’analyse reste superficielle : il ne propose pas de méthodologie rigoureuse, ne compare pas systématiquement avec d’autres outils (bien qu’il mentionne une vidéo sur Gemini 2.0), et ne fournit pas de données chiffrées. La démonstration est néanmoins honnête, car il montre aussi les échecs de l’IA, ce qui renforce la crédibilité de son retour.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est limitée : il s’agit d’un test utilisateur, non d’une étude contrôlée. L’auteur ne cite aucune source externe, mais il mentionne des vidéos de sa propre chaîne et des liens vers ses formations. La qualité des sources est donc faible d’un point de vue académique, mais acceptable pour un contenu de vulgarisation. Le titre est bien choisi, car il reflète l’enthousiasme de l’auteur et correspond au contenu. Les commentaires sont très positifs, avec des éloges sur la clarté et l’humour, et certains soulignent la comparaison avec Gemini 2.0. Aucune critique négative majeure n’est présente.

225 mots

Adéquation titre / contenu

Le titre est accrocheur et reflète bien le contenu : l'auteur teste la fonctionnalité de vision en direct de ChatGPT et exprime son étonnement.

Qualité & fiabilité

7/10

Démonstration pratique de la fonctionnalité vision/voix de ChatGPT, avec des tests concrets et des limites identifiées. L'auteur est un vulgarisateur reconnu, mais la vidéo est essentiellement un retour d'expérience subjectif, sans analyse technique approfondie ni sources externes.

Chapitres

Sources citées

Sources concordantes

Apport & nouveautés

La vidéo apporte un retour d’expérience concret sur une fonctionnalité récente de ChatGPT, ce qui est utile pour les utilisateurs francophones. Elle met en évidence les forces (reconnaissance d’objets, fluidité) et les faiblesses (raisonnement visuel, modération) de l’outil. Cependant, elle ne présente pas de nouveauté conceptuelle majeure, mais plutôt une démonstration pratique.

Pour aller plus loin :

  • ChatGPT (OpenAI) — Site officiel pour suivre les évolutions.
  • Vision par ordinateur — Concepts de base de la vision artificielle.
  • Modèle de langage multimodal — Notion de modèles traitant texte et image.
  • Apprentissage par renforcement — Technique utilisée pour entraîner les modèles à interagir.

101 mots

Profil radar

Le profil radar montre une vidéo équilibrée, avec des scores modérés sur tous les axes. La quantité d'information est correcte pour une démonstration, la qualité est bonne, le niveau technique est accessible, et la fiabilité est acceptable pour un retour d'expérience.

Fiabilité 7/10

💬 Très positif. Sur les 30 commentaires analysés, les spectateurs expriment leur enthousiasme pour la démonstration, saluent la clarté et l'humour, et certains comparent avec Gemini 2.0, notant la supériorité de ChatGPT.