Je teste le nouveau Claude (Sonnet, GPTs, Artifacts... BLUFFÉ !)

Je teste le nouveau Claude (Sonnet, GPTs, Artifacts... BLUFFÉ !)

🎙 Ludo Salenne 👥 267K 📅 26 juin 2024 ⏱ 47 min 👁 55K 📄 tutoriel 🧭 2026-08-21
Disponible en : Français (actuel) English

Mots-clés

Claude 3.5 SonnetArtifactsProjectsVision IAComparatif IA

Résumé

Ludo Salenne présente un tutoriel complet sur la mise à jour majeure de Claude AI par Anthropic, sortie le 21 juin 2024. Il commence par une démonstration impressionnante de la fonctionnalité Artifacts, qui permet de prévisualiser en direct des applications web créées par l’IA, comme un jeu Snake. Ensuite, il explore l’interface repensée, les différents modèles (Sonnet 3.5, Opus 3, Haiku) et leurs usages. Il teste la qualité de réponse avec un prompt avancé pour la rédaction d’une fiche de poste, montrant une excellente compréhension contextuelle. La partie vision est mitigée : si Claude identifie correctement une position d’échecs et extrait le texte d’une infographie, il échoue à retrouver Charlie dans une image ‘Où est Charlie ?’, persistant dans son erreur malgré les corrections. Il compare ensuite Claude 3.5 Sonnet à Claude 3 Opus, recommandant Opus pour la rédaction. Il présente les fonctionnalités Projects (équivalent des GPTs) et Artifacts en détail, avec des exemples de création de jeu vidéo et de site web. Enfin, il évoque le Prompt Generator, l’automatisation via des outils tiers, et donne son avis comparatif avec ChatGPT, concluant que Claude est un concurrent sérieux, voire supérieur sur certains points.

193 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La valeur principale réside dans la démonstration pratique et détaillée des nouvelles fonctionnalités de Claude, avec des exemples concrets et reproductibles. L’argumentation est structurée autour de tests successifs, ce qui permet d’évaluer les forces et faiblesses de l’outil. Cependant, l’enthousiasme du créateur est parfois excessif et les benchmarks cités sont ceux fournis par Anthropic, sans vérification indépendante. La comparaison avec ChatGPT est subjective et basée sur des impressions personnelles, mais elle reste honnête et nuancée, reconnaissant les points forts de chaque outil.

Rigueur scientifique, qualité des sources, adéquation du titre

Les sources citées sont principalement les pages officielles d’Anthropic (annonce de Claude 3.5 Sonnet, documentation Projects) et des liens vers ses propres ressources. La rigueur scientifique est limitée : les benchmarks sont repris tels quels, sans analyse critique, et les tests sont empiriques. Le titre est fidèle au contenu, qui est un test pratique et enthousiaste. L’adéquation titre/contenu est bonne, sans exagération notable.

160 mots

Adéquation titre / contenu

Le titre reflète bien le contenu : test pratique et enthousiaste des nouvelles fonctionnalités de Claude, avec une emphase sur l'effet 'bluffant'.

Qualité & fiabilité

7/10

Démonstrations pratiques nombreuses et variées, mais les benchmarks cités proviennent exclusivement de la communication d'Anthropic et ne sont pas contre-vérifiés. Quelques affirmations générales (ex: 'meilleure IA du marché') sont reprises sans esprit critique.

Chapitres

Sources citées

Sources concordantes

Sources discordantes

  • Test 'Où est Charlie ?' — Le test de vision échoue à retrouver Charlie, contredisant les benchmarks de vision annoncés par Anthropic.

Références externes

Apport & nouveautés

La vidéo apporte une démonstration pratique et accessible des nouvelles fonctionnalités de Claude 3.5 Sonnet, notamment Artifacts et Projects, ce qui est utile pour les utilisateurs francophones. Elle met en lumière des cas d’usage concrets (création de jeux, de sites, rédaction) et compare les performances avec ChatGPT. L’originalité réside dans le test de la vision, qui montre des limites intéressantes.

Pour aller plus loin :

  • Claude 3.5 Sonnet - Article Wikipédia — Pour un contexte général sur les modèles Claude.
  • Artifacts - Documentation Anthropic — Pour approfondir la fonctionnalité Artifacts.
  • Benchmarks MMLU — Pour comprendre les benchmarks de compréhension linguistique mentionnés.

101 mots

Profil radar

Le profil radar montre une bonne quantité d'informations et un niveau technique correct, mais une fiabilité globale moyenne due à l'absence de vérification indépendante des benchmarks. La qualité de l'information est bonne pour un tutoriel pratique, mais la rigueur scientifique est limitée.

Fiabilité 6/10

💬 Très positif. Sur les 30 commentaires analysés, les spectateurs expriment une forte appréciation du travail de Ludo Salenne, saluant la clarté, la pédagogie et l'exhaustivité du tutoriel, avec quelques suggestions d'amélioration.