New Open Source Qwen 397B BEATS GLM 5.1 & Claude? 🤯 | Nex N2 Pro TESTED

New Open Source Qwen 397B BEATS GLM 5.1 & Claude? 🤯 | Nex N2 Pro TESTED

Le nouveau Qwen 397B open source SURPASSE GLM 5.1 et Claude ? 🤯 | Nex N2 Pro TESTÉ

🎙 xCreate 👥 26K 📅 7 juin 2026 ⏱ 13 min 👁 10K 📄 revue d'actualité 🧭 2026-09-09
Disponible en : Français (actuel) English

Mots-clés

Qwen 397BNex N2 ProGLM 5.1Claudeopen source

Résumé

Cette vidéo de la chaîne xCreate présente un test du modèle Nex N2 Pro, une version améliorée du Qwen 397B open source, prétendument supérieure à GLM 5.1 et Claude. Le créateur compare le modèle à son prédécesseur Qwen 397B sur plusieurs tâches de codage, de mathématiques et de génération d’images. Les résultats montrent que Nex N2 Pro est parfois meilleur que Qwen, mais souvent inférieur à GLM 5.1, notamment sur le jeu Flappy Birds. Le modèle a tendance à se perdre dans des boucles de réflexion en mode ’thinking’, ce qui le rend lent. Malgré ces faiblesses, l’auteur salue l’initiative de Nex-AGI de reprendre le flambeau open source. Il propose des liens pour essayer le modèle et mentionne des vidéos complémentaires sur d’autres modèles.

124 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La vidéo apporte une évaluation pratique et honnête d’un nouveau modèle open source, avec des tests concrets et une comparaison directe avec Qwen. L’argumentation repose sur des observations empiriques, mais elle est personnelle et non standardisée. Le créateur utilise des benchmarks fournis par le modèle lui-même sans les vérifier de manière indépendante, ce qui limite la portée des conclusions. Néanmoins, la démarche de test est transparente et permet aux téléspectateurs de se faire une idée.

Rigueur scientifique, qualité des sources, adéquation du titre

La vidéo s’appuie sur les benchmarks affichés sur la page du modèle, mais ceux-ci ne sont pas vérifiés. L’auteur cite des vidéos complémentaires de sa chaîne, mais ne fournit pas de sources externes indépendantes. Le titre est accrocheur et suggère une supériorité qui n’est pas confirmée par les tests. Les sources utilisées sont uniquement les liens dans la description, notamment vers Hugging Face et inferencer.com. L’adéquation du titre avec le contenu est partielle, car le modèle ne parvient pas à surpasser GLM 5.1 dans les tests pratiques.

177 mots

Adéquation titre / contenu

Le titre suggère que le modèle bat GLM 5.1 et Claude, mais les tests montrent des performances mitigées, souvent inférieures. L'interrogation du titre est justifiée, mais le contenu ne confirme pas pleinement la supériorité annoncée.

Qualité & fiabilité

7/10

La vidéo présente un test pratique du modèle Nex N2 Pro, basé sur Qwen 397B, avec des comparaisons transparentes et des résultats montrés en direct. Cependant, les tests sont personnalisés et non standardisés, et le titre exagère les performances constatées.

Moments clés

Sources citées

Références externes

Apport & nouveautés

La vidéo fournit un test de première main d’un nouveau modèle open source, montrant son potentiel et ses limites pratiques. Elle souligne l’importance de la communauté open source dans la continuité de modèles comme Qwen. L’apport original réside dans la démonstration de l’écart entre les benchmarks annoncés et les performances réelles observées.

Pour aller plus loin :

  • Qwen — Modèle de base utilisé.
  • GLM (modèle de langage) — Modèle concurrent comparé.
  • Claude (IA) — Modèle commercial comparé.
  • Hugging Face — Plateforme d’hébergement des modèles open source.
  • SWE-bench — Benchmark de codage utilisé dans les comparaisons.

95 mots

Profil radar

Le profil radar montre une bonne quantité d'informations (8/10), mais une qualité (6/10) et une fiabilité (6/10) moyennes, reflétant un test empirique mais non standardisé. Le niveau technique est correct (7/10), indiquant un contenu accessible mais précis.

Fiabilité 6/10