GPT-5.2 es la p*ta hostia 🔥🤯

GPT-5.2 es la p*ta hostia 🔥🤯

🎙 Inteligencia Artificial 👥 725K 📅 12 décembre 2025 ⏱ 10 min 👁 108K 📄 revue d'actualité 🧭 2026-08-03
Disponible en : Français (actuel) English

Mots-clés

GPT-5.2OpenAIGemini 3ARC-AGI-2benchmarks

Résumé

Cette vidéo de la chaîne Inteligencia Artificial, présentée par Jon Hernández, annonce la sortie de GPT-5.2 par OpenAI et analyse ses performances par rapport aux modèles concurrents, notamment Gemini 3 Pro et Claude Opus 4.5. L’auteur commence par présenter les benchmarks officiels, soulignant des améliorations significatives en programmation, raisonnement et tâches réelles (Excel, PowerPoint). Il met particulièrement en avant le benchmark ARC-AGI-2, où GPT-5.2 atteint 52,9%, contre 31% pour Gemini 3 Pro, marquant un bond spectaculaire. Il discute ensuite du pricing, notant une augmentation d’environ 40% par rapport à GPT-5.1, et de la latence plus élevée du modèle. Il détaille les améliorations dans la génération de sorties (Excel formatés, présentations), les capacités de codage (simulation d’ondes), la vision (identification de composants sur une carte mère) et la réduction des hallucinations. Il interprète ces résultats comme une preuve que les LLM continuent de s’améliorer sans plafond apparent, et que OpenAI n’est pas mort, mais a plutôt des contraintes de calcul. Il conclut en prédisant des avancées encore plus rapides en 2026.

170 mots

Évaluation critique

La vidéo offre une analyse factuelle et chiffrée des performances de GPT-5.2, s’appuyant sur des benchmarks officiels publiés par OpenAI. L’auteur, Jon Hernández, est un vulgarisateur reconnu dans le domaine de l’IA, et son enthousiasme est palpable. Cependant, cette enthousiasme peut parfois nuire à la rigueur critique : il ne remet pas en question les benchmarks d’OpenAI, qui pourraient être biaisés en faveur de leur modèle. De plus, il extrapole des tendances à partir de quelques points de données, ce qui est scientifiquement fragile. Il mentionne des améliorations émergentes en vision et en réduction des hallucinations, mais sans fournir de preuves indépendantes. La comparaison avec Gemini 3 Pro est intéressante, mais il ne discute pas des avantages de Google en termes de gratuité et d’écosystème. La vidéo est bien structurée, avec des chapitres clairs, et les informations sont présentées de manière accessible. Cependant, elle manque de profondeur sur les implications éthiques et sociétales de ces avancées. Les sources citées se limitent aux liens de la description, principalement des ressources promotionnelles de l’auteur, et aucun lien direct vers les benchmarks ou les articles d’OpenAI n’est fourni, ce qui limite la vérifiabilité. Enfin, l’adéquation titre-contenu est correcte, le titre reflétant l’enthousiasme, mais il est peu informatif. Globalement, la vidéo est utile pour rester à jour, mais elle doit être complétée par des sources plus critiques et indépendantes.

225 mots

Adéquation titre / contenu

Le titre est accrocheur et reflète l'enthousiasme de l'auteur pour GPT-5.2, mais il est peu informatif et ne décrit pas le contenu technique.

Qualité & fiabilité

7/10

La vidéo présente des benchmarks chiffrés et des comparaisons entre modèles, mais s'appuie principalement sur des démonstrations et des annonces d'OpenAI sans vérification indépendante. Le ton est enthousiaste et parfois peu critique, mais les informations sont globalement exactes et à jour.

Chapitres

Sources citées

Sources concordantes

  • OpenAI - GPT-5.2 — Annonce officielle d'OpenAI avec les benchmarks et détails techniques.

Sources discordantes

  • Google - Gemini 3

Apport & nouveautés

La vidéo apporte une analyse rapide et chiffrée de la sortie de GPT-5.2, mettant en lumière ses performances sur des benchmarks clés comme ARC-AGI-2, et discute de ses implications pour la concurrence entre OpenAI et Google. Elle souligne que le scaling des LLM continue de produire des gains significatifs, contredisant les discours sur un plafonnement.

Pour aller plus loin :

  • ARC-AGI-2 — Site officiel du benchmark, expliquant sa conception et son importance.
  • Scaling Laws for Neural Language Models — Article fondateur de Kaplan et al. sur les lois de mise à l’échelle.
  • GPT-5.2 System Card — Page officielle d’OpenAI présentant les caractéristiques et benchmarks du modèle.

106 mots

Profil radar

Le profil radar montre une vidéo avec une quantité d'information élevée (8/10) et une qualité correcte (7/10), mais un niveau technique moyen (6/10) et une fiabilité globale modérée (7/10). Cela indique un contenu riche mais nécessitant une vérification externe.

Fiabilité 7/10

💬 Très positif. Sur les 30 commentaires analysés, la majorité exprime enthousiasme et gratitude envers Jon pour ses analyses, certains débattent de la comparaison avec Google, mais aucun commentaire négatif majeur n'est présent.