Séminaire DIC-ISC-CRIA - 9 octobre 2025 par Sean TROTT

Séminaire DIC-ISC-CRIA - 9 octobre 2025 par Sean TROTT

🎙 Sean Trott 👥 305 📅 9 octobre 2025 ⏱ 80 min 👁 62 📄 revue de littérature 🧭 2026-08-16
Disponible en : Français (actuel) English

Mots-clés

théorie de l'espritLLMcognitionépistémologiemodèles de langage

Résumé

Sean Trott, chercheur en sciences cognitives à l’UC San Diego, présente une conférence sur les défis épistémologiques posés par l’étude de la théorie de l’esprit (ToM) dans les grands modèles de langage (LLM) et chez les humains. Il commence par définir la ToM comme la capacité à attribuer des états mentaux à autrui, et discute des hypothèses sur son origine, notamment l’hypothèse de l’exposition au langage. Il introduit l’utilisation des LLM comme ‘organismes modèles’ pour tester cette hypothèse, car ils sont entraînés uniquement sur du texte. Il présente une étude de 2023 (Trott et al.) où GPT-3 a montré une sensibilité aux états de croyance implicites dans une tâche de fausse croyance, mais avec des performances inférieures à celles des humains. Une réplication avec 55 modèles open-weight a confirmé ces résultats, montrant qu’aucun modèle n’atteint le niveau humain. Trott aborde ensuite les interprétations possibles de ces résultats : le ’test du canard’, le ‘rejet axiomatique’, et la ‘validité de construit différentielle’. Il discute des défis théoriques et empiriques pour déterminer si les LLM ont réellement une ToM, notamment la plausibilité théorique, la validité apparente des tâches, la validité convergente entre tâches, et la question des mécanismes sous-jacents. Il conclut en proposant des pistes pour une meilleure méthodologie, comme l’utilisation de batteries de tâches et l’analyse des mécanismes internes.

218 mots

Évaluation critique

Valeur des informations & solidité de l’argumentation

La conférence offre une valeur scientifique élevée en présentant des données originales issues de recherches publiées et en cours. L’argumentation est solide, structurée et nuancée : Trott expose clairement les hypothèses, les méthodes, les résultats et leurs limites. Il discute de manière critique les interprétations possibles, évitant les conclusions hâtives. La distinction entre sensibilité aux états de croyance et théorie de l’esprit à part entière est bien argumentée. L’utilisation de modèles open-weight pour la réplication renforce la robustesse des conclusions. La réflexion épistémologique sur la validité de construit est particulièrement pertinente et apporte une profondeur analytique.

Rigueur scientifique, qualité des sources, adéquation du titre

La rigueur scientifique est exemplaire : les méthodes sont détaillées, les limites sont reconnues (notamment la dépendance à des modèles propriétaires), et les résultats sont interprétés avec prudence. Les sources citées sont des publications académiques dans des revues à comité de lecture (TACL, Cognitive Science). Le titre est en adéquation parfaite avec le contenu, qui se concentre sur les défis épistémologiques. La présentation est claire et bien structurée, avec des exemples concrets. Aucune séquence publicitaire n’est présente.

188 mots

Adéquation titre / contenu

Le titre reflète précisément le contenu : l'exposé porte sur les défis épistémologiques de l'étude de la théorie de l'esprit dans les LLM et chez les humains.

Qualité & fiabilité

8/10

Exposé scientifique rigoureux, s'appuyant sur des études publiées et des travaux en cours, avec une réflexion épistémologique approfondie. Les limites méthodologiques sont clairement identifiées.

Moments clés

Sources citées

Sources concordantes

Apport & nouveautés

La conférence apporte une contribution originale en proposant une réflexion épistémologique approfondie sur l’utilisation des LLM comme modèles de la cognition humaine, en particulier pour la théorie de l’esprit. Elle présente des données de réplication avec des modèles open-weight, renforçant la généralisabilité des résultats. L’approche de ‘validité de construit différentielle’ offre un cadre conceptuel pour interpréter les performances des LLM sans tomber dans l’anthropomorphisme ou le rejet systématique.

Pour aller plus loin :

  • Théorie de l’esprit — Article de synthèse sur le concept.
  • Grand modèle de langage — Présentation des LLM.
  • Tâche de fausse croyance — Description de la tâche classique utilisée.
  • Validité de construit — Notion méthodologique clé.

109 mots

Profil radar

Le profil radar montre une très bonne qualité d'information et une fiabilité élevée, avec une quantité d'information substantielle. Le niveau technique est modéré, reflétant une présentation accessible mais exigeante. La fiabilité globale est renforcée par la rigueur méthodologique et la discussion critique.

Fiabilité 8/10