Éducation IA

OpenAI montre que ChatGPT et l’esprit critique améliorent les travaux étudiants différemment

OpenAI rapporte une expérience randomisée à Bocconi où ChatGPT améliore cohérence et finition, tandis que le raisonnement causal augmente la variété des idées.

Publié Mis à jour
OpenAIChatGPTÉducation IA

OpenAI a publié les résultats d’une expérience éducative randomisée suggérant que l’accès à ChatGPT et l’entraînement à l’esprit critique améliorent les travaux étudiants de façons différentes mais complémentaires. L’entreprise a présenté ces résultats le 27 août 2026, décrivant une recherche menée avec Bocconi University et OpenAI Economic Research auprès de plus de 1 000 étudiants de première année.

L’expérience demandait aux étudiants de travailler sur un cas réel: formuler des recommandations marketing pour la boutique de produits dérivés de Bocconi University. Les étudiants ont été répartis aléatoirement par créneau de cours en quatre groupes. Un groupe recevait l’accès à ChatGPT avec GPT-4o, un autre suivait un entraînement au raisonnement causal, un troisième recevait les deux, et un dernier aucun des deux. L’exercice de raisonnement causal n’était pas un tutoriel d’IA. Il apprenait à relier cause et effet, examiner pourquoi une idée peut fonctionner et considérer quand elle peut échouer.

Les chercheurs ont évalué les rendus de deux manières. Des correcteurs humains ont utilisé une grille en cinq points centrée sur la réponse aux objectifs marketing standards. Séparément, une analyse automatique de texte mesurait le nombre et la variété des idées, les indices de raisonnement causal et la similarité avec des recommandations rédigées par des experts. Cette double approche compte, car une réponse polie et une réponse originale ne sont pas toujours identiques, surtout lorsque l’IA facilite la qualité de surface.

L’effet de ChatGPT était net dans la grille. Les étudiants ayant accès à ChatGPT ont obtenu presque un point de plus sur cinq. Leurs travaux contenaient plus d’idées, une logique plus claire et une plus grande proximité avec les recommandations d’experts. OpenAI souligne que les étudiants ne remettaient pas simplement leurs devoirs au modèle. Ils devaient décider quoi demander, évaluer les réponses et choisir ce qui entrait dans la version finale.

L’entraînement à l’esprit critique a produit un autre effet. Les étudiants qui l’avaient suivi expliquaient mieux pourquoi leurs idées pouvaient fonctionner et quand elles pouvaient échouer, mais ils n’obtenaient pas de meilleures notes dans la grille traditionnelle. L’analyse textuelle montrait pourtant qu’ils généraient une gamme d’idées plus large et plus distincte de celle de leurs pairs. Cela révèle un problème de mesure éducative. Si l’évaluation récompense surtout les réponses claires et conventionnelles, elle peut manquer les compétences d’originalité que l’école dit valoriser.

Les étudiants ayant reçu ChatGPT et l’entraînement au raisonnement causal ont montré l’ensemble de gains le plus large. Leur variété d’idées ressemblait au groupe formé au raisonnement, tandis que leurs notes et leur nombre d’idées ressemblaient au groupe avec ChatGPT seul. Leurs travaux montraient aussi plus de cohérence logique et davantage de remise en question des hypothèses. L’étude refuse donc le débat simpliste entre usage de l’IA et pensée autonome.

L’implication pratique est que l’IA en éducation doit être traitée comme un problème de conception, pas seulement d’autorisation. Si les étudiants peuvent produire des réponses polies avec l’IA, le résultat final révèle moins ce qu’ils comprennent. Les devoirs devront peut-être récompenser originalité, processus de raisonnement, comparaison d’options et défense des choix. ChatGPT peut combler un écart d’expertise, mais l’esprit critique reste essentiel parce qu’il change la façon de poser le problème avant et après la réponse du modèle.