1. Introduction et problème

Dans la tranche d'âge de 3 à 6 ans — jardin d'enfants, maternelle, CENDI, école infantile — s'est installé un paquet de trois artefacts qui prétendent valoir pour la qualité de l'interaction pédagogico-relationnelle. Le premier est un système qui note des vidéos CLASS : un pipeline multimodal ou de langage qui estime Positive Climate, Negative Climate ou Instructional Support et déclare que la classe « a déjà une qualité mesurée par l'IA ». Le deuxième est un wearable qui signale « réponds maintenant » : un dispositif bug-in-ear ou un bracelet qui augmente les opportunités de réponse de l'enseignant et présente l'alerte comme s'il s'agissait de sensibilité relationnelle. Le troisième est un modèle qui classe les tours de parole : un algorithme qui compte ou étiquette les tours adulte–enfant et livre le décompte comme s'il s'agissait de réciprocité pédagogique. Les trois sont visibles et bon marché en temps de coordination. Ils permettent d'exhiber que le centre « fait déjà de la qualité d'interaction avec l'intelligence artificielle ». Le saut — d'obtenir un score, de recevoir une alerte ou d'accumuler des tours à affirmer qu'il y a qualité de processus — n'est autorisé ni par les preuves d'observation automatisée ni par ce que Starting Strong et CLASS mesurent lorsqu'il y a Emotional Support, Classroom Organization et Instructional Support dans la vie quotidienne de la classe.

La thèse de cet article est restrictive. Un système qui note des vidéos CLASS, un wearable qui signale « réponds maintenant » ou un modèle qui classe les tours de parole ne constituent pas la qualité de l'interaction pédagogico-relationnelle en éducation de la petite enfance. À ce stade, la qualité de processus est sensibilité, réciprocité et échafaudage — le serve-and-return du Center on the Developing Child ; les dimensions Emotional Support (ES), Classroom Organization (CO) et Instructional Support (IS) de CLASS ; l'ancre d'interactions quotidiennes significatives de l'OCDE Starting Strong — ; non un tableau de bord de notation, une alerte d'opportunité de réponse ni un décompte automatique de tours. L'OCDE (2021), dans Starting Strong VI, analyse les curriculums de vingt-six pays — cinquante-six curriculums — et ancre la qualité de l'ECEC dans les interactions quotidiennes adulte–enfant, non dans des artefacts de mesure. Cela n'autorise pas à traduire « il y a un score CLASS automatisé » par « il y a qualité de processus ». Cela autorise à demander ce qui a été mesuré : souvent, une corrélation avec des jugements humains sur des segments de quinze minutes, non la sensibilité soutenue lorsqu'un enfant de quatre ans offre un « serve » et que l'adulte répond, élargit et échafaude.

Le problème s'aggrave par trois confusions de catégorie que les fiches produits ne mentionnent pas et que cet article sépare avec rigueur. Première : la qualité de processus n'est pas la documentation pédagogique — portfolios, panneaux ou carnets numériques qui enregistrent ce qui s'est produit —. Deuxième : ce n'est pas l'éducation socioémotionnelle (SEL) comme programme de compétences émotionnelles globales. Troisième : ce ne sont pas les fonctions exécutives comme le contrôle inhibiteur, la mémoire de travail et la flexibilité cognitive. Gómez et Strasser (2021) et Gómez-Muzzio et Strasser (2025) sont cités ici uniquement pour distinguer les tours conversationnels de la qualité d'interaction pédagogique : les tours prédisent le développement socioémotionnel, mais un classificateur de tours n'est pas, par le fait d'exister, le métier de sensibilité et d'échafaudage dans la salle. Ce travail ne recycle pas des articles de documentation, de SEL ou de fonctions exécutives. La question est celle de la qualité de processus : qu'est-ce qui compte comme interaction pédagogico-relationnelle lorsqu'un centre de petite enfance « fait de l'IA et de la qualité d'interaction ». Confondre le produit — score, wearable, classificateur — avec le processus est l'erreur que ce travail nomme. Ramakrishnan, Zylich, Ottmar, LoCasale-Crouch et Whitehill (2023) démontrent la viabilité de l'estimation multimodale de Positive Climate et Negative Climate ; Whitehill et LoCasale-Crouch (2024) relient des jugements au niveau de l'énoncé à des scores CLASS d'Instructional Support. Inférence pédagogique, marquée comme telle : le marché de « l'IA pour la qualité d'interaction en petite enfance » hérite de cette distribution évaluative et la convertit en promesse de qualité. Il convertit la mesure automatisée et l'alerte en totalité du métier relationnel.

Les contributions sont trois : reconstruire l'état de l'art qui sépare la qualité de processus (serve-and-return ; CLASS ES/CO/IS ; OCDE Starting Strong) de la notation, de l'alerte et du décompte de tours ; examiner trois familles de cas empiriques ; et offrir quatre épreuves pour décider quand un jardin d'enfants peut affirmer qu'il y a qualité d'interaction pédagogico-relationnelle, et non seulement un système qui note des vidéos, un wearable ou un classificateur de tours.

2. État de l'art : de la qualité de processus à l'artefact qu'on exhibe

Il convient de séparer quatre strates que le marché de « l'IA pour la qualité d'interaction en petite enfance » mélange habituellement. La première est le construit de qualité de processus de 3 à 6 ans comme sensibilité, réciprocité et échafaudage dans les interactions quotidiennes — serve-and-return ; Emotional Support, Classroom Organization et Instructional Support ; OCDE Starting Strong — (Center on the Developing Child at Harvard University, s. d. ; OCDE, 2021, 2023 ; Finders et al., 2021 ; Howard et al., 2024 ; von Suchodoletz et al., 2023 ; Paschall et al., 2023). La deuxième est le métier relationnel qui la cultive — noticing enseignant, réponse contingente, organisation de la classe et soutien instructionnel médiatisé — (LoCasale-Crouch et al., 2023 ; NAEYC, 2022). La troisième est la preuve d'observation automatisée CLASS, de coaching bug-in-ear, de classification des tours et de cartographies de l'IA en ECE (Ramakrishnan et al., 2023 ; Whitehill et LoCasale-Crouch, 2024 ; Green et al., 2023 ; Ferjan Ramírez et al., 2021 ; Chen, 2024 ; Su et Yang, 2022 ; Ljungcrantz, 2026). La quatrième est le cadre de droits, de systèmes et de pratique appropriée au développement, qui traite l'enfant de 3–6 ans comme sujet d'interactions de processus, non comme vecteur de features pour un pipeline de scoring (UNESCO, 2021 ; Miao et Holmes, 2023 ; Commission européenne, 2022 ; U.S. Department of Education, 2023).

Dans la strate du construit, l'OCDE (2021) fixe que la qualité de l'ECEC se joue dans des interactions significatives quotidiennes et analyse comment vingt-six pays articulent ce mandat dans cinquante-six curriculums. L'OCDE (2023) situe la numérisation dans des usages à sens pédagogique, non dans un flux d'alertes qui remplacerait la réciprocité. Le Center on the Developing Child (s. d.) définit le serve-and-return comme la séquence dans laquelle l'enfant initie — serve — et l'adulte répond de manière contingente, élargit et soutient l'échange. Finders, Budrevich, Duncan, Purpura, Elicker et Schmitt (2021), avec 684 enfants de maternelle, montrent que les dimensions CLASS ne sont pas interchangeables : la moyenne de Classroom Organization s'associe positivement aux mathématiques ; la variabilité intra-journée de CO s'associe négativement à l'alphabétisation ; la moyenne d'Instructional Support s'associe négativement au langage dans leurs modèles. Statut : résultat selon lequel la qualité de processus est multidimensionnelle et sensible à la variabilité, non à un score unique. Howard, Lewis, Walter, Verenikina et Kervin (2024), dans une revue systématique de quatre-vingt-dix études et huit cent soixante-dix associations avec des enfants de 3 à 5 ans, trouvent peu de soutien aux indices globaux de qualité d'interaction et une meilleure cohérence sur certaines dimensions — par exemple, supporting play —, avec un faible soutien de l'instructional support même lorsqu'il s'aligne sur des outcomes cognitifs. Inférence : un tableau de bord qui résume la « qualité CLASS » en un nombre ne couvre pas, par le fait d'exister, la sensibilité, la réciprocité et l'échafaudage.

Dans la strate du métier, LoCasale-Crouch, Romo-Escudero, Clayback, Whittaker, Hamre et Melo (2023) assignent aléatoirement soixante et un éducateurs de toddlers à un contrôle ou au cours Effective Classroom Interactions for Toddler Educators (ECI-TE) : ceux qui terminent le cours montrent de plus grandes habiletés de noticing et une plus grande qualité d'interactions éducateur–enfant, avec une taille d'effet moyenne. Statut : résultat de développement professionnel orienté à remarquer et à enactar des interactions efficaces. Ce n'est pas un résultat selon lequel un wearable qui pousse « réponds maintenant » reproduit ce métier. La NAEYC (2022) exige une pratique appropriée au développement : la qualité se vérifie dans les relations, non dans les artefacts de mesure. Inférence : un score automatisé ne marche pas avec l'enfant. Un adulte qui remarque le serve et répond, oui.

Dans la strate des artefacts, Ramakrishnan et al. (2023) présentent ACORN : apprentissage automatique multimodal pour estimer CLASS Positive Climate et Negative Climate ; ils rapportent r = 0,55 pour PC et r = 0,63 pour NC sur des segments de quinze minutes du corpus UVA Toddler (n = 300 segments), avec AUC = 0,70 pour les moments de Positive Climate. Whitehill et LoCasale-Crouch (2024) combinent Whisper, Llama 2 et bag-of-words pour Instructional Support : corrélation de Pearson jusqu'à 0,48 face à une IRR humaine jusqu'à 0,55, en agrégeant des jugements d'énoncé en un score CLASS IS de quinze minutes en toddler et pre-K. Green, Olsen et Nandakumar (2023) testent le coaching bug-in-ear en Head Start pour augmenter les opportunities to respond (OTR) en mathématiques avec quatre enseignants : relation fonctionnelle dans deux sur quatre ; maintien faible. Ferjan Ramírez, Hippe et Kuhl (2021) avertissent que les mesures automatiques de tours conversationnels parent–enfant ne sont pas équivalentes aux jugements manuels. Statut : résultat de faisabilité du scoring, de coaching d'OTR et de précaution métrologique sur les tours ; non un résultat selon lequel score, alerte ou classificateur constituent la qualité de processus. Chen (2024), Su et Yang (2022) et Ljungcrantz (2026) cartographient l'IA en ECE sans l'équivaloir à la qualité d'interaction pédagogico-relationnelle du jardin d'enfants.

Dans la strate des systèmes, l'UNESCO (2021) exige une supervision humaine. Miao et Holmes (2023) fixent une validation pédagogique et des seuils d'âge pour l'IA générative. La Commission européenne (2022) et le Département de l'Éducation des États-Unis (2023) convergent pour ne pas substituer le jugement professionnel. von Suchodoletz et al. (2023) métanalysent les associations entre qualité ECEC et outcomes infantiles, renforçant que la qualité compte et qu'elle ne se réduit pas à un artefact. Paschall et al. (2023), avec 2 114 élèves Head Start, identifient des profils où le plus grand regroupe un climat émotionnel positif avec un faible instructional support : résultat selon lequel les dimensions ne voyagent pas ensemble. Inférence : un enfant de quatre ans n'est ni l'intrant d'un pipeline de scoring ni le destinataire passif d'une alerte wearable. Il est le protagoniste d'un serve-and-return qu'un adulte garant exerce avec sensibilité, réciprocité et échafaudage.

3. Méthode de revue

Une revue narrative critique a été réalisée, non une méta-analyse primaire. Le propos n'était pas d'estimer une taille d'effet homogène de l'observation automatisée, mais d'articuler un argument de catégorie pédagogique avec des sources vérifiées. Critères d'inclusion : (a) 2021–2026, avec transfert explicitement marqué lorsque l'échantillon n'est pas de 3–6 ans ; (b) qualité de processus, interactions adulte–enfant, serve-and-return, CLASS (ES/CO/IS), observation automatisée, coaching bug-in-ear, tours conversationnels ou IA en éducation de la petite enfance ; (c) pertinence pour jardin d'enfants, maternelle, CENDI ou 3–6 ans ; (d) revue à pairs, DOI ou rapport de la NAEYC, de l'UNESCO, de l'OCDE, de la Commission européenne, du Center on the Developing Child ou d'un département d'éducation ; (e) DOI ou page éditoriale vérifiable. Ont été exclus comme objet central les axes déjà utilisés dans cette série — documentation pédagogique, SEL comme programme substitut, fonctions exécutives, tutorat génératif, écarts, vie privée, DUA, STEM, numératie, évaluation formative, famille–école, formation continue — bien que certains apparaissent comme limite de catégorie.

La recherche a été exécutée le 28 août 2026 (slot 01:02 America/Mexico_City) sur des pages DOI, Springer, Elsevier, Wiley, SAGE, IEEE Xplore, OECD iLibrary, UNESDOC, JAIR, NAEYC, Zenodo, Harvard Center on the Developing Child et sites éditoriaux. Chaque source a été vérifiée contre au moins une de ces pages. On a distingué résultat empirique, cadre conceptuel ou normatif, et inférence pédagogique marquée comme telle. On a priorisé la distinction qualité de processus / documentation / SEL / fonctions exécutives, et la précaution de Ferjan Ramírez et al. (2021) sur les tours automatiques face aux jugements manuels.

4. Cas 1. Noter des vidéos CLASS, alerter « réponds maintenant » ou classer des tours ne constitue pas la qualité d'interaction

Ramakrishnan, Zylich, Ottmar, LoCasale-Crouch et Whitehill (2023) publient dans IEEE Transactions on Affective Computing le système ACORN qui nomme le mieux le premier artefact lorsqu'on le présente comme qualité d'interaction. Ils entraînent un apprentissage automatique multimodal pour estimer CLASS Positive Climate et Negative Climate. Sur le corpus UVA Toddler, avec trois cents segments de quinze minutes, ils rapportent une corrélation r = 0,55 avec Positive Climate et r = 0,63 avec Negative Climate, et AUC = 0,70 pour détecter des moments de Positive Climate. Statut de la preuve. Résultat empirique d'estimation automatisée : le système s'approche des jugements humains sur deux dimensions de climat émotionnel. Ce n'est pas un résultat selon lequel installer un scorer CLASS développe ou garantit Emotional Support, Classroom Organization et Instructional Support dans la vie de la classe, ni selon lequel sensibilité, réciprocité et échafaudage sont couverts. La donnée que le marché ne cite pas est le plafond : des corrélations modérées et un AUC de détection de moments, non une équivalence avec la qualité de processus vécue. Inférence pédagogique, marquée comme telle : c'est le geste qu'un jardin d'enfants copie lorsqu'il « fait de la qualité avec une IA qui note des vidéos ». On enregistre, on note, on exhibe le tableau de bord. Ce qu'il y a, c'est un artefact d'observation. La qualité de processus, chez l'OCDE (2021) et au Center on the Developing Child (s. d.), demande un serve-and-return contingent, non un r de 0,55 avec Positive Climate.

Whitehill et LoCasale-Crouch (2024) saturent le portrait du premier artefact depuis Instructional Support. Ils combinent transcription Whisper, Llama 2 et bag-of-words ; ils agrègent des jugements au niveau de l'énoncé jusqu'à un score CLASS IS de quinze minutes en toddler et pre-K. La corrélation de Pearson atteint jusqu'à 0,48 face à une fiabilité interjuges humaine jusqu'à 0,55. Statut : résultat de connexion entre prédiction globale et feedback spécifique d'énoncé. Ce n'est pas un résultat selon lequel un modèle de langage constitue un échafaudage instructionnel. Inférence, marquée comme telle : s'approcher de l'IRR humaine sur un segment n'autorise pas à déclarer « il y a déjà un Instructional Support de qualité ». Cela autorise à dire qu'il y a estimation. Finders et al. (2021) montrent, en outre, que IS et CO ne se comportent pas de la même façon relativement aux outcomes : un score unique aplatit cette hétérogénéité.

Green, Olsen et Nandakumar (2023) nomment le deuxième artefact. Dans un Head Start, ils utilisent le coaching bug-in-ear pour augmenter les opportunities to respond en mathématiques avec quatre enseignants. Ils documentent une relation fonctionnelle dans deux sur quatre et un maintien faible. Statut : résultat selon lequel une alerte ou un coaching à l'oreille peut accroître l'OTR dans certains cas, avec un maintien fragile. Ce n'est pas un résultat selon lequel un wearable qui dit « réponds maintenant » est de la sensibilité relationnelle ou du serve-and-return. Inférence : l'OTR est une opportunité de réponse académique ; la sensibilité est de remarquer le serve de l'enfant — verbal, gestuel, ludique — et de le rendre avec contingence affective et cognitive. Ferjan Ramírez, Hippe et Kuhl (2021) ferment le troisième artefact avec un avertissement métrologique : les mesures automatiques de tours conversationnels ne sont pas équivalentes aux mesures manuelles. Statut : résultat de désaccord entre automatique et manuel. Inférence : un classificateur de tours peut compter des événements acoustiques ; il ne démontre ni réciprocité pédagogique ni échafaudage. Chen (2024), Su et Yang (2022) et Ljungcrantz (2026) confirment la croissance de l'IA en ECE sans preuve que score, alerte ou classificateur substituent le métier. Inférence : un CENDI qui livre une « qualité CLASS générée par l'IA » ou des « tours suffisants selon le modèle » a fait de la mesure ou du décompte. La qualité de processus se vérifie selon que l'adulte a répondu au serve, a organisé la classe avec chaleur et a échafaudé la pensée. Elle ne se vérifie pas dans l'AUC du scorer.

5. Cas 2. Ce que le jardin d'enfants fait bien lorsqu'il y a qualité de processus : sensibilité, réciprocité et échafaudage

Le Center on the Developing Child at Harvard University (s. d.) définit le serve-and-return comme cadre actuel d'interaction : l'enfant initie ; l'adulte remarque, répond, nomme, attend et soutient l'échange. Statut : cadre conceptuel institutionnel vérifiable sur la page éditoriale du centre. Ce n'est pas un résultat d'IA. Inférence pédagogique, marquée comme telle : c'est l'objet qu'un centre de petite enfance peut appeler qualité d'interaction pédagogico-relationnelle. La réciprocité n'est pas un décompte de tours : c'est une contingence affective et cognitive. Un wearable qui pousse « réponds maintenant » sans lire le serve peut augmenter l'OTR et, en même temps, interrompre le rythme de l'enfant. Un scorer CLASS peut noter un climat positif en vidéo et n'avoir pas capturé si l'adulte a élargi la pensée de l'enfant dans le coin de jeu.

L'OCDE (2021) sature le cadre depuis la politique comparée : dans vingt-six pays et cinquante-six curriculums, Starting Strong VI soutient que la qualité se joue dans des interactions quotidiennes significatives. L'OCDE (2023) ajoute que la numérisation doit autonomiser sans substituer ces interactions. Statut : cadre de systèmes. Inférence : un jardin d'enfants ne peut traiter « nous mesurons déjà CLASS avec l'IA » comme équivalent d'avoir transformé les interactions quotidiennes. LoCasale-Crouch et al. (2023) apportent le pont empirique du métier : le cours ECI-TE améliore le noticing et la qualité des interactions chez les éducateurs de toddlers (N = 61 ; effet moyen), précisément parce qu'il forme le regard professionnel, non parce qu'il automatise le score. Statut : résultat d'essai randomisé de développement professionnel. Inférence : le noticing est une condition de la sensibilité ; un tableau de bord ne remarque pas à la place de l'enseignant.

Finders et al. (2021), avec 684 enfants, montrent que Emotional Support, Classroom Organization et Instructional Support ont des relations différenciées avec la readiness : moyenne de CO avec les mathématiques ; variabilité de CO avec l'alphabétisation (négative) ; moyenne d'IS avec le langage (négative dans leurs spécifications). Howard et al. (2024) renforcent, dans quatre-vingt-dix études, que les indices globaux de qualité d'interaction ont peu de soutien et que des dimensions spécifiques — comme supporting play — montrent une plus grande cohérence, tandis que l'instructional support a un faible soutien même aligné avec des outcomes cognitifs. Statut : résultat empirique et de synthèse sur la multidimensionalité et les limites d'IS comme prédicteur. Inférence : lorsqu'il y a qualité de processus en petite enfance, il y a ES (climat émotionnel, sensibilité, respect), CO (organisation, productivité, gestion du comportement) et IS (développement de concepts, feedback de qualité, modelage linguistique) exercés en temps réel par des adultes ; non une moyenne aplatie. Paschall et al. (2023), avec 2 114 Head Start, trouvent un profil majoritaire de climat émotionnel positif avec un faible instructional support : les dimensions ne s'achètent pas en paquet. von Suchodoletz et al. (2023) métanalysent que la qualité ECEC s'associe aux outcomes infantiles, sans autoriser à réduire cette qualité à un artefact de scoring. La NAEYC (2022) exige que la pratique soit appropriée au développement : l'enfant de 3–6 ans est sujet de relation, non de pipeline. Inférence : sensibilité, réciprocité et échafaudage se vérifient dans la cour, à la table et dans la transition — lorsque l'adulte soutient le serve-and-return —, non dans le journal du wearable ni dans le JSON du classificateur de tours.

6. Cas 3. Les interactions de processus ne sont ni documentation, ni SEL, ni fonctions exécutives

La première frontière de catégorie est la documentation pédagogique. Un panneau numérique, un portfolio ou un registre anecdotique peuvent conserver des traces de ce qui s'est produit ; ils ne constituent pas, à eux seuls, la qualité des interactions de processus que l'OCDE (2021) ancre dans la rencontre quotidienne. Statut : inférence pédagogique ancrée dans le cadre Starting Strong, marquée comme telle. Cet article ne convertit pas la documentation en objet central : il la nomme pour interdire l'équivalence. Un système qui note des vidéos CLASS n'est pas non plus une documentation de sens : c'est une estimation psychométrique automatisée. Confondre « nous avons des preuves à l'écran » avec « il y a réciprocité dans la salle » est l'erreur de catégorie que le marché exploite.

La deuxième frontière est le SEL. Gómez et Strasser (2021), avec 43 dyades, montrent que les tours conversationnels à 18 mois prédisent les compétences socioémotionnelles à 30 mois. Gómez-Muzzio et Strasser (2025), avec 33 cas, montrent que les tours à 30 mois expliquent entre 14,4 % et 20,3 % de la variance socioémotionnelle à 77 mois. Statut : résultat empirique sur tours et développement socioémotionnel. Inférence pédagogique, marquée comme telle et à usage restrictif : ces études sont retenues uniquement pour distinguer. Un classificateur de tours peut hériter de la renommée prédictive des tours sur le SEL et se vendre comme « qualité d'interaction ». Il ne l'est pas. La qualité de processus dans cet article est sensibilité, réciprocité et échafaudage dans CLASS ES/CO/IS et serve-and-return, non un programme de compétences socioémotionnelles ni un proxy SEL fondé sur le décompte. Ce travail ne recycle pas un article SEL : il utilise la preuve des tours pour montrer le saut illégitime du décompte automatique à la déclaration de qualité pédagogico-relationnelle. Ferjan Ramírez et al. (2021) renforcent la coupure : automatique ≠ manuel.

La troisième frontière sont les fonctions exécutives. Cet article ne convertit pas la qualité d'interaction en contrôle inhibiteur, mémoire de travail ou flexibilité cognitive. Paschall et al. (2023) et Finders et al. (2021) sont retenus pour des profils et dimensions CLASS, non pour les FE. von Suchodoletz et al. (2023) sont retenus pour des associations qualité–outcomes, non pour un entraînement exécutif. Inférence : lorsqu'un produit promet « améliore l'attention exécutive parce qu'il mesure des tours » ou « développe l'autorégulation parce qu'il note CLASS », on a franchi un autre construit. La qualité de processus peut s'associer empiriquement à de nombreux outcomes ; elle ne s'identifie pas à eux. Chen (2024), Su et Yang (2022) et Ljungcrantz (2026) cartographient l'IA en ECE ; Miao et Holmes (2023) fixent des limites d'âge et de validation. Inférence : le seul usage de l'IA cohérent avec 3–6 ans demeure du côté de l'adulte qui remarque, répond et échafaude — comme soutien à la formation au noticing ou au feedback professionnel différé —, soumis à validation pédagogique. Il n'entre pas comme scorer autonome, wearable qui substitue le jugement ni classificateur de tours qui déclare la qualité accomplie.

7. Cadre inférentiel : quatre épreuves pour affirmer qu'il y a qualité de processus, non un artefact

Le cadre qui suit est une inférence pédagogique de cet article, ancrée dans les cas et dans les instruments vérifiés. Ce n'est pas une nouvelle norme internationale. Il distingue quatre épreuves. Si un jardin d'enfants, une maternelle, un CENDI ou une école infantile ne les passe pas, il ne peut déclarer qu'un système qui note des vidéos CLASS, un wearable qui signale « réponds maintenant » ou un modèle qui classe les tours de parole constituent la qualité de l'interaction pédagogico-relationnelle.

7.1. Épreuve du serve-and-return contingent, non du score de climat. Le Center on the Developing Child (s. d.) définit la séquence serve–réponse–élargissement. Ramakrishnan et al. (2023) estiment Positive/Negative Climate avec des r modérées et AUC = 0,70. Inférence : la preuve de qualité se vérifie selon que l'adulte a remarqué le serve de l'enfant et a répondu avec contingence. Si la « preuve » du centre est un tableau de bord ACORN ou un score de Positive Climate, le centre a fait de l'estimation, non de la réciprocité.

7.2. Épreuve d'Emotional Support, Classroom Organization et Instructional Support en situation réelle, non de la moyenne aplatie. Finders et al. (2021) documentent des relations différenciées d'ES/CO/IS et de la variabilité intra-journée. Howard et al. (2024) documentent peu de soutien aux indices globaux et un faible soutien d'IS. Paschall et al. (2023) documentent des profils avec climat positif et faible IS. Whitehill et LoCasale-Crouch (2024) atteignent Pearson jusqu'à 0,48 en IS automatisé. Inférence : la qualité de processus exige les trois dimensions exercées, non un nombre qui les effondre. Un modèle qui approxime IS ne démontre pas l'échafaudage de concepts à la table de travail.

7.3. Épreuve de la sensibilité et du noticing enseignant, non de l'alerte OTR. LoCasale-Crouch et al. (2023) améliorent noticing et qualité d'interaction par la formation. Green et al. (2023) accroissent l'OTR avec bug-in-ear chez 2/4 enseignants, avec maintien faible. Inférence : « réponds maintenant » peut élever les opportunités de réponse académique sans élever la sensibilité au serve de l'enfant. La sensibilité est lecture de l'autre ; l'OTR est fréquence de prompt.

7.4. Épreuve de la distinction de catégorie et du jugement professionnel, non du catalogue de produit. Ferjan Ramírez et al. (2021) empêchent d'équivaloir tours automatiques et jugements manuels. Gómez et Strasser (2021) et Gómez-Muzzio et Strasser (2025) servent uniquement à montrer que les tours prédisent le SEL, non qu'un classificateur soit qualité de processus. L'UNESCO (2021), Miao et Holmes (2023), la Commission européenne (2022), le Département de l'Éducation des États-Unis (2023), la NAEYC (2022) et l'OCDE (2021, 2023) exigent supervision humaine, validation pédagogique, pratique appropriée au développement et interactions de processus. Inférence : un centre ne peut traiter l'enfant comme vecteur de features pour scoring, alerte ou décompte. La qualité de processus ne s'accomplit pas en notant mieux la vidéo. Elle s'accomplit en répondant au serve, en organisant la classe avec chaleur et en échafaudant la pensée avec des adultes qui soutiennent le métier.

Le cadre admet le numérique lorsqu'il se subordonne à la formation enseignante et à l'observation professionnelle validée (LoCasale-Crouch et al., 2023 ; Whitehill et LoCasale-Crouch, 2024, comme soutien au feedback, non comme qualité déclarée). Il refuse de déclarer la qualité d'interaction par scorer CLASS, wearable d'alerte ou classificateur de tours (Ramakrishnan et al., 2023 ; Green et al., 2023 ; Ferjan Ramírez et al., 2021).

8. Discussion

Trois tensions organisent la discussion. La première oppose exhiber un artefact de mesure et exercer la qualité de processus. C'est un résultat qu'ACORN estime le climat émotionnel avec des corrélations modérées (Ramakrishnan et al., 2023) ; que les LLM et BoW approximent Instructional Support avec Pearson jusqu'à 0,48 (Whitehill et LoCasale-Crouch, 2024) ; et que le bug-in-ear peut déplacer l'OTR chez certains enseignants (Green et al., 2023). C'est un cadre que la qualité se joue dans les interactions quotidiennes (OCDE, 2021 ; Center on the Developing Child, s. d. ; NAEYC, 2022). Ce n'est pas un résultat selon lequel score, alerte ou classificateur produisent le métier que LoCasale-Crouch et al. (2023) forment comme noticing. Les trois artefacts mesurent ou poussent ce que l'ingénierie sait livrer et déclarent ce que seule la réciprocité autoriserait.

La deuxième oppose décompte de tours et réciprocité pédagogique. Ferjan Ramírez et al. (2021) montrent un désaccord automatique–manuel. Gómez et Strasser (2021) et Gómez-Muzzio et Strasser (2025) montrent la valeur prédictive des tours pour le SEL — usage restrictif ici —. Inférence : insister sur le fait que le jardin d'enfants « a déjà une qualité d'interaction » parce que le modèle compte assez de tours est une pédagogie inversée. On prend un proxy corrélationnel avec le développement socioémotionnel et on le fait valoir pour Emotional Support, Classroom Organization et Instructional Support. L'enfant devient émetteur de tours ; l'adulte, superviseur du classificateur.

La troisième oppose indice global et multidimensionalité. Howard et al. (2024) et Finders et al. (2021) déconseillent de traiter la qualité comme un seul nombre. Paschall et al. (2023) montrent des profils déséquilibrés. Inférence : le seul usage de l'IA cohérent avec 3–6 ans demeure du côté de l'adulte qui remarque et répond, soumis à validation pédagogique et aux guides de l'UNESCO, de la Commission européenne et du Département de l'Éducation des États-Unis. Un scorer autonome parce que le système a besoin d'un produit ne l'est pas.

9. Limites

Cette revue est narrative. Elle n'applique pas PRISMA ni n'estime d'effets combinés primaires. Ramakrishnan et al. (2023) estiment PC/NC, non les trois dimensions CLASS complètes comme qualité vécue. Whitehill et LoCasale-Crouch (2024) atteignent des corrélations inférieures ou proches de l'IRR humaine, non une équivalence pédagogique. Green et al. (2023) sont quatre enseignants Head Start avec maintien faible. LoCasale-Crouch et al. (2023) sont soixante et un éducateurs de toddlers dans un essai randomisé de cours en ligne, non de scoring par IA. Finders et al. (2021) sont 684 dans un contexte étatsunien. Howard et al. (2024) synthétisent quatre-vingt-dix études hétérogènes. Paschall et al. (2023) sont des profils Head Start. Gómez et Strasser (2021) et Gómez-Muzzio et Strasser (2025) sont de petits échantillons (N = 43 et N = 33) et ne servent qu'à distinguer tours/SEL de la qualité de processus. Ferjan Ramírez et al. (2021) sont des tours parent–enfant, avec transfert marqué vers la classe. Chen (2024), Su et Yang (2022) et Ljungcrantz (2026) cartographient l'IA en ECE, non la qualité CLASS de jardin d'enfants. NAEYC, UNESCO, OCDE et le Center on the Developing Child sont de cadre. Aucun essai latino-américain d'IA comparant serve-and-return médiatisé par l'adulte à un scorer autonome ou à un wearable d'alerte en CENDI n'a été localisé. Les inférences de la section 7 sont des hypothèses de catégorie pédagogique, non une preuve d'implémentation.

10. Conclusions

Un système qui note des vidéos CLASS, un wearable qui signale « réponds maintenant » ou un modèle qui classe les tours de parole ne constituent pas la qualité de l'interaction pédagogico-relationnelle dans un centre d'éducation de la petite enfance. La preuve vérifiée n'autorise pas cette déclaration. ACORN estime Positive Climate et Negative Climate avec r = 0,55 et r = 0,63 sur trois cents segments de quinze minutes, avec AUC = 0,70 (Ramakrishnan et al., 2023). Whisper, Llama 2 et BoW atteignent Pearson jusqu'à 0,48 en Instructional Support face à une IRR humaine jusqu'à 0,55 (Whitehill et LoCasale-Crouch, 2024). Le bug-in-ear déplace l'OTR chez deux enseignants sur quatre, avec maintien faible (Green et al., 2023). Les mesures automatiques de tours ne sont pas équivalentes aux manuelles (Ferjan Ramírez et al., 2021). En revanche, lorsqu'il y a qualité de processus en petite enfance, il y a sensibilité, réciprocité et échafaudage : serve-and-return (Center on the Developing Child, s. d.) ; interactions quotidiennes dans vingt-six pays et cinquante-six curriculums (OCDE, 2021) ; dimensions CLASS différenciées et variables (N = 684 ; Finders et al., 2021) ; noticing formé chez des éducateurs de toddlers (N = 61 ; LoCasale-Crouch et al., 2023) ; peu de justification des indices globaux et faible soutien d'IS dans une synthèse de quatre-vingt-dix études (Howard et al., 2024) ; profils qui séparent climat émotionnel et instructional support (N = 2 114 ; Paschall et al., 2023). Les interactions de processus se distinguent de la documentation, du SEL — bien que les tours prédisent le SEL (Gómez et Strasser, 2021 ; Gómez-Muzzio et Strasser, 2025) — et des fonctions exécutives. Les guides en vigueur exigent interactions de processus, supervision humaine, validation pédagogique et de ne pas substituer le jugement professionnel (OCDE, 2021, 2023 ; NAEYC, 2022 ; UNESCO, 2021 ; Miao et Holmes, 2023 ; Commission européenne, 2022 ; U.S. Department of Education, 2023).

Là où les sources ne mesurent pas un jardin d'enfants, cet article ne l'affirme pas. Là où elles mesurent scoring, alerte OTR ou classification de tours, il ne les traduit pas en qualité d'interaction pédagogico-relationnelle. Accompagner les filles et les garçons de trois à six ans dans la qualité de processus, c'est exercer la sensibilité face au serve, la réciprocité dans le return et l'échafaudage dans Emotional Support, Classroom Organization et Instructional Support. Le reste est tableau de bord d'observation, alerte wearable et décompte algorithmique de tours. Ce n'est pas la qualité de l'interaction pédagogico-relationnelle, et cela ne doit pas se présenter comme ce qu'elle n'est pas.

Laboratoire éditorial de NEXTECH.IA / Ingénieur Mitre.

Références

  1. Center on the Developing Child at Harvard University. (s. f.). Serve and return. https://developingchild.harvard.edu/key-concept/serve-and-return/
  2. Chen, J. J. (2024). A scoping study on AI affordances in early childhood education: Mapping the global landscape, identifying research gaps, and charting future research directions. Journal of Artificial Intelligence Research, 81, 701–740. https://doi.org/10.1613/jair.1.16882
  3. European Commission. (2022). Ethical guidelines on the use of artificial intelligence (AI) and data in teaching and learning for educators. Publications Office of the European Union. https://doi.org/10.2766/153756
  4. Ferjan Ramírez, N., Hippe, D. S., y Kuhl, P. K. (2021). Comparing automatic and manual measures of parent–infant conversational turns: A word of caution. Child Development, 92(2), 672–681. https://doi.org/10.1111/cdev.13495
  5. Finders, J. K., Budrevich, A., Duncan, R. J., Purpura, D. J., Elicker, J., y Schmitt, S. A. (2021). Variability in preschool CLASS scores and children’s school readiness. AERA Open, 7. https://doi.org/10.1177/23328584211038938
  6. Gómez, E., y Strasser, K. (2021). Language and socioemotional development in early childhood: The role of conversational turns. Developmental Science, 24(5), e13109. https://doi.org/10.1111/desc.13109
  7. Gómez-Muzzio, E., y Strasser, K. (2025). Conversational turns at early childhood predicts socioemotional development at school age. Social Development, 34(4), e70019. https://doi.org/10.1111/sode.70019
  8. Green, A. L., Olsen, A. A., y Nandakumar, V. (2023). Increasing teacher opportunities to respond in a Head Start program using a bug-in-ear coaching model. Early Childhood Education Journal, 52(6), 1107–1119. https://doi.org/10.1007/s10643-023-01498-4
  9. Howard, S. J., Lewis, K. L., Walter, E., Verenikina, I., y Kervin, L. K. (2024). Measuring the quality of adult–child interactions in the context of ECEC: A systematic review on the relationship with developmental and educational outcomes. Educational Psychology Review, 36, 6. https://doi.org/10.1007/s10648-023-09832-3
  10. Ljungcrantz, L. (2026). The interaction of AI and early childhood education. A state-of-the-art review 2020–2024. Early Childhood Education Journal, 54, 3565–3581. https://doi.org/10.1007/s10643-025-02079-3
  11. LoCasale-Crouch, J., Romo-Escudero, F., Clayback, K., Whittaker, J., Hamre, B., y Melo, C. (2023). Results from a randomized trial of the Effective Classroom Interactions for toddler educators professional development intervention. Early Childhood Research Quarterly, 65, 217–226. https://doi.org/10.1016/j.ecresq.2023.06.005
  12. Miao, F., y Holmes, W. (2023). Guidance for generative AI in education and research. UNESCO. https://doi.org/10.54675/EWZM9535
  13. NAEYC. (2022). Developmentally appropriate practice in early childhood programs serving children from birth through age 8 (4.ª ed.). NAEYC. https://www.naeyc.org/resources/pubs/books/dap-fourth-edition
  14. OECD. (2021). Starting Strong VI: Supporting meaningful interactions in early childhood education and care. OECD Publishing. https://doi.org/10.1787/f47a06ae-en
  15. OECD. (2023). Empowering young children in the digital age (Starting Strong). OECD Publishing. https://doi.org/10.1787/50967622-en
  16. Paschall, K. W., Barnett, M. A., Mastergeorge, A. M., Li, X., y Vasquez, M. B. (2023). A new look at teacher interactional quality: Profiles of individual teacher–child relationship and classroom teaching quality among Head Start students. Early Education and Development, 34(5), 1172–1190. https://doi.org/10.1080/10409289.2022.2094159
  17. Ramakrishnan, A., Zylich, B., Ottmar, E., LoCasale-Crouch, J., y Whitehill, J. (2023). Toward automated classroom observation: Multimodal machine learning to estimate CLASS Positive Climate and Negative Climate. IEEE Transactions on Affective Computing, 14(1), 664–679. https://doi.org/10.1109/TAFFC.2021.3059209
  18. Su, J., y Yang, W. (2022). Artificial intelligence in early childhood education: A scoping review. Computers and Education: Artificial Intelligence, 3, 100049. https://doi.org/10.1016/j.caeai.2022.100049
  19. UNESCO. (2021). Recommendation on the ethics of artificial intelligence. UNESCO. https://unesdoc.unesco.org/ark:/48223/pf0000381137
  20. U.S. Department of Education, Office of Educational Technology. (2023). Artificial intelligence and the future of teaching and learning: Insights and recommendations. U.S. Department of Education. https://www.ed.gov/sites/ed/files/documents/ai-report/ai-report.pdf
  21. von Suchodoletz, A., Lee, D. S., Henry, J., Tamang, S., Premachandra, B., y Yoshikawa, H. (2023). Early childhood education and care quality and associations with child outcomes: A meta-analysis. PLOS ONE, 18(5), e0285985. https://doi.org/10.1371/journal.pone.0285985
  22. Whitehill, J., y LoCasale-Crouch, J. (2024). Automated evaluation of classroom Instructional Support with LLMs and BoWs: Connecting global predictions to specific feedback. Journal of Educational Data Mining, 16(1), 34–60. https://doi.org/10.5281/zenodo.10974824