Communications libres
Vendredi le 20 novembre
Salle
Communication A (10 h 30)
Comment les chercheurs coconstruisent-ils les savoirs en mesure? Le cas (fascinant) de lz*
Sébastien Béland (Université de Montréal)
Cette présentation retrace, dans une perspective sociohistorique, l’évolution de l’indice de détection des réponses inappropriées (person-fit) lz*, vingt-cinq ans après la parution de l’article fondateur de Snijders (2001). Il sera d’abord montré en quoi le développement de cette statistique s’inscrit dans l’héritage des séries de Taylor, puis une chronologie des travaux ayant contribué à son émergence et à son approfondissement sera proposée. La science est une activité fondamentalement collective, structurée par les échanges, les influences réciproques et la critique entre chercheurs. L’histoire de lz* et des développements qui l’ont suivie illustre bien l’idée, défendue notamment par Polanyi (1962), selon laquelle le savoir scientifique se construit au sein de réseaux de chercheurs dont l’autorité repose avant tout sur la reconnaissance mutuelle. L’examen de 23 articles jugés essentiels met ainsi en lumière les interactions au sein de cette communauté scientifique et révèle la dimension sociale du travail en mesure. La présentation abordera également des résultats issus de comparaisons entre lz* et d’autres statistiques de détection de réponses inappropriées, ainsi qu’une application de lz* à des données réelles. Enfin, quelques recommandations pratiques seront formulées.
Communication B (10 h 50)
Items dépendants dans l’analyse de Rasch : un cadre correctif et diagnostique pour traiter la redondance informationnelle et distinguer la multidimensionnalité
Martin Riopel (Université du Québec à Montréal)
Dans les analyses de Rasch, une question pratique revient souvent : que faire avec des items dépendants? Faut-il les éliminer pour améliorer l’ajustement, les regrouper, ou peut-on les conserver sans surcompter l’information qu’ils apportent? Cette question met directement en tension une exigence théorique centrale — l’indépendance locale — et des décisions concrètes de traitement des données en mesure et en évaluation. Cette communication propose un cadre correctif et diagnostique pour éclairer une distinction souvent délicate en pratique : celle entre une dépendance locale structurelle liée à une redondance informationnelle entre items et une dépendance révélant une multidimensionnalité réelle. L’idée centrale est simple : lorsqu’une association résiduelle positive entre items reflète surtout un chevauchement d’information, il n’est pas toujours nécessaire d’éliminer ces items. Leur contribution peut être corrigée de manière conservatrice afin de réduire l’excès d’information, tout en demeurant compatible avec les procédures usuelles d’estimation et d’interprétation. La démarche sera illustrée à partir de trois cas contrastés : une duplication parfaite, une redondance partielle entre items et une dépendance liée à une structure multidimensionnelle. Dans les deux premiers cas, la correction permet soit de conserver exactement l’information utile sans double comptage, soit d’améliorer l’ajustement tout en préservant les items. Dans le troisième, l’échec de la correction devient lui-même informatif et oriente vers une autre interprétation psychométrique. L’objectif est de montrer qu’entre la conservation d’items dépendants et leur élimination automatique, il existe une troisième voie : traiter certaines dépendances locales comme un problème de redondance informationnelle et utiliser leur correction comme outil diagnostique pour soutenir des décisions plus nuancées. En ce sens, cette proposition constitue aussi une première étape vers un cadre théorique compatible avec le modèle de Rasch, qui maintient l’exigence d’unidimensionnalité tout en proposant un traitement plus systématique et théoriquement fondé de certaines dépendances locales.
Communication C (11 h 10)
Analyse des biais d’auto-évaluation et d’hétéro-évaluation par modèles linéaires mixtes
David Jan (Université de Fribourg)
Cette étude examine la structure des notes attribuées lors d’exercices d’évaluation dans un échantillon de 122 observations réparties entre 28 étudiants répartis en cinq groupes de travail. L’objectif est d’identifier l’influence du statut de l’évaluateur (auto-évaluation ou évaluation d’autrui) et du groupe évalué sur la variabilité des notes. À la fin de chacune des cinq présentations, les étudiant·e·s disposaient d’un temps dédié à l’évaluation ou à l’auto-évaluation de chaque prestation au moyen de quatre questions portant sur la qualité globale. Afin de garantir un anonymat maximal, les informations recueillies comprenaient uniquement le groupe d’appartenance, le groupe évalué et les quatre scores de qualité. Les résultats du modèle vide indiquent que 1,8 % de la variance des scores est attribuable à l’identité individuelle de l’étudiant·e et 3,3 % à son groupe d’appartenance, selon les coefficients de corrélation intraclasse. L’ajustement du modèle est significativement optimisé par l’inclusion du groupe évalué et de l’auto-évaluation, ces deux facteurs structurant l’essentiel de la variabilité des scores au sein de l’échantillon. L’identité du groupe évalué exerce une influence prépondérante (F(4, 88,4) = 16,68, p < ,001), avec des évaluations fortement différenciées selon les cibles, ce qui témoigne d’une hétérogénéité marquée dans la perception des performances entre les différents groupes. Le facteur auto-évaluation est significatif (β = -0,82, SE = 0,25, p = 0,002), indiquant une divergence systématique de notation lorsque l’étudiant s’évalue lui-même par rapport à l’évaluation d’un tiers. Finalement, l’interaction entre l’auto-évaluation et le groupe évalué n’est pas significative. Cela suggère que le biais d’auto-évaluation est un phénomène constant et indépendant de la performance spécifique des groupes. En conclusion, l’étude démontre une tendance à l’autocritique systématique : les étudiant·e·s évaluent leur propre travail plus sévèrement que leurs pairs.
Communication D (11 h 30)
Portrait de l’évaluation du code linguistique chez les élèves du secondaire : comparaison des critères dans les épreuves de production écrite de plusieurs juridictions éducatives
Aristide Sorelle Tsayem Tchoupou (Université Laval)
Jean-Guy Blais (Université de Montréal)
Serge Sévigny (Université Laval)
Dans plusieurs juridictions éducatives francophones ou bilingues, les élèves doivent démontrer leur maîtrise du code linguistique (orthographe, syntaxe, ponctuation) dans des épreuves certificatives de production écrite. Or, les modalités d’évaluation de ces conventions linguistiques varient considérablement d’un système à l’autre, tant dans la nature des critères que dans leur opérationnalisation (approche quantitative fondée sur le décompte d’erreurs ou approche qualitative globale). S’inscrivant dans le champ de l’évaluation des apprentissages, cette communication vise à dresser un portrait comparatif des critères d’évaluation du code linguistique dans différentes juridictions (Québec, Alberta, Ontario, Colombie-Britannique, France, Cameroun). Elle s’appuie sur une analyse documentaire des cadres d’évaluation et des grilles de correction rendus publics par les ministères et les organismes en charge de l’évaluation des apprentissages au niveau secondaire. Les critères analysés portent sur le poids accordé au code linguistique, les seuils de réussite, les types d’erreurs considérées et la nature du jugement attendu (analytique ou holistique). L’analyse met en évidence des conceptions contrastées de l’évaluation du code linguistique selon les juridictions. Certaines, comme le Québec, utilisent une approche fondée sur le décompte des erreurs. D’autres, comme la France, privilégient une évaluation holistique où la correction linguistique est intégrée à l’appréciation globale du texte. En Alberta, en Ontario et en Colombie-Britannique, l’évaluation repose davantage sur des descripteurs de niveaux de maîtrise intégrant syntaxe, orthographe et ponctuation dans une progression qualitative. Au Cameroun, la grille organise l’évaluation en critères pondérés où le code linguistique constitue une dimension parmi d’autres, sans seuil éliminatoire explicite. Cette analyse illustre la présence de pratiques différentes et la particularité du Québec quant à l’évaluation du code linguistique dans les épreuves certificatives de production écrite en français.