Aller au contenu principal

Dans les coulisses du programme

Des erreurs expliquées. Un entraînement ciblé.

Un bon score peut cacher une difficulté qui revient. Nous avons amélioré le programme pour mieux la repérer, proposer du soutien ciblé et rendre les corrections plus claires. Voici ce que nos tests ont vérifié.

Par Dictée en ligne · équipe technique3 min

Les résultats essentiels

Correction vérifiée100 / 100

Appels conformes au référentiel du test final ; 50 entrées distinctes.

Difficulté récurrenteDès 3 essais

Soutien déclenché dans les 20 parcours a / à concernés.

Séances de test151 200

Contrôles du parcours réussis, avec des corrections préparées.

Suivi dans la durée90 séances

Par parcours, pour vérifier les décisions successives.

Des tests qui améliorent votre entraînement

Nous avons mis le programme à l’épreuve sur 1 680 parcours de 90 séances, puis rejoué les mêmes cas après amélioration. Ces historiques sont construits pour le test : ils vérifient le fonctionnement du logiciel, sans mesurer les progrès d’élèves.

01 · ComprendreUne correction plus claire

Un mot ajouté est expliqué. La ponctuation est rattachée au passage concerné.

02 · RepérerVoir au-delà du score

Une difficulté répétée peut déclencher du soutien, même avec un bon résultat global.

03 · S’entraînerTravailler la bonne notion

La priorité hebdomadaire intervient désormais dans le choix de l’exercice.

Un bon score ne doit pas masquer une difficulté

Dans le scénario « a / à », les scores restent entre 70 et 80 sur 100, mais la même confusion revient. Après trois essais concernés, le programme propose maintenant un exercice de soutien adapté, lorsqu’un contenu éligible est disponible.

Même parcours de test a / à avant et après amélioration : la nouvelle version insère une séance de soutien après les trois premières dictées.
Les douze premières séances d’un parcours enregistré. D : dictée du parcours ; S : soutien ciblé. Agrandir.

20 parcours sur 20 ont reçu une proposition de soutien après le troisième essai concerné. La version initiale n’en proposait aucun dans ce scénario. Le parcours continue ensuite, en tenant compte des exercices déjà réalisés.

Trouver une dictée à mon niveau →

Une correction qui montre quoi reprendre

Le nouveau contrôle des mots ajoutés explique précisément le passage à retirer. Voici un résultat du test, avec le même score de 80 avant et après amélioration.

Réponse : moto, lune, petit, ami, papa, midi. Correction : Tu as ajouté petit avant ami. Ce passage ne figure pas dans le texte de référence.
« Tu as ajouté “petit” avant “ami”. Ce passage ne figure pas dans le texte de référence. » Résultat retrouvé dans les deux appels concernés. Agrandir.
Avant / après · mêmes entrées83 → 100 / 100

Appels conformes au référentiel d’annotations après les améliorations : passages corrigés et catégories d’erreurs.

Réponses sans erreur36 / 36

Appels sans fausse alerte, sur 18 réponses distinctes correctes, chacune évaluée deux fois.

Ce volet comporte 50 entrées distinctes, chacune évaluée deux fois. Il teste toute la chaîne de correction, y compris les contrôles du logiciel. Le résultat décrit cet échantillon repris après correction ; il ne garantit pas la justesse de toutes les futures réponses.

La bonne notion, dans le bon exercice

La sélection hebdomadaire utilise désormais la difficulté prioritaire pour rechercher un exercice dont l’objectif pédagogique correspond. Nos tests vérifient que, pour un même utilisateur, une priorité « accords » et une priorité « conjugaison » conduisent à des exercices aux objectifs différents. Le choix reste lié au contenu disponible et aux exercices déjà réalisés.

ma · miOrthographe
é / èAccents
+ sAccords
être / avoirConjugaison
AaMajuscules
. ! ?Ponctuation
a / àHomophones

Sept familles d’erreurs, du CP à la 6e, et douze scénarios : erreurs fréquentes, rechutes, séances espacées, contenu de soutien disponible ou absent. Les 151 200 séances passent les contrôles de score, de correction préparée et d’enregistrement unique.

Méthode et résultats détaillés

Comment avons-nous vérifié ces améliorations ?

Évaluation interne de l’équipe Dictée en ligne, publiée le 24 septembre et mise à jour le 25 septembre 2026. Sept groupes × douze scénarios × vingt variantes reproductibles donnent 1 680 parcours de 90 séances. Les répétitions ne sont pas des participants indépendants. Les historiques sont construits, et l’évolution des erreurs est fixée par le protocole.

Les séances utilisent le service de tentative, le calcul de score et le sélecteur du produit, avec un correcteur contrôlé et une sauvegarde JSON locale. Les catalogues portent sur une seule notion et trois références par groupe : 21 textes au total. Ce volet ne valide pas l’audio, le navigateur, la base de production ou le classement de plusieurs difficultés concurrentes.

Le contrôle séparé de correction utilise Claude Sonnet 5 sur 100 appels (50 entrées distinctes répétées deux fois). Les entrées et le référentiel sont conservés à l’identique entre versions. Les résultats successifs sont 83, puis 89, puis 100 appels conformes sur 100. Toutes les réponses sont archivées ; aucune sélection des meilleures réponses n’a été effectuée. Les scores sont calculés par le logiciel.

Les cas ayant guidé les améliorations sont aussi ceux rejoués : il s’agit d’un contrôle de régression, pas d’une validation indépendante sur de nouveaux textes. Le référentiel et la revue ont été préparés avec un assistant de programmation et n’ont pas été validés indépendamment par des enseignants. La conformité des annotations ne mesure pas à elle seule la qualité pédagogique des explications.

Le soutien dépend de la notion, des prérequis, du format, de la longueur et du contenu éligible non réalisé récemment. Le test hebdomadaire vérifie également le filtrage des objectifs documentés sur une base SQLite locale. Un contenu sans objectif correspondant n’est pas présenté comme ciblé.

Ces résultats ne démontrent pas un gain d’apprentissage. Pour le mesurer, il faudra un suivi d’élèves, des évaluations sur des textes nouveaux et un groupe de comparaison. Les données présentes permettent de vérifier les décisions du système et les corrections apportées.

Comparer les versions et consulter les preuves

Les améliorations concernent les erreurs récurrentes malgré un score élevé, le choix hebdomadaire par objectif, les mots ajoutés, la cohérence des catégories et le repérage de la ponctuation. Les deux appels initialement sans explication pour un mot ajouté sont maintenant expliqués.

Résultats et comparaison avant / après (JSON) · Protocole, historiques et trois versions des corrections (ZIP).

Archive initiale du 24 septembre. Les observations initiales restent accessibles pour retracer les améliorations.

Pour citer : Équipe Dictée en ligne (2026), Des erreurs expliquées. Un entraînement ciblé. Évaluation technique interne sur historiques construits, version du 25 septembre 2026. 1 680 parcours de 90 séances ; volet distinct de 100 appels de correction.

Adresse de référence · Notre méthode pédagogique.

Questions fréquentes sur cette évaluation

Ces résultats prouvent-ils que les élèves progressent ?

Non. L’amélioration est fixée par le scénario de test. Il faut suivre de vrais élèves avec des évaluations indépendantes pour mesurer un apprentissage et un groupe de comparaison pour en attribuer les effets au programme.

Les 151 200 séances ont-elles toutes été corrigées par une IA ?

Non. Elles utilisent des réponses de correction contrôlées pour tester le programme. Les résultats du modèle proviennent d’un échantillon séparé de 100 appels, soit 50 entrées distinctes répétées deux fois.

Peut-on citer cette étude ?

Oui, comme évaluation technique interne sur données synthétiques, mise à jour le 25 septembre 2026. Elle n’a pas fait l’objet d’une revue scientifique indépendante et ne constitue pas une preuve d’efficacité pédagogique.

Pour aller plus loin

Données et annexes techniques

À votre tour de choisir une dictée

Choisissez votre niveau et découvrez la correction après votre première dictée.

Choisir ma dictée