Notre méthode
Presque toutes les préparations en ligne annoncent « une note par IA ». Aucune ne montre à quel point cette note ressemble à celle d'un vrai correcteur. Nous avons décidé de le mesurer, et de publier le résultat.
Où en est-on ?
Statut au 28 septembre 2026 : calibration en préparation. Tant que les résultats ne sont pas publiés ici, chaque niveau affiché par notre correcteur est une estimation non vérifiée, et nous l'écrivons à côté.
Comment nous mesurons
- Nous réunissons environ 200 copies et enregistrements d'entraînement, de tous niveaux, avec l'accord de leurs auteurs.
- 2 à 3 correcteurs humains qualifiés en français langue étrangère notent chaque copie selon les critères officiels du TCF, sans voir la note de l'IA ni celle des autres correcteurs.
- Notre IA corrige les mêmes copies.
- Nous comparons : écart moyen en niveaux, pourcentage de copies au même niveau, pourcentage à un niveau près, et l'accord entre les humains eux-mêmes (pour savoir ce qu'un « bon » score veut dire).
Ce que nous publierons
- Les chiffres ci-dessus, par épreuve (écrit, oral) et par niveau.
- Les cas où l'IA se trompe le plus souvent, et dans quel sens (trop sévère ou trop indulgente).
- La date de la mesure et la version de la correction évaluée. Chaque changement de notre correction est retesté sur ce corpus avant d'être mis en ligne.
Les critères utilisés
Nous appliquons les critères publiés par France Éducation international dans le Manuel du candidat du TCF : linguistique (lexique, grammaire, orthographe, élaboration des phrases), pragmatique (cohérence, développement du thème) et sociolinguistique (adaptation à la situation). Les règles qui mènent à « A1 non atteint » (nombre de mots, hors sujet, texte appris par cœur) sont vérifiées en premier.
Vos données
Un texte n'entre dans le corpus de vérification que si son auteur l'a accepté par une case séparée, décochée par défaut. Il est alors anonymisé.