Produit

Prepamigo contre Claude pour le CELPIP Writing : lequel vous donne la bonne note?

8 septembre 2026

Part des rédactions notées au niveau vérifié

36 réponses écrites officielles du CELPIP, 12 à chacun des trois niveaux, sur les deux tâches de Writing. Claude a reçu la tâche et la rédaction et a été invité, en langage simple, à la noter sur l'échelle du CELPIP. Le correcteur de Writing de Prepamigo a fonctionné comme il le fait en production.

86%

Correcteur de Writing Prepamigo

61%

Claude Opus 5

56%

Claude Sonnet 5

Prepamigo comparé aux meilleurs forfaits de clavardeurs IA

En dollars canadiens. Les prix de Prepamigo incluent les taxes. Claude Max (à partir de US$100) et ChatGPT Pro (US$200) sont convertis au taux de 1,38, avant taxes. La précision correspond à la part des 36 rédactions officielles notées au niveau vérifié lorsque le modèle nommé est invité, en langage simple, à noter la rédaction; un seul essai.

Prepamigo
Claude MaxOpus 5
Prix mensuel
CA$24.98 (taxe incl.)
CA$138+ (taxe en sus)
Notation
Illimitée
Plafonnée
Banque de questions prête à l'emploi
Oui
Non
Séries d'exercices
80
Aucune
Tâches d'exercice
2,000+
Aucune
Format CELPIP
Oui
Non
Précision
86%
61%
Rédactions de niveau moyen
100%
25%

Le Writing est l’épreuve où un clavardeur IA paraît le plus convaincant comme correcteur. Il n’y a aucun enregistrement à transcrire, aucun accent dont il faut se soucier, seulement du texte qui entre et un chiffre qui sort, accompagné d’un paragraphe d’explication assurée. Nous avons donc testé ce chiffre. Nous avons donné à Claude les mêmes 36 réponses écrites officielles du CELPIP sur lesquelles notre propre correcteur est mesuré, douze à chaque niveau, et lui avons demandé de les noter comme le demanderait un candidat.

La réponse courte : le correcteur de Writing de Prepamigo a trouvé le niveau vérifié 86% du temps. Claude Opus 5 l’a trouvé 61% du temps et Claude Sonnet 5 56% du temps. L’écart n’est pas réparti également. Sur les rédactions faibles et sur les rédactions fortes, Claude est honorable, et au sommet, Opus 5 fait même mieux que nous. Sur les rédactions de niveau moyen, les 7 et les 8 que la plupart des candidats écrivent réellement, Opus 5 avait raison une fois sur quatre et Sonnet 5 une fois sur trois. Prepamigo avait raison sur les douze.

Le reste de cet article passe en revue ces résultats niveau par niveau, explique pourquoi un modèle généraliste perd le milieu de l’échelle, examine ce que vaut la rétroaction de chaque côté et compare ce que coûte une pratique sérieuse du Writing avec chacun. Nous avons essayé d’être justes envers Claude tout du long, y compris pour le seul endroit où il nous a battus.

Le test simple : ce qu’obtient réellement un candidat

Quatre-vingt-six pourcent contre soixante et un et cinquante-six. Sur 36 rédactions, cela représente neuf notes correctes de plus qu’Opus 5 et onze de plus que Sonnet 5. Autrement dit, Prepamigo commet 64% moins d’erreurs de notation qu’Opus 5 et 69% moins que Sonnet 5 sur les mêmes rédactions.

Ce que Claude a reçu compte, alors le voici. Chaque modèle s’est fait dire qu’il était un examinateur expérimenté du CELPIP Writing, a reçu la tâche exactement comme le candidat l’a vue, y compris les points exigés pour la tâche du courriel et les options pour la tâche du sondage, et a reçu la rédaction. On lui a demandé une seule note de 0 à 12. C’est toute la consigne. C’est ce que vous taperiez dans une fenêtre de clavardage, et c’est un test plus juste qu’un simple « note ceci » d’une ligne, parce que le modèle sait au moins ce que la tâche demandait.

Le correcteur de Prepamigo a reçu la même tâche et la même rédaction. Il avait aussi ce qu’il a toujours en production : de vrais exemples de rédactions notées pour cette tâche à chaque niveau, pour comparer, et une couche de règles qui vérifie ce qu’un évaluateur vérifie en premier, comme la présence de chaque point exigé, le fait qu’une réponse au sondage prenne vraiment position, la présence d’une salutation et d’une formule de clôture dans un courriel, et la longueur de la réponse.

Là où l’écart s’ouvre : niveau par niveau

Un chiffre global cache où tombent les erreurs, et en Writing, les erreurs tombent à un seul endroit. Voici les mêmes résultats répartis par niveau vérifié : les rédactions faibles notées 4 ou 5, les rédactions moyennes notées 7 ou 8, et les rédactions fortes notées 10 et plus.

Rédactions faibles (note vérifiée de 4 ou 5)

12 rédactions officielles. Les erreurs de Claude ici sont surtout des 3, un niveau plus bas.

75%

Correcteur de Writing Prepamigo

67%

Claude Opus 5

50%

Claude Sonnet 5

Sur les rédactions faibles, Prepamigo est à 75%, Opus 5 à 67%, Sonnet 5 à 50%. Les trois erreurs de Prepamigo sont toutes allées un cran trop haut, à 6 ou 7, sur des rédactions courtes mais soignées. Les erreurs de Claude vont dans l’autre sens : Sonnet 5 a donné un 3 à quatre des douze rédactions faibles, et Opus 5 en a noté deux à 3. Un 3 sur cette échelle, c’est une réponse qui aborde à peine la tâche. Ces rédactions l’abordent; elles sont simplement minces. Claude, sans exemple de ce à quoi ressemble un 4, lit « mince » comme un échec.

Rédactions moyennes (note vérifiée de 7 ou 8)

12 rédactions officielles. C'est le niveau où se trouvent la plupart des candidats, et le niveau où Claude échoue.

100%

Correcteur de Writing Prepamigo

33%

Claude Sonnet 5

25%

Claude Opus 5

Le milieu, c’est toute l’histoire. Prepamigo a noté les douze rédactions de niveau moyen à l’intérieur de la bande 7 à 8. Opus 5 en a réussi trois; Sonnet 5 en a réussi quatre. Les erreurs d’Opus 5 étaient presque toutes vers le haut : il a donné un 9 à six des douze et un 10 à une. Sonnet 5 s’est partagé dans les deux sens, avec quatre rédactions poussées vers le bas à 6 et quatre poussées vers le haut à 9 ou 10.

Réfléchissez à ce que cela signifie pour le candidat qui a écrit l’une de ces rédactions. Un 7 ou un 8 est la note réelle la plus fréquente à l’examen, et c’est la note qui décide si vous avez atteint votre cible d’immigration ou non. Demandez à Opus 5, et plus de la moitié du temps il vous dira que vous êtes un 9 ou un 10, prêt à arrêter de pratiquer. Vous ne l’êtes pas. Demandez à Sonnet 5, et une fois sur trois il vous dira que vous avez glissé à 6. Ce n’est pas le cas. Aucune de ces deux réponses ne vous aide à décider quoi faire ensuite.

Rédactions fortes (note vérifiée de 10 ou plus)

12 rédactions officielles. Le seul niveau où Claude Opus 5 bat Prepamigo.

92%

Claude Opus 5

83%

Correcteur de Writing Prepamigo

83%

Claude Sonnet 5

Au sommet, Opus 5 est le meilleur correcteur de ce test : onze rédactions fortes sur douze reconnues. Prepamigo et Sonnet 5 en ont reconnu dix chacun. Les deux erreurs de Prepamigo étaient toutes deux un 9, un cran en dessous; celles de Sonnet 5 étaient un 9 et un 7. Nous le rapportons parce que c’est vrai, et parce que cela explique le schéma d’ensemble : Claude est généreux. Il distribue des 9, des 10 et des 11 sans compter, ce qui se trouve à être juste sur les rédactions fortes et faux sur tout le reste.

Si vous utilisez Claude pour noter vos textes et qu’il vous donne un 9, traitez-le comme une note de niveau moyen jusqu’à ce qu’autre chose le confirme. Dans notre test, une rédaction à laquelle Opus 5 donnait un 9 avait plus de chances d’être un 7 ou un 8 vérifié qu’un 9 ou un 10 vérifié.

Pourquoi un clavardeur IA perd le milieu de l’échelle

Une rédaction de niveau moyen au CELPIP est une chose bien précise. Elle couvre la tâche, elle est organisée, elle comporte peu d’erreurs qui bloquent la compréhension, et elle est aussi générique : les raisons sont affirmées plutôt que développées, le vocabulaire est prudent, les phrases ont toutes la même forme. Un évaluateur qui en a vu des centaines sait exactement où elle se situe. Un modèle généraliste n’en a pas vu des centaines étiquetées comme des 7. Il a vu un texte propre, organisé, presque sans faute, et il tend vers un chiffre élevé.

C’est toute la différence. Le correcteur de Prepamigo ne juge pas une rédaction par rapport à une idée de la bonne écriture. Il la juge par rapport à de vraies rédactions notées pour la même tâche : une au niveau faible, une au milieu, une au sommet, toutes de vraies réponses avec de vrais faux pas. Une rédaction propre mais générique atterrit à côté de l’exemple moyen parce que c’est à lui qu’elle ressemble le plus. Une rédaction mince atterrit à côté de l’exemple faible plutôt qu’en dessous, parce que l’exemple faible est mince lui aussi et reste tout de même un 4.

Par-dessus la comparaison se trouve une couche de règles qui s’occupe de ce qu’un modèle compte mal. Le courriel a-t-il couvert les trois points exigés, ou seulement deux? La réponse au sondage a-t-elle vraiment choisi une option, ou hésité entre les deux? Y a-t-il une salutation et une formule de clôture? La réponse fait-elle 180 mots ou 60? Un point exigé manqué maintient la note d’exécution de la tâche à 8 ou moins, peu importe la qualité de l’anglais, parce que c’est ainsi que fonctionne l’examen. Claude, interrogé simplement, n’a ni plancher ni plafond de ce genre; il décide de tout à l’impression.

Nous avons testé si le fait de renseigner Claude sur les niveaux réglait le problème. Ce n’est pas le cas, à lui seul. Donner une grille à un modèle produit la même dérive. Ce qui fait bouger le chiffre, c’est de lui donner les vrais exemples notés et une couche de règles, ce qui est une autre façon de dire : construire un correcteur.

L’écart de flux de travail : ce que vous devez apporter

Le Writing est l’épreuve où Claude est le plus facile à utiliser comme correcteur, et cela vaut la peine d’être honnête à ce sujet. Vous collez la rédaction, vous obtenez une note en quelques secondes, et si vous voulez qu’il s’explique, il le fera, longuement. Il n’y a aucune étape de transcription, aucun audio, aucune préparation. Pour un second avis rapide, c’est vraiment pratique.

Ce que vous n’obtenez pas, c’est la tâche. Claude n’a pas de banque de consignes de courriel et de sondage de style CELPIP avec les bons points exigés, les bonnes options et le bon nombre de mots, alors soit vous rédigez votre propre consigne en espérant qu’elle ressemble à l’examen, soit vous pratiquez sur ce que vous trouvez. Vous n’obtenez pas de vérification des points exigés, parce que Claude ne sait pas quels points le vrai examen énumérerait. Vous n’obtenez pas de réponse modèle réécrite à partir de votre propre rédaction à la bonne longueur. Et vous n’obtenez pas un chiffre étalonné sur de vraies rédactions notées, ce qui explique pourquoi le milieu de l’échelle se dérègle.

Sur Prepamigo, vous ouvrez une tâche dans la banque, le minuteur tourne, vous écrivez, et environ une minute après avoir soumis, vous avez quatre notes par dimension, une note globale, la liste de tout ce que vous avez manqué, des corrections citées de votre propre texte et une réponse modèle réécrite. La quarantième rédaction du mois vous coûte le même effort que la première.

La même rédaction, la même note

Une note que l’on ne peut pas reproduire n’est pas une mesure. Si la même rédaction obtient un 8 aujourd’hui et un 10 demain, vous n’avez rien appris sur votre écriture. Après l’exécution principale, nous avons donc noté les 36 rédactions deux fois de plus, à des jours différents. Le correcteur de Writing de Prepamigo a obtenu 86%, 89% et 86% sur les trois exécutions, avec les mêmes douze rédactions de niveau moyen à l’intérieur de la bande chaque fois.

Les exécutions de Claude ont bougé elles aussi, mais la forme de ses erreurs, non : à chaque exécution, la plupart des rédactions de niveau moyen sont revenues avec un 9 d’Opus 5, et les rédactions faibles ont continué de récolter des 3 de Sonnet 5. Cette constance est la constatation utile. Le problème n’est pas que Claude est instable. C’est que Claude est mal étalonné avec assurance, dans la même direction chaque fois, ce qui est plus difficile à remarquer.

Rétroaction : une bonne explication du mauvais chiffre

Claude écrit d’excellents textes de rétroaction. Ils sont clairs, patients et précis, et si vous lui demandez d’expliquer pourquoi une rédaction est un 9, il produira un paragraphe convaincant. L’ennui, c’est que le paragraphe est écrit pour justifier un chiffre qu’il a déjà choisi, et quand le chiffre est faux, l’explication l’est avec lui. Une rédaction qui est en réalité un 7 se fait louanger pour des qualités qu’elle n’a pas, et le candidat repart rassuré.

La rétroaction de Prepamigo fonctionne dans l’autre sens. Chaque correction cite les mots exacts de votre rédaction, et tout ce que le vérificateur ne retrouve pas dans votre texte est retiré avant que vous le voyiez. Un point exigé manqué est nommé. Chaque dimension reçoit un seul facteur limitant, ou une affirmation claire que rien ne la retient. Et vous recevez une réponse modèle réécrite à partir de votre propre réponse, à la longueur que demande la tâche, pour que vous voyiez l’écart au lieu de le lire. La section ci-dessous énumère ce qui a changé dans la couche de rétroaction.

Ce qui est nouveau dans vos commentaires de Writing

La note n'est que la moitié de ce que vous recevez. La couche de commentaires de Writing a été reconstruite en même temps que le correcteur, et tout ce qu'elle contient est ancré dans votre propre texte. Voici ce qui a changé.

  • Des corrections que vous pouvez retrouver dans votre propre rédaction. Chaque correction de grammaire, d'orthographe et de vocabulaire cite les mots exacts de votre réponse, de sorte que l'application peut les surligner là où vous les avez écrits. Tout ce que le vérificateur ne retrouve pas mot pour mot dans votre rédaction est retiré avant que vous le voyiez.
  • Une réponse modèle, construite à partir de votre réponse. Vous recevez une version réécrite de votre propre réponse qui conserve vos idées, couvre chaque point exigé et tient dans les 150 à 200 mots que demande la tâche. Si la première réécriture rate cette longueur, elle est refaite une fois avant de vous être montrée.
  • Le point exigé que vous avez manqué, nommé. Pour la tâche du courriel, les commentaires énumèrent les points de la consigne que votre réponse n'a pas couverts. Un point manqué maintient aussi la note d'exécution de la tâche à 8 ou moins, de sorte que le chiffre et les commentaires ne se contredisent jamais.
  • Un seul facteur limitant par dimension. Pour chacune des quatre dimensions, les commentaires nomment la seule chose qui retient cette note, en termes concrets, ou disent clairement que rien ne la retient et ce qui la porte. Conclure qu'une dimension n'a aucun problème est une vraie réponse, pas un vide.
  • La critique au bon endroit. Un ton faible est un problème d'exécution de la tâche, un choix de mot vague est un problème de vocabulaire, une phrase interminable est un problème de lisibilité. Chaque point est classé sous la dimension à laquelle il appartient, au lieu d'être fondu dans le résumé général.
  • Des réécritures phrase par phrase. Des phrases précises de votre rédaction vous reviennent avec une version améliorée et une ligne expliquant pourquoi elle est meilleure, pour que vous voyiez le changement au lieu de simplement le lire.
  • Votre dimension la plus forte et la plus faible, côte à côte. Les commentaires vous indiquent laquelle des quatre dimensions porte votre note et laquelle la retient, pour que vous sachiez quoi pratiquer ensuite sans avoir à décoder quatre chiffres.

Chaque citation des commentaires est vérifiée dans votre rédaction avant d'être affichée. Si le vérificateur ne retrouve pas les mots, la ligne est supprimée. C'est pourquoi les commentaires ne vous demandent jamais de corriger quelque chose que vous n'avez pas écrit.

Ce que coûte la pratique au quotidien

Une note de Writing est la plus utile à votre trentième rédaction, pas à votre troisième. C’est à ce moment qu’elle commence à vous dire si un changement dans votre façon d’écrire fonctionne. La question pratique est donc ce que coûte chaque option quand on l’utilise en grand volume.

Claude Pro coûte US$20 par mois, environ CA$28, ou US$17 par mois en facturation annuelle, tel que publié sur claude.com en septembre 2026, avec une fenêtre d’utilisation glissante de cinq heures et une limite hebdomadaire. Les forfaits Max, à partir de US$100 par mois, environ CA$138 avant taxes, relèvent ces limites mais ne les éliminent pas. Aucun des forfaits n’inclut de banque de tâches, de minuteur, de vérification des points exigés, de réponse modèle, ni de note étalonnée sur de vraies rédactions notées.

Prepamigo coûte CA$24.98 par mois, ou CA$8.25 par mois sur le forfait annuel, soit CA$98.98 pour l’année, taxes incluses, et vous pouvez annuler à tout moment. Chaque forfait inclut une notation illimitée sans plafond quotidien, par séance ou hebdomadaire, des tentatives illimitées, et la banque de questions complète : 80 séries d’exercices complètes et plus de 2,000 tâches d’exercice couvrant le Writing, le Speaking, le Reading et le Listening, conçues pour suivre les types de tâches, le minutage et le format du test CELPIP General.

Quand Claude est le meilleur outil

  • Peaufiner une rédaction forte. Si vous êtes déjà à 10 et voulez savoir ce qu’exigerait un 11 ou un 12, Opus 5 reconnaît l’écriture forte de façon fiable et l’explique bien. C’est le seul niveau où il nous a battus.
  • Réécrire une phrase de cinq façons. Demander des variantes pour une phrase maladroite est rapide, et les suggestions sont bonnes.
  • En discuter. Si vous voulez débattre de la raison pour laquelle un argument est faible, une conversation est le bon format. Prepamigo vous donne un verdict et des preuves; il ne clavarde pas.
  • Tout ce qui sort du test. Claude est un assistant généraliste et Prepamigo ne l’est pas.

Ce que Claude ne devrait pas être, selon ces preuves, c’est ce qui dit à un rédacteur de niveau 7 ou 8 où il en est. C’est la majorité des candidats, et c’est exactement là que Claude se trompe trois fois sur quatre.

FAQ

Claude peut-il noter mon CELPIP Writing? Il vous donnera un chiffre. Sur 36 réponses officielles aux notes vérifiées, Claude Opus 5 avait raison 61% du temps et Claude Sonnet 5 56%, contre 86% pour Prepamigo. Sur les rédactions de niveau moyen : 25% et 33% contre 100%.

Prepamigo est-il plus précis que Claude en Writing? Globalement, oui, de 25 à 30 points. Sur les rédactions fortes, Opus 5 est meilleur, 92% contre 83%. Sur les rédactions de niveau moyen, là où se trouvent la plupart des candidats, l’écart est de 100% contre 25%.

Pourquoi Claude donne-t-il un 9 à ma rédaction moyenne? Sans rien pour comparer, une rédaction propre, organisée et générique paraît forte. Opus 5 a donné un 9 ou un 10 à sept des douze rédactions vérifiées à 7 ou 8. Prepamigo compare chaque rédaction à de vrais exemples notés pour la même tâche.

Combien coûte chacun? Claude Max commence à US$100 par mois, environ CA$138 avant taxes; Pro coûte US$20 avec des plafonds plus serrés. Prepamigo coûte CA$24.98 par mois taxes incluses, ou CA$8.25 par mois sur le forfait annuel, avec une notation illimitée et 80 séries d’exercices.

Pour la même comparaison face à ChatGPT, lisez Prepamigo contre ChatGPT pour le Writing. Pour savoir comment fonctionne le correcteur de Writing, lisez à l’intérieur du correcteur de Writing de Prepamigo. Vous pouvez aussi Lire ce guide en anglais. Ou Rédiger une réponse et voyez la note.

Prepamigo contre Claude pour le CELPIP Writing : lequel vous donne la bonne note? | PrepAmigo