Produit

Prepamigo contre ChatGPT pour le CELPIP Writing : précision, limites et coût

8 septembre 2026

Part des rédactions notées au niveau vérifié

36 réponses écrites officielles du CELPIP, 12 à chacun des trois niveaux, sur les deux tâches de Writing. Chaque modèle GPT a reçu la tâche et la rédaction et a été invité, en langage simple, à la noter sur l'échelle du CELPIP. Le correcteur de Writing de Prepamigo a fonctionné comme il le fait en production.

86%

Correcteur de Writing Prepamigo

78%

GPT 5.6 sol

69%

GPT 5.6 luna

58%

GPT-4o mini

Prepamigo comparé aux meilleurs forfaits de clavardeurs IA

En dollars canadiens. Les prix de Prepamigo incluent les taxes. Claude Max (à partir de US$100) et ChatGPT Pro (US$200) sont convertis au taux de 1,38, avant taxes. La précision correspond à la part des 36 rédactions officielles notées au niveau vérifié lorsque le modèle nommé est invité, en langage simple, à noter la rédaction; un seul essai.

Prepamigo
ChatGPT ProGPT 5.6 sol
Prix mensuel
CA$24.98 (taxe incl.)
CA$276 (taxe en sus)
Notation
Illimitée
Plafonnée
Banque de questions prête à l'emploi
Oui
Non
Séries d'exercices
80
Aucune
Tâches d'exercice
2,000+
Aucune
Format CELPIP
Oui
Non
Précision
86%
78%
Rédactions de niveau moyen
100%
75%

ChatGPT est probablement l’outil le plus utilisé par les candidats au CELPIP pour vérifier leurs textes. On colle le courriel, on demande une note, on reçoit un chiffre et un paragraphe. C’est rapide, c’est sur votre téléphone, et pour le Writing, aucune étape de transcription ne se met en travers. Nous avons donc testé ce chiffre. Nous avons donné à trois modèles GPT les mêmes 36 réponses écrites officielles du CELPIP sur lesquelles notre propre correcteur est mesuré, douze à chaque niveau, et leur avons demandé de noter les rédactions comme le demanderait un candidat.

La réponse courte : le correcteur de Writing de Prepamigo a trouvé le niveau vérifié 86% du temps. GPT 5.6 sol, le modèle derrière les forfaits payants de ChatGPT, l’a trouvé 78% du temps. GPT 5.6 luna a atteint 69% et GPT-4o mini 58%. Huit points, c’est un vrai écart, et il vient de deux endroits : le milieu de l’échelle, où Prepamigo a noté correctement les douze rédactions et GPT 5.6 sol en a réussi neuf, et le sommet, où GPT 5.6 sol a retenu un quart des rédactions fortes à 9.

Disons-le d’emblée : GPT 5.6 sol est le meilleur correcteur généraliste de Writing que nous ayons testé, loin devant tout modèle Claude sur les mêmes rédactions. Le reste de cet article passe en revue les résultats niveau par niveau, explique d’où viennent les huit points, examine la rétroaction de chaque côté et compare ce que coûte une pratique sérieuse du Writing avec chacun.

Le test simple : ce qu’obtient réellement un candidat

Quatre-vingt-six pourcent contre soixante-dix-huit. Sur 36 rédactions, cela représente trois notes correctes de plus pour Prepamigo que pour GPT 5.6 sol, six de plus que GPT 5.6 luna et dix de plus que GPT-4o mini. Autrement dit, Prepamigo commet 37% moins d’erreurs de notation que GPT 5.6 sol, 55% moins que luna et 67% moins que GPT-4o mini.

Ce que les modèles GPT ont reçu compte. Chacun s’est fait dire qu’il était un examinateur expérimenté du CELPIP Writing, a reçu la tâche exactement comme le candidat l’a vue, y compris les points exigés pour la tâche du courriel et les options pour la tâche du sondage, et a reçu la rédaction. On lui a demandé une seule note de 0 à 12. C’est ce que vous taperiez dans ChatGPT, et c’est un test plus juste qu’un simple « note ceci », parce que le modèle sait au moins ce que la tâche demandait.

Le correcteur de Prepamigo a reçu la même tâche et la même rédaction, plus ce qu’il a toujours en production : de vrais exemples de rédactions notées pour cette tâche à chaque niveau, pour comparer, et une couche de règles qui vérifie ce qu’un évaluateur vérifie en premier, comme la couverture de chaque point exigé, le fait qu’une réponse au sondage prenne vraiment position, la présence d’une salutation et d’une formule de clôture dans un courriel, et le fait que la réponse s’approche de la longueur que demande la tâche.

D’où viennent les huit points : niveau par niveau

Rédactions faibles (note vérifiée de 4 ou 5)

12 rédactions officielles. Le seul niveau où les modèles GPT prennent une légère avance.

83%

GPT 5.6 sol

83%

GPT 5.6 luna

83%

GPT-4o mini

75%

Correcteur de Writing Prepamigo

Sur les rédactions faibles, les trois modèles GPT sont à 83% et Prepamigo à 75%. C’est le seul niveau où ChatGPT est devant, et nous le rapportons comme tel. Les trois erreurs de Prepamigo sont toutes allées un cran trop haut, à 6 ou 7, sur des rédactions courtes mais soignées. Les deux erreurs de GPT 5.6 sol étaient toutes deux un 6. Les rédactions faibles sont l’extrémité facile de l’échelle pour un clavardeur IA : un texte court, générique et truffé d’erreurs paraît faible à n’importe qui.

Rédactions moyennes (note vérifiée de 7 ou 8)

12 rédactions officielles. Le niveau où se trouvent la plupart des candidats.

100%

Correcteur de Writing Prepamigo

75%

GPT 5.6 sol

67%

GPT-4o mini

58%

GPT 5.6 luna

Au milieu, Prepamigo a noté les douze rédactions à l’intérieur de la bande 7 à 8. GPT 5.6 sol en a réussi neuf; ses trois erreurs étaient toutes un 6, un cran en dessous. GPT 5.6 luna en a réussi sept, tirant trois rédactions vers le bas à 6, une à 5 et une vers le haut à 9. GPT-4o mini en a réussi huit et a poussé les quatre autres vers le haut à 9.

Un 7 ou un 8 est la note réelle la plus fréquente à l’examen, et c’est la note qui décide si un candidat a atteint sa cible. GPT 5.6 sol dira à un tel candidat sur quatre qu’il a glissé à 6. Luna le dira à quatre sur dix. Ni l’un ni l’autre n’est un désastre comme le sont les résultats de Claude dans la bande du milieu, mais c’est la différence entre une note de pratique sur laquelle on peut planifier et une note qu’il faut remettre en question.

Rédactions fortes (note vérifiée de 10 ou plus)

12 rédactions officielles. Les erreurs ici sont des 9 : la rédaction était forte et le correcteur s'est retenu.

83%

Correcteur de Writing Prepamigo

75%

GPT 5.6 sol

67%

GPT 5.6 luna

25%

GPT-4o mini

Au sommet, Prepamigo a reconnu dix rédactions fortes sur douze, GPT 5.6 sol neuf, luna huit, et GPT-4o mini trois. Toutes les erreurs sauf une étaient un 9. GPT-4o mini a donné un 9 à neuf des douze rédactions fortes : il ne donne tout simplement pas de 10. Si votre écriture est forte et que vous la vérifiez avec le palier gratuit de ChatGPT, qui dirige encore beaucoup de trafic vers de petits modèles, on vous dira que vous êtes un 9 presque chaque fois.

Un 9 de ChatGPT sur une rédaction que vous jugiez excellente a plus de chances d’être un 10 retenu qu’un vrai 9. Réécrivez-la une fois avec la réponse modèle à côté et faites-la noter de nouveau; un 10 constant sur deux tentatives est un 10.

Pourquoi un clavardeur IA glisse au milieu et au sommet

Une rédaction de niveau moyen au CELPIP couvre la tâche, est organisée, et est aussi générique : des raisons affirmées plutôt que développées, un vocabulaire prudent, des phrases d’une seule forme. Une rédaction forte n’est pas sans défaut; elle a un ou deux faux pas, et une phrase plate parmi les phrases développées. Un modèle sans exemples notés pour comparer doit décider à l’impression. L’impression de GPT 5.6 sol est un peu sévère : le 7 générique se lit comme un 6, le 10 avec un faux pas se lit comme un 9. Luna est plus sévère encore. GPT-4o mini traite le 9 comme un plafond.

Le correcteur de Prepamigo ne juge pas une rédaction par rapport à une idée de la bonne écriture. Il la compare à de vraies rédactions notées pour la même tâche, une à chaque niveau, toutes de vraies réponses avec de vrais faux pas. Une rédaction générique mais complète atterrit à côté de l’exemple moyen parce que c’est à lui qu’elle ressemble. Une rédaction forte avec une phrase maladroite atterrit à côté de l’exemple fort, qui en a une lui aussi. Par-dessus cette comparaison se trouve une couche de règles pour ce qu’un modèle compte mal : la présence de chaque point exigé, le fait qu’une réponse au sondage a pris position, la présence d’une salutation et d’une formule de clôture dans le courriel, et sa longueur. Un point exigé manqué maintient l’exécution de la tâche à 8 ou moins, peu importe l’anglais, parce que c’est ainsi que fonctionne l’examen.

L’écart de flux de travail : ce que vous devez apporter

Pour le Writing, ChatGPT est facile à utiliser comme correcteur, et nous ne prétendrons pas le contraire. Collez la rédaction, obtenez un chiffre, demandez une explication. Aucun enregistrement, aucune transcription. Pour un second avis rapide sur une seule rédaction, c’est pratique et, avec GPT 5.6 sol, raisonnablement précis.

Ce que vous n’obtenez pas, c’est la tâche. ChatGPT peut inventer une consigne de style CELPIP si vous le lui demandez, mais il devine les points exigés, les options du sondage et le nombre de mots qu’utilise le vrai examen. Vous n’obtenez pas de vérification des points exigés, parce qu’il ne sait pas quels points le vrai examen énumérerait. Vous n’obtenez pas de réponse modèle réécrite à partir de votre propre rédaction à la bonne longueur. Et chaque rédaction que vous collez est comptée dans votre allocation de messages.

Sur Prepamigo, vous ouvrez une tâche dans la banque, le minuteur tourne, vous écrivez, et environ une minute après avoir soumis, vous avez quatre notes par dimension, une note globale, la liste de tout ce que vous avez manqué, des corrections citées de votre propre texte et une réponse modèle réécrite. La quarantième rédaction du mois vous coûte le même effort que la première.

La même rédaction, la même note

Après l’exécution principale, nous avons noté les 36 rédactions deux fois de plus, à des jours différents. Le correcteur de Writing de Prepamigo a obtenu 86%, 89% et 86% sur les trois exécutions, avec les mêmes douze rédactions de niveau moyen à l’intérieur de la bande chaque fois. GPT 5.6 sol a obtenu 78%, 83% et 81% : meilleur à ses deuxième et troisième exécutions, et un rappel qu’une seule réponse d’un clavardeur IA comporte quelques points de chance dans un sens ou dans l’autre. Si vous notez avec ChatGPT, demandez deux fois et gardez la réponse la plus basse.

Rétroaction : explication contre preuves

ChatGPT explique bien. Demandez pourquoi une rédaction est un 6 et il vous le dira, dans un anglais clair, avec des suggestions. Le hic, c’est que l’explication est écrite pour justifier un chiffre déjà choisi, alors quand le chiffre est un cran trop bas, l’explication trouve des défauts assortis. Un candidat qui était en réalité à 7 lit une page sur des faiblesses qui n’étaient pas déterminantes.

La rétroaction de Prepamigo part du texte. Chaque correction cite les mots exacts de votre rédaction, et tout ce que le vérificateur ne retrouve pas dans votre texte est retiré avant que vous le voyiez. Un point exigé manqué est nommé. Chaque dimension reçoit un seul facteur limitant, ou une affirmation claire que rien ne la retient. Et vous recevez une réponse modèle réécrite à partir de votre propre réponse, à la longueur que demande la tâche. La section ci-dessous énumère ce qui a changé.

Ce qui est nouveau dans vos commentaires de Writing

La note n'est que la moitié de ce que vous recevez. La couche de commentaires de Writing a été reconstruite en même temps que le correcteur, et tout ce qu'elle contient est ancré dans votre propre texte. Voici ce qui a changé.

  • Des corrections que vous pouvez retrouver dans votre propre rédaction. Chaque correction de grammaire, d'orthographe et de vocabulaire cite les mots exacts de votre réponse, de sorte que l'application peut les surligner là où vous les avez écrits. Tout ce que le vérificateur ne retrouve pas mot pour mot dans votre rédaction est retiré avant que vous le voyiez.
  • Une réponse modèle, construite à partir de votre réponse. Vous recevez une version réécrite de votre propre réponse qui conserve vos idées, couvre chaque point exigé et tient dans les 150 à 200 mots que demande la tâche. Si la première réécriture rate cette longueur, elle est refaite une fois avant de vous être montrée.
  • Le point exigé que vous avez manqué, nommé. Pour la tâche du courriel, les commentaires énumèrent les points de la consigne que votre réponse n'a pas couverts. Un point manqué maintient aussi la note d'exécution de la tâche à 8 ou moins, de sorte que le chiffre et les commentaires ne se contredisent jamais.
  • Un seul facteur limitant par dimension. Pour chacune des quatre dimensions, les commentaires nomment la seule chose qui retient cette note, en termes concrets, ou disent clairement que rien ne la retient et ce qui la porte. Conclure qu'une dimension n'a aucun problème est une vraie réponse, pas un vide.
  • La critique au bon endroit. Un ton faible est un problème d'exécution de la tâche, un choix de mot vague est un problème de vocabulaire, une phrase interminable est un problème de lisibilité. Chaque point est classé sous la dimension à laquelle il appartient, au lieu d'être fondu dans le résumé général.
  • Des réécritures phrase par phrase. Des phrases précises de votre rédaction vous reviennent avec une version améliorée et une ligne expliquant pourquoi elle est meilleure, pour que vous voyiez le changement au lieu de simplement le lire.
  • Votre dimension la plus forte et la plus faible, côte à côte. Les commentaires vous indiquent laquelle des quatre dimensions porte votre note et laquelle la retient, pour que vous sachiez quoi pratiquer ensuite sans avoir à décoder quatre chiffres.

Chaque citation des commentaires est vérifiée dans votre rédaction avant d'être affichée. Si le vérificateur ne retrouve pas les mots, la ligne est supprimée. C'est pourquoi les commentaires ne vous demandent jamais de corriger quelque chose que vous n'avez pas écrit.

Ce que coûte la pratique au quotidien

ChatGPT Plus coûte US$20 par mois, environ CA$28, facturé mensuellement, tel que publié en septembre 2026, avec un plafond de messages par fenêtre glissante; ChatGPT Pro, à US$200 par mois, environ CA$276 avant taxes, relève ce plafond. Le palier gratuit dirige une bonne partie de son trafic vers de plus petits modèles, et dans ce test, le plus petit d’entre eux a reconnu trois rédactions fortes sur douze. Aucun des forfaits n’inclut de banque de tâches, de minuteur, de vérification des points exigés, de réponse modèle, ni de note étalonnée sur de vraies rédactions notées.

Prepamigo coûte CA$24.98 par mois, ou CA$8.25 par mois sur le forfait annuel, soit CA$98.98 pour l’année, taxes incluses, et vous pouvez annuler à tout moment. Chaque forfait inclut une notation illimitée sans plafond quotidien, par séance ou hebdomadaire, des tentatives illimitées, et la banque de questions complète : 80 séries d’exercices complètes et plus de 2,000 tâches d’exercice couvrant le Writing, le Speaking, le Reading et le Listening, conçues pour suivre les types de tâches, le minutage et le format du test CELPIP General.

Quand ChatGPT est le meilleur outil

  • Un second avis rapide sur une rédaction. GPT 5.6 sol est un correcteur convenable et prend dix secondes. Si vous avez déjà la tâche et voulez simplement un autre point de vue, il fait l’affaire.
  • Réécrire une phrase de cinq façons. Demander des variantes pour une phrase maladroite est rapide, et les suggestions sont bonnes.
  • En discuter. Si vous voulez débattre de la raison pour laquelle un argument est faible, une conversation est le bon format. Prepamigo vous donne un verdict et des preuves; il ne clavarde pas.
  • Tout ce qui sort du test. ChatGPT est un assistant généraliste et Prepamigo ne l’est pas.

Ce qu’il ne devrait pas être, c’est la seule chose qui dit à un rédacteur de niveau 7 ou 8 où il en est, ou la chose qui dit à un rédacteur fort qu’il est un 9. Ce sont les deux endroits où il se trompe le plus souvent.

FAQ

ChatGPT peut-il noter mon CELPIP Writing? Oui, et mieux que la plupart des clavardeurs IA : GPT 5.6 sol avait raison 78% du temps sur 36 réponses officielles, luna 69%, GPT-4o mini 58%, contre 86% pour Prepamigo.

Prepamigo est-il plus précis que ChatGPT en Writing? De huit points face au meilleur modèle GPT. Rédactions de niveau moyen : 100% contre 75%; rédactions fortes : 83% contre 75%; rédactions faibles : 75% contre 83%.

Quel modèle GPT devrais-je utiliser? GPT 5.6 sol. Pas GPT-4o mini, qui a donné un 9 à neuf des douze rédactions fortes.

Combien coûte chacun? ChatGPT Pro coûte US$200 par mois, environ CA$276 avant taxes; Plus coûte US$20 avec des plafonds de messages. Prepamigo coûte CA$24.98 par mois taxes incluses, ou CA$8.25 par mois sur le forfait annuel, avec une notation illimitée et 80 séries d’exercices.

Pour la même comparaison face à Claude, lisez Prepamigo contre Claude pour le Writing. Pour savoir comment fonctionne le correcteur de Writing, lisez à l’intérieur du correcteur de Writing de Prepamigo. Vous pouvez aussi Lire ce guide en anglais. Ou Rédiger une réponse et voyez la note.

Prepamigo contre ChatGPT pour le CELPIP Writing : précision, limites et coût | PrepAmigo