نسبة المقالات التي حصلت على الدرجة الموثّقة
36 إجابة كتابة رسمية من CELPIP، 12 عند كل من المستويات الثلاثة، عبر مهمتي الكتابة. أُعطي كل نموذج GPT المهمة والمقال وطُلب منه، بكلمات بسيطة، تقييمه على مقياس CELPIP. عمل مقيّم Prepamigo للكتابة كما يعمل في الإنتاج.
86%
مقيّم Prepamigo للكتابة
78%
GPT 5.6 sol
69%
GPT 5.6 luna
58%
GPT-4o mini
Prepamigo مقارنةً بأشهر باقات روبوتات المحادثة
بالدولار الكندي. أسعار Prepamigo شاملة الضريبة. تم تحويل Claude Max (بدءًا من US$100) و ChatGPT Pro (US$200) بسعر 1.38، قبل الضريبة. الدقة هي نسبة المقالات الرسمية الـ36 التي حصلت على الدرجة الموثّقة عند طلب تقييم المقال من النموذج المذكور بكلمات بسيطة؛ محاولة واحدة.
ChatGPT هو على الأرجح الأداة الأكثر شيوعًا التي يستخدمها مرشحو CELPIP لفحص كتابتهم. تلصق البريد الإلكتروني، وتطلب درجة، وتحصل على رقم وفقرة. إنه سريع، وموجود على هاتفك، وفي الكتابة لا توجد خطوة تفريغ تعترض الطريق. لذا اختبرنا الرقم. أعطينا ثلاثة نماذج GPT نفس 36 إجابة كتابة رسمية من CELPIP التي يُقاس عليها مقيّمنا، اثنتي عشرة عند كل مستوى، وطلبنا منها تقييم المقالات بالطريقة التي يطلبها الطالب.
الجواب المختصر: أصاب مقيّم Prepamigo للكتابة المستوى الموثّق في 86% من الحالات. وأصابه GPT 5.6 sol، النموذج الذي تعمل به باقات ChatGPT المدفوعة، في 78% من الحالات. وبلغ GPT 5.6 luna نسبة 69% وGPT-4o mini نسبة 58%. ثماني نقاط فجوة حقيقية، وتأتي من موضعين: وسط المقياس، حيث قيّم Prepamigo المقالات الاثني عشر كلها بشكل صحيح وقيّم GPT 5.6 sol تسعة منها، والقمة، حيث أبقى GPT 5.6 sol ربع المقالات القوية عند درجة 9.
ينبغي أن نقول منذ البداية إن GPT 5.6 sol هو أفضل مصحّح كتابة عام اختبرناه، متقدمًا بفارق واضح على أي نموذج Claude على نفس المقالات. يستعرض باقي هذا المقال النتائج مستوى تلو الآخر، ويشرح من أين تأتي النقاط الثماني، وينظر في الملاحظات عند كل جانب، ويقارن تكلفة التدرب على الكتابة بجدية مع كل منهما.
الاختبار البسيط: ما يحصل عليه الطالب فعليًا
ستة وثمانون بالمئة مقابل ثمانية وسبعين. في 36 مقالًا، هذا يعني ثلاث درجات صحيحة أكثر لـ Prepamigo مما لـ GPT 5.6 sol، وست أكثر من GPT 5.6 luna، وعشر أكثر من GPT-4o mini. بعبارة أخرى، يرتكب Prepamigo أخطاء تقييم أقل بنسبة 37% من GPT 5.6 sol، وأقل بنسبة 55% من luna، وأقل بنسبة 67% من GPT-4o mini.
ما أُعطي لنماذج GPT مهم. قيل لكل منها إنه ممتحن كتابة CELPIP ذو خبرة، وأُعطي المهمة تمامًا كما رآها المرشح، بما في ذلك النقاط المطلوبة في مهمة البريد الإلكتروني والخيارات في مهمة الاستبيان، وأُعطي المقال. وطُلب منه درجة واحدة من 0 إلى 12. هذا ما ستكتبه في ChatGPT، وهو اختبار أنصف من مجرد «قيّم هذا» لأن النموذج يعرف على الأقل ما طلبته المهمة.
تلقّى مقيّم Prepamigo نفس المهمة ونفس المقال، إضافة إلى ما يملكه دائمًا في الإنتاج: مقالات نموذجية حقيقية مصحّحة لتلك المهمة عند كل مستوى ليقارن بها، وطبقة قواعد تفحص الأمور التي يفحصها المصحّح أولًا، مثل هل غُطّيت كل نقطة مطلوبة، وهل الرد على الاستبيان يختار جانبًا فعلًا، وهل البريد الإلكتروني يحوي تحية وخاتمة، وهل الإجابة قريبة من الطول الذي تطلبه المهمة.
من أين تأتي النقاط الثماني: مستوى تلو الآخر
المقالات الضعيفة (الدرجة الموثّقة 4 أو 5)
12 مقالًا رسميًا. المستوى الوحيد الذي تتقدم فيه نماذج GPT قليلًا.
83%
GPT 5.6 sol
83%
GPT 5.6 luna
83%
GPT-4o mini
75%
مقيّم Prepamigo للكتابة
في المقالات الضعيفة، نماذج GPT الثلاثة كلها عند 83% وPrepamigo عند 75%. هذا هو المستوى الوحيد الذي يتقدم فيه ChatGPT، ونذكره كما هو. زلات Prepamigo الثلاث كلها ذهبت درجة واحدة أعلى، إلى 6 أو 7، في مقالات كانت قصيرة لكن مرتّبة. وزلّتا GPT 5.6 sol كانتا كلتاهما درجة 6. المقالات الضعيفة هي الطرف السهل من المقياس لروبوت المحادثة: الكتابة القصيرة والعامة والمليئة بالأخطاء تبدو ضعيفة لأي أحد.
المقالات المتوسطة (الدرجة الموثّقة 7 أو 8)
12 مقالًا رسميًا. المستوى الذي يقف عنده معظم المرشحين.
100%
مقيّم Prepamigo للكتابة
75%
GPT 5.6 sol
67%
GPT-4o mini
58%
GPT 5.6 luna
في الوسط، قيّم Prepamigo المقالات الاثني عشر كلها ضمن نطاق 7 إلى 8. أصاب GPT 5.6 sol تسعة؛ وكانت زلاته الثلاث كلها درجة 6، أي درجة واحدة أدنى. وأصاب GPT 5.6 luna سبعة، إذ سحب ثلاثة مقالات إلى الأسفل نحو 6، وواحدًا نحو 5، ودفع واحدًا إلى الأعلى نحو 9. وأصاب GPT-4o mini ثمانية ودفع الأربعة الأخرى إلى الأعلى نحو 9.
درجة 7 أو 8 هي أكثر الدرجات الحقيقية شيوعًا في الاختبار، وهي الدرجة التي تحدد هل بلغ المرشح هدفه. سيخبر GPT 5.6 sol واحدًا من كل أربعة من هؤلاء المرشحين أنه تراجع إلى 6. وسيخبر luna أربعة من كل عشرة. ليس أي منهما كارثة بالطريقة التي عليها نتائج Claude في النطاق المتوسط، لكنه الفرق بين درجة تدريب يمكنك التخطيط بناءً عليها وأخرى عليك أن تشكّك فيها.
المقالات القوية (الدرجة الموثّقة 10 فأعلى)
12 مقالًا رسميًا. الزلات هنا هي درجة 9: كان المقال قويًا وتحفّظ المصحّح.
83%
مقيّم Prepamigo للكتابة
75%
GPT 5.6 sol
67%
GPT 5.6 luna
25%
GPT-4o mini
عند القمة، تعرّف Prepamigo على عشرة من اثني عشر مقالًا قويًا، وGPT 5.6 sol على تسعة، وluna على ثمانية، وGPT-4o mini على ثلاثة. كل زلة ما عدا واحدة كانت درجة 9. أعطى GPT-4o mini درجة 9 لتسعة من المقالات القوية الاثني عشر: إنه ببساطة لا يمنح درجة 10. إن كانت كتابتك قوية وفحصتها بالمستوى المجاني من ChatGPT، الذي لا يزال يوجّه كثيرًا من الاستخدام إلى نماذج صغيرة، فسيُقال لك إنك عند 9 في كل مرة تقريبًا.
لماذا يزلّ روبوت المحادثة في الوسط وعند القمة
مقال CELPIP من المستوى المتوسط يغطي المهمة، ومنظّم، وهو أيضًا عام: أسباب مذكورة لا مطوّرة، ومفردات آمنة، وجمل على شكل واحد. أما المقال القوي فليس خاليًا من العيوب؛ فيه زلة أو اثنتان، وجملة عادية بين الجمل المطوّرة. النموذج الذي لا يملك أمثلة مصحّحة ليقارن بها عليه أن يقرر بالانطباع. وانطباع GPT 5.6 sol صارم قليلًا: درجة 7 العامة تُقرأ على أنها 6، ودرجة 10 القوية مع زلة تُقرأ على أنها 9. وluna أشد صرامة. أما GPT-4o mini فيتعامل مع 9 على أنها السقف.
لا يحكم مقيّم Prepamigo على المقال في ضوء فكرة عن الكتابة الجيدة. بل يقارنه بمقالات حقيقية مصحّحة لنفس المهمة، واحد عند كل مستوى، وكلها إجابات حقيقية فيها زلات حقيقية. المقال العام لكن المكتمل يقع بجوار النموذج المتوسط لأنه ما يشبهه. والمقال القوي الذي فيه جملة ركيكة واحدة يقع بجوار النموذج القوي، الذي فيه واحدة أيضًا. وفوق هذه المقارنة تقع طبقة قواعد للأمور التي يسيء النموذج عدّها: هل كل نقطة مطلوبة موجودة، وهل اختار الرد على الاستبيان جانبًا، وهل البريد الإلكتروني فيه تحية وخاتمة، وكم طوله. تفويت نقطة مطلوبة يُبقي تحقيق المهمة عند 8 أو أقل بغض النظر عن الإنجليزية، لأن هذه هي طريقة عمل الاختبار.
فجوة سير العمل: ما عليك أن تحضره بنفسك
في الكتابة، ChatGPT سهل الاستخدام كمصحّح، ولن ندّعي غير ذلك. تلصق المقال، وتحصل على رقم، وتطلب شرحًا. لا تسجيل، ولا نص مفرّغ. لرأي ثانٍ سريع على مقال واحد هو مريح، ومع GPT 5.6 sol دقيق بشكل معقول.
ما لا تحصل عليه هو المهمة. يستطيع ChatGPT ابتكار سؤال على طراز CELPIP إن طلبت منه، لكنه يخمّن النقاط المطلوبة وخيارات الاستبيان وعدد الكلمات التي يستخدمها الاختبار الحقيقي. ولا تحصل على فحص للنقاط المطلوبة، لأنه لا يعرف أي النقاط سيذكرها الاختبار الحقيقي. ولا تحصل على إجابة نموذجية معاد كتابتها من مقالك أنت بالطول الصحيح. وكل مقال تلصقه يُحتسب من رصيد رسائلك.
في Prepamigo، تفتح مهمة من البنك، ويعمل المؤقّت، وتكتب، وبعد نحو دقيقة من الإرسال تكون أمامك درجات الأبعاد الأربعة، ودرجة إجمالية، وقائمة بكل ما فوّتَه، وتصحيحات مقتبسة من نصّك أنت، وإجابة نموذجية معاد كتابتها. يكلّفك المقال الأربعون في الشهر نفس الجهد الذي يكلّفك به الأول.
نفس المقال، نفس الدرجة
بعد الجولة الرئيسية قيّمنا المقالات الـ36 كلها مرتين إضافيتين في يومين مختلفين. سجّل مقيّم Prepamigo للكتابة 86% و89% و86% عبر الجولات الثلاث، مع بقاء المقالات المتوسطة الاثني عشر نفسها ضمن النطاق في كل مرة. وسجّل GPT 5.6 sol نسب 78% و83% و81%: أفضل في جولتيه الثانية والثالثة، وتذكير بأن جواب روبوت المحادثة الواحد يحمل بضع نقاط من الحظ في أي من الاتجاهين. إن كنت تقيّم مع ChatGPT فعلًا، فاسأل مرتين واحتفظ بالجواب الأدنى.
الملاحظات: الشرح مقابل الدليل
يشرح ChatGPT جيدًا. اسأله لماذا المقال بدرجة 6 وسيخبرك، بإنجليزية واضحة، مع اقتراحات. العقبة أن الشرح يُكتب لتبرير رقم اختير مسبقًا، فعندما يكون الرقم درجة واحدة أدنى، يجد الشرح عيوبًا تناسبه. والمرشح الذي كان في الحقيقة عند 7 يقرأ صفحة عن نقاط ضعف لم تكن حاسمة.
تعمل ملاحظات Prepamigo انطلاقًا من النص. يقتبس كل تصحيح الكلمات الدقيقة من مقالك، وأي شيء لا يجده المدقّق في نصّك يُحذف قبل أن تراه. تُسمّى النقطة المطلوبة التي فوّتَها. يحصل كل بُعد على عامل محدِّد واحد، أو على عبارة واضحة بأن لا شيء يعيقه. وتحصل على إجابة نموذجية معاد كتابتها من إجابتك أنت بالطول الذي تطلبه المهمة. يسرد القسم التالي ما تغيّر.
ما الجديد في ملاحظات الكتابة
الدرجة ليست سوى نصف ما تحصل عليه. أُعيد بناء طبقة ملاحظات الكتابة جنبًا إلى جنب مع المقيّم، وكل ما فيها مرتبط بنصّك أنت. وهذا ما تغيّر.
- تصحيحات تجدها في مقالك نفسه. يقتبس كل تصحيح في النحو والإملاء والمفردات الكلمات الدقيقة من إجابتك، ليتمكّن التطبيق من تظليلها في المكان الذي كتبتها فيه. وأي شيء لا يجده المدقّق كلمةً بكلمة في مقالك يُحذف قبل أن تراه.
- إجابة نموذجية مبنية من إجابتك. تحصل على نسخة معاد كتابتها من إجابتك تحتفظ بأفكارك، وتغطي كل نقطة مطلوبة، وتقع ضمن 150 إلى 200 كلمة التي تطلبها المهمة. وإذا لم تصل إعادة الكتابة الأولى إلى هذا الطول، تُعاد مرة واحدة قبل عرضها.
- النقطة المطلوبة التي فوّتَها، بالاسم. في مهمة البريد الإلكتروني، تسرد الملاحظات النقاط الواردة في السؤال التي لم تغطّها إجابتك. كما أن تفويت نقطة يُبقي درجة تحقيق المهمة عند 8 أو أقل، فلا تتعارض الدرجة مع الملاحظات أبدًا.
- عامل محدِّد واحد لكل بُعد. لكل بُعد من الأبعاد الأربعة، تسمّي الملاحظات الشيء الوحيد الذي يُبقي تلك الدرجة منخفضة، بعبارات ملموسة، أو تقول بوضوح إنه لا شيء يعيقها وما الذي يرفعها. فالحكم بأن بُعدًا ما لا مشكلة فيه جواب حقيقي، لا فراغ.
- الانتقاد في مكانه الصحيح. النبرة الضعيفة مشكلة في تحقيق المهمة، واختيار الكلمة الغامضة مشكلة في المفردات، والجملة المتصلة بلا توقف مشكلة في سهولة القراءة. تُصنَّف كل نقطة تحت البُعد الذي تنتمي إليه بدلًا من حشرها في الملخص العام.
- إعادة كتابة على مستوى الجملة. تعود إليك جمل محددة من مقالك بنسخة محسّنة وسطر واحد عن سبب كونها أفضل، لترى التغيير بدلًا من أن تقرأ عنه.
- أقوى أبعادك وأضعفها، جنبًا إلى جنب. تخبرك الملاحظات بأي الأبعاد الأربعة يرفع درجتك وأيها يعيقها، لتعرف ما تتدرّب عليه لاحقًا دون فك شفرة أربعة أرقام.
يُفحص كل اقتباس في الملاحظات مقابل مقالك قبل عرضه. وإذا لم يجد المدقّق الكلمات، يُحذف السطر. ولهذا لا تطلب منك الملاحظات أبدًا إصلاح شيء لم تكتبه.
كم تكلفة التدرب يوميًا
سعر ChatGPT Plus هو US$20 شهريًا، أي نحو CA$28، بفوترة شهرية، حسب ما نُشر في سبتمبر 2026، مع حد على عدد الرسائل في كل نافذة متجددة؛ ويرفع ChatGPT Pro، بسعر US$200 شهريًا، أي نحو CA$276 قبل الضريبة، هذا الحد. يوجّه المستوى المجاني كثيرًا من استخدامه إلى نماذج أصغر، وفي هذا الاختبار تعرّف أصغرها على ثلاثة مقالات قوية من اثني عشر. لا تشمل أي من الباقات بنك مهام، أو مؤقتًا، أو فحصًا للنقاط المطلوبة، أو إجابة نموذجية، أو درجة مُعايرة مقابل مقالات حقيقية مصحّحة.
سعر Prepamigo هو CA$24.98 شهريًا، أو CA$8.25 شهريًا في الباقة السنوية، وهو CA$98.98 للسنة، شامل الضريبة، ويمكنك الإلغاء في أي وقت. تشمل كل باقة تقييمًا غير محدود من دون حد يومي أو جلسة أو أسبوعي، ومحاولات غير محدودة، وبنك الأسئلة الكامل: 80 مجموعة تدريب كاملة وأكثر من 2,000 مهمة تدريبية عبر أقسام الكتابة والمحادثة والقراءة والاستماع، مكتوبة لتتبع أنواع المهام والتوقيت والصيغة في اختبار CELPIP العام.
عندما يكون ChatGPT الأداة الأفضل
- رأي ثانٍ سريع على مقال واحد. GPT 5.6 sol مصحّح لا بأس به ويستغرق عشر ثوانٍ. إن كانت المهمة لديك بالفعل وتريد فقط نظرة أخرى، فهو مناسب.
- إعادة كتابة جملة بخمس طرق. طلب بدائل لجملة ركيكة سريع والاقتراحات جيدة.
- التحدث في التفاصيل. إن أردت أن تجادل في سبب ضعف سبب معيّن، فالمحادثة هي الشكل المناسب. يمنحك Prepamigo حكمًا ودليلًا؛ ولا يتحدث معك.
- أي شيء خارج الاختبار. ChatGPT مساعد عام وPrepamigo ليس كذلك.
ما لا ينبغي أن يكون هو الشيء الوحيد الذي يخبر كاتبًا عند 7 أو 8 بموقعه، أو الشيء الذي يخبر كاتبًا قويًا أنه عند 9. هذان هما الموضعان اللذان يخطئ فيهما أكثر ما يخطئ.
الأسئلة الشائعة
هل يمكن لـ ChatGPT تقييم كتابتي في CELPIP؟ نعم، وأفضل من معظم روبوتات المحادثة: كان GPT 5.6 sol صحيحًا في 78% من الحالات على 36 إجابة رسمية، وluna في 69%، وGPT-4o mini في 58%، مقابل 86% لـ Prepamigo.
هل Prepamigo أدق من ChatGPT في الكتابة؟ بفارق ثماني نقاط عن أفضل نموذج GPT. مقالات المستوى المتوسط 100% مقابل 75%؛ والمقالات القوية 83% مقابل 75%؛ والمقالات الضعيفة 75% مقابل 83%.
أي نموذج GPT ينبغي أن أستخدم؟ GPT 5.6 sol. لا GPT-4o mini، الذي أعطى درجة 9 لتسعة من اثني عشر مقالًا قويًا.
كم تكلفة كل خيار؟ سعر ChatGPT Pro هو US$200 شهريًا، أي نحو CA$276 قبل الضريبة؛ وسعر Plus هو US$20 مع حدود على الرسائل. سعر Prepamigo هو CA$24.98 شهريًا شامل الضريبة، أو CA$8.25 شهريًا في الباقة السنوية، مع تقييم غير محدود و80 مجموعة تدريب.
لنفس المقارنة مع Claude، اقرأ Prepamigo مقارنةً بـ Claude للكتابة. ولمعرفة كيف يعمل مقيّم الكتابة، اقرأ داخل مقيّم الكتابة في Prepamigo. أو اكتب إجابة وشاهد الدرجة. يمكنك أيضًا اقرأ هذا الدليل بالإنجليزية.
