نسبة المقالات التي حصلت على الدرجة الموثّقة
36 إجابة كتابة رسمية من CELPIP، 12 عند كل من المستويات الثلاثة، عبر مهمتي الكتابة. أُعطي Claude المهمة والمقال وطُلب منه، بكلمات بسيطة، تقييمه على مقياس CELPIP. عمل مقيّم Prepamigo للكتابة كما يعمل في الإنتاج.
86%
مقيّم Prepamigo للكتابة
61%
Claude Opus 5
56%
Claude Sonnet 5
Prepamigo مقارنةً بأشهر باقات روبوتات المحادثة
بالدولار الكندي. أسعار Prepamigo شاملة الضريبة. تم تحويل Claude Max (بدءًا من US$100) و ChatGPT Pro (US$200) بسعر 1.38، قبل الضريبة. الدقة هي نسبة المقالات الرسمية الـ36 التي حصلت على الدرجة الموثّقة عند طلب تقييم المقال من النموذج المذكور بكلمات بسيطة؛ محاولة واحدة.
الكتابة هي المهارة التي يبدو فيها روبوت المحادثة أكثر إقناعًا كمصحّح. لا تسجيل يحتاج إلى تفريغ، ولا لكنة تقلق بشأنها، مجرد نص يدخل ورقم يخرج، مع فقرة من الشرح الواثق. لذا اختبرنا الرقم. أعطينا Claude نفس 36 إجابة كتابة رسمية من CELPIP التي يُقاس عليها مقيّمنا، اثنتي عشرة عند كل مستوى، وطلبنا منه تقييمها بالطريقة التي يطلبها الطالب.
الجواب المختصر: أصاب مقيّم Prepamigo للكتابة المستوى الموثّق في 86% من الحالات. وأصابه Claude Opus 5 في 61% من الحالات وClaude Sonnet 5 في 56% من الحالات. الفجوة ليست موزّعة بالتساوي. في المقالات الضعيفة والمقالات القوية أداء Claude مقبول، وعند القمة Opus 5 أفضل منا فعلًا. أما في مقالات المستوى المتوسط، أي درجات 7 و8 التي يكتبها معظم المرشحين فعليًا، فقد كان Opus 5 صحيحًا مرة واحدة من كل أربع وSonnet 5 مرة واحدة من كل ثلاث. وكان Prepamigo صحيحًا في الاثني عشر مقالًا كلها.
يستعرض باقي هذا المقال تلك النتائج مستوى تلو الآخر، ويشرح لماذا يخسر النموذج العام وسط المقياس، وينظر في قيمة الملاحظات عند كل جانب، ويقارن تكلفة التدرب على الكتابة بجدية مع كل منهما. حاولنا أن نكون منصفين لـ Claude في كل ما كتبنا، بما في ذلك الموضع الوحيد الذي تفوّق فيه علينا.
الاختبار البسيط: ما يحصل عليه الطالب فعليًا
ستة وثمانون بالمئة مقابل واحد وستين وستة وخمسين. في 36 مقالًا، هذا يعني تسع درجات صحيحة أكثر من Opus 5 وإحدى عشرة أكثر من Sonnet 5. بعبارة أخرى، يرتكب Prepamigo أخطاء تقييم أقل بنسبة 64% من Opus 5 وأقل بنسبة 69% من Sonnet 5 على نفس المقالات.
ما أُعطي لـ Claude مهم، فإليك ما هو. قيل لكل نموذج إنه ممتحن كتابة CELPIP ذو خبرة، وأُعطي المهمة تمامًا كما رآها المرشح، بما في ذلك النقاط المطلوبة في مهمة البريد الإلكتروني والخيارات في مهمة الاستبيان، وأُعطي المقال. وطُلب منه درجة واحدة من 0 إلى 12. هذه هي التعليمة بأكملها. إنها ما ستكتبه في نافذة المحادثة، وهي اختبار أنصف من مجرد سطر «قيّم هذا» لأن النموذج يعرف على الأقل ما طلبته المهمة.
تلقّى مقيّم Prepamigo نفس المهمة ونفس المقال. وكان لديه أيضًا ما يملكه دائمًا في الإنتاج: مقالات نموذجية حقيقية مصحّحة لتلك المهمة عند كل مستوى ليقارن بها، وطبقة قواعد تفحص الأمور التي يفحصها المصحّح أولًا، مثل هل كل نقطة مطلوبة موجودة، وهل الرد على الاستبيان يختار جانبًا فعلًا، وهل البريد الإلكتروني يحوي تحية وخاتمة، وكم طول الإجابة.
أين تتسع الفجوة: مستوى تلو الآخر
الرقم الإجمالي يخفي أين تقع الأخطاء، وفي الكتابة تقع الأخطاء في مكان واحد. إليك النتائج نفسها مقسّمة بحسب المستوى الموثّق: المقالات الضعيفة بدرجة 4 أو 5، والمقالات المتوسطة بدرجة 7 أو 8، والمقالات القوية بدرجة 10 فأعلى.
المقالات الضعيفة (الدرجة الموثّقة 4 أو 5)
12 مقالًا رسميًا. زلات Claude هنا هي في معظمها درجة 3، أي مستوى واحد أدنى.
75%
مقيّم Prepamigo للكتابة
67%
Claude Opus 5
50%
Claude Sonnet 5
في المقالات الضعيفة، Prepamigo عند 75%، وOpus 5 عند 67%، وSonnet 5 عند 50%. زلات Prepamigo الثلاث كلها ذهبت درجة واحدة أعلى، إلى 6 أو 7، في مقالات كانت قصيرة لكن مرتّبة. أما زلات Claude فتذهب في الاتجاه المعاكس: أعطى Sonnet 5 أربعة من المقالات الضعيفة الاثني عشر درجة 3، وأعطى Opus 5 اثنين منها درجة 3. درجة 3 على هذا المقياس تعني إجابة بالكاد تتفاعل مع المهمة. هذه المقالات تتفاعل معها؛ إنها فقط هزيلة. وClaude، من دون مثال لما تبدو عليه درجة 4، يقرأ الهزيل على أنه راسب.
المقالات المتوسطة (الدرجة الموثّقة 7 أو 8)
12 مقالًا رسميًا. هذا هو المستوى الذي يقف عنده معظم المرشحين، والمستوى الذي يفشل فيه Claude.
100%
مقيّم Prepamigo للكتابة
33%
Claude Sonnet 5
25%
Claude Opus 5
الوسط هو القصة كلها. قيّم Prepamigo المقالات المتوسطة الاثني عشر كلها ضمن نطاق 7 إلى 8. أصاب Opus 5 ثلاثة منها؛ وأصاب Sonnet 5 أربعة. كانت زلات Opus 5 كلها تقريبًا نحو الأعلى: أعطى درجة 9 لستة من الاثني عشر ودرجة 10 لواحد. أما Sonnet 5 فانقسم في الاتجاهين، إذ دفع أربعة مقالات إلى الأسفل نحو 6 وأربعة إلى الأعلى نحو 9 أو 10.
فكّر في ما يعنيه ذلك للمرشح الذي كتب أحد تلك المقالات. درجة 7 أو 8 هي أكثر الدرجات الحقيقية شيوعًا في الاختبار، وهي الدرجة التي تحدد هل بلغت هدفك للهجرة أم لا. اسأل Opus 5، وفي أكثر من نصف الحالات سيخبرك أنك عند 9 أو 10 وأنك جاهز للتوقف عن التدريب. لست كذلك. اسأل Sonnet 5، وفي مرة من كل ثلاث سيخبرك أنك تراجعت إلى 6. لم تتراجع. لا يساعدك أي من الجوابين في تقرير ما تفعله بعد ذلك.
المقالات القوية (الدرجة الموثّقة 10 فأعلى)
12 مقالًا رسميًا. المستوى الوحيد الذي يتفوق فيه Claude Opus 5 على Prepamigo.
92%
Claude Opus 5
83%
مقيّم Prepamigo للكتابة
83%
Claude Sonnet 5
عند القمة، Opus 5 هو أفضل مصحّح في هذا الاختبار: تعرّف على أحد عشر من اثني عشر مقالًا قويًا. وتعرّف كل من Prepamigo وSonnet 5 على عشرة. زلّتا Prepamigo كانتا كلتاهما درجة 9، أي درجة واحدة أدنى؛ وزلّتا Sonnet 5 كانتا 9 و7. نذكر هذا لأنه صحيح، ولأنه يفسّر النمط العام: Claude كريم. يوزّع درجات 9 و10 و11 بسخاء، وهو ما يصادف أن يكون صحيحًا في المقالات القوية وخاطئًا في كل ما عداها.
لماذا يخسر روبوت المحادثة وسط المقياس
مقال CELPIP من المستوى المتوسط شيء محدد. يغطي المهمة، ومنظّم، وفيه أخطاء قليلة تعيق الفهم، وهو أيضًا عام: الأسباب مذكورة لا مطوّرة، والمفردات آمنة، والجمل كلها على شكل واحد. المصحّح الذي رأى مئات من هذه المقالات يعرف بالضبط أين تقع. أما النموذج العام فلم ير مئات منها موسومة بدرجة 7. رأى قطعة كتابة نظيفة ومنظّمة وصحيحة في معظمها، فيمدّ يده إلى رقم مرتفع.
هذا هو الفرق كله. لا يحكم مقيّم Prepamigo على المقال في ضوء فكرة عن الكتابة الجيدة. بل يحكم عليه في ضوء مقالات حقيقية مصحّحة لنفس المهمة: واحد عند المستوى الضعيف، وواحد في الوسط، وواحد عند القمة، وكلها إجابات حقيقية فيها زلات حقيقية. المقال النظيف لكن العام يقع بجوار النموذج المتوسط لأنه أكثر ما يشبهه. والمقال الهزيل يقع بجوار النموذج الضعيف لا تحته، لأن النموذج الضعيف هزيل أيضًا ومع ذلك درجته 4.
وفوق هذه المقارنة تقع طبقة قواعد تتولى الأمور التي يسيء النموذج عدّها. هل غطّى البريد الإلكتروني النقاط المطلوبة الثلاث كلها، أم اثنتين فقط؟ هل اختار الرد على الاستبيان خيارًا فعلًا، أم تردد بينها؟ هل هناك تحية وخاتمة؟ هل الإجابة 180 كلمة أم 60؟ تفويت نقطة مطلوبة يُبقي درجة تحقيق المهمة عند 8 أو أقل مهما كانت الإنجليزية جيدة، لأن هذه هي طريقة عمل الاختبار. أما Claude، عند الطلب البسيط، فلا حد أدنى ولا أعلى لديه من هذا القبيل؛ يقرر كل شيء بالانطباع.
اختبرنا هل إخبار Claude بالمستويات يصلح هذا. لا يصلحه وحده. إعطاء النموذج معايير تقييم ينتج الانحراف نفسه. ما يحرّك الرقم هو إعطاؤه النماذج الحقيقية المصحّحة وطبقة قواعد، وهذه طريقة أخرى للقول: بناء مقيّم.
فجوة سير العمل: ما عليك أن تحضره بنفسك
الكتابة هي المهارة التي يسهل فيها استخدام Claude كمصحّح، ومن الإنصاف الاعتراف بذلك. تلصق المقال، وتحصل على درجة في ثوانٍ، وإن أردت منه أن يشرح نفسه فسيفعل، بإسهاب. لا خطوة تفريغ، ولا صوت، ولا إعداد. لرأي ثانٍ سريع هو مريح حقًا.
ما لا تحصل عليه هو المهمة. لا يملك Claude بنكًا من أسئلة البريد الإلكتروني والاستبيان على طراز CELPIP بالنقاط المطلوبة والخيارات وعدد الكلمات الصحيحة، فإما أن تكتب سؤالك بنفسك وتأمل أن يشبه الاختبار، أو تتدرب على ما تجده. ولا تحصل على فحص للنقاط المطلوبة، لأن Claude لا يعرف أي النقاط سيذكرها الاختبار الحقيقي. ولا تحصل على إجابة نموذجية معاد كتابتها من مقالك أنت بالطول الصحيح. ولا تحصل على رقم مُعاير مقابل مقالات حقيقية مصحّحة، ولهذا يختل وسط المقياس.
في Prepamigo، تفتح مهمة من البنك، ويعمل المؤقّت، وتكتب، وبعد نحو دقيقة من الإرسال تكون أمامك درجات الأبعاد الأربعة، ودرجة إجمالية، وقائمة بكل ما فوّتَه، وتصحيحات مقتبسة من نصّك أنت، وإجابة نموذجية معاد كتابتها. يكلّفك المقال الأربعون في الشهر نفس الجهد الذي يكلّفك به الأول.
نفس المقال، نفس الدرجة
الدرجة التي لا يمكنك إعادة إنتاجها ليست قياسًا. إن حصل المقال نفسه على 8 اليوم و10 غدًا، فأنت لم تتعلم شيئًا عن كتابتك. لذا بعد الجولة الرئيسية قيّمنا المقالات الـ36 كلها مرتين إضافيتين في يومين مختلفين. سجّل مقيّم Prepamigo للكتابة 86% و89% و86% عبر الجولات الثلاث، مع بقاء المقالات المتوسطة الاثني عشر نفسها ضمن النطاق في كل مرة.
تحرّكت جولات Claude أيضًا، لكن شكل أخطائه لم يتغير: في كل جولة، عادت معظم المقالات المتوسطة بدرجة 9 من Opus 5، واستمرت المقالات الضعيفة في جمع درجات 3 من Sonnet 5. هذا الاتساق هو النتيجة المفيدة. المشكلة ليست أن Claude متقلّب. بل إن Claude سيئ المعايرة بثقة في الاتجاه نفسه في كل مرة، وهذا أصعب ملاحظةً.
الملاحظات: شرح جيد لرقم خاطئ
يكتب Claude نصوص ملاحظات ممتازة. فهي واضحة وصبورة ومحددة، وإن طلبت منه شرح سبب كون المقال بدرجة 9 فسينتج فقرة مقنعة. المشكلة أن الفقرة تُكتب لتبرير رقم اختاره مسبقًا، وعندما يكون الرقم خاطئًا يكون الشرح خاطئًا معه. المقال الذي هو في الحقيقة بدرجة 7 يُمدح على صفات لا يملكها، ويمضي المرشح مطمئنًا.
تعمل ملاحظات Prepamigo من الطرف الآخر. يقتبس كل تصحيح الكلمات الدقيقة من مقالك، وأي شيء لا يجده المدقّق في نصّك يُحذف قبل أن تراه. تُسمّى النقطة المطلوبة التي فوّتَها. يحصل كل بُعد على عامل محدِّد واحد، أو على عبارة واضحة بأن لا شيء يعيقه. وتحصل على إجابة نموذجية معاد كتابتها من إجابتك أنت بالطول الذي تطلبه المهمة، لترى الفجوة بدلًا من أن تقرأ عنها. يسرد القسم التالي ما تغيّر في طبقة الملاحظات.
ما الجديد في ملاحظات الكتابة
الدرجة ليست سوى نصف ما تحصل عليه. أُعيد بناء طبقة ملاحظات الكتابة جنبًا إلى جنب مع المقيّم، وكل ما فيها مرتبط بنصّك أنت. وهذا ما تغيّر.
- تصحيحات تجدها في مقالك نفسه. يقتبس كل تصحيح في النحو والإملاء والمفردات الكلمات الدقيقة من إجابتك، ليتمكّن التطبيق من تظليلها في المكان الذي كتبتها فيه. وأي شيء لا يجده المدقّق كلمةً بكلمة في مقالك يُحذف قبل أن تراه.
- إجابة نموذجية مبنية من إجابتك. تحصل على نسخة معاد كتابتها من إجابتك تحتفظ بأفكارك، وتغطي كل نقطة مطلوبة، وتقع ضمن 150 إلى 200 كلمة التي تطلبها المهمة. وإذا لم تصل إعادة الكتابة الأولى إلى هذا الطول، تُعاد مرة واحدة قبل عرضها.
- النقطة المطلوبة التي فوّتَها، بالاسم. في مهمة البريد الإلكتروني، تسرد الملاحظات النقاط الواردة في السؤال التي لم تغطّها إجابتك. كما أن تفويت نقطة يُبقي درجة تحقيق المهمة عند 8 أو أقل، فلا تتعارض الدرجة مع الملاحظات أبدًا.
- عامل محدِّد واحد لكل بُعد. لكل بُعد من الأبعاد الأربعة، تسمّي الملاحظات الشيء الوحيد الذي يُبقي تلك الدرجة منخفضة، بعبارات ملموسة، أو تقول بوضوح إنه لا شيء يعيقها وما الذي يرفعها. فالحكم بأن بُعدًا ما لا مشكلة فيه جواب حقيقي، لا فراغ.
- الانتقاد في مكانه الصحيح. النبرة الضعيفة مشكلة في تحقيق المهمة، واختيار الكلمة الغامضة مشكلة في المفردات، والجملة المتصلة بلا توقف مشكلة في سهولة القراءة. تُصنَّف كل نقطة تحت البُعد الذي تنتمي إليه بدلًا من حشرها في الملخص العام.
- إعادة كتابة على مستوى الجملة. تعود إليك جمل محددة من مقالك بنسخة محسّنة وسطر واحد عن سبب كونها أفضل، لترى التغيير بدلًا من أن تقرأ عنه.
- أقوى أبعادك وأضعفها، جنبًا إلى جنب. تخبرك الملاحظات بأي الأبعاد الأربعة يرفع درجتك وأيها يعيقها، لتعرف ما تتدرّب عليه لاحقًا دون فك شفرة أربعة أرقام.
يُفحص كل اقتباس في الملاحظات مقابل مقالك قبل عرضه. وإذا لم يجد المدقّق الكلمات، يُحذف السطر. ولهذا لا تطلب منك الملاحظات أبدًا إصلاح شيء لم تكتبه.
كم تكلفة التدرب يوميًا
درجة الكتابة أكثر فائدة عند مقالك الثلاثين، لا الثالث. عندها تبدأ في إخبارك هل تغيير طريقة كتابتك يعمل فعلًا. فالسؤال العملي هو تكلفة استخدام كل خيار بكثرة.
سعر Claude Pro هو US$20 شهريًا، أي نحو CA$28، أو US$17 شهريًا عند الفوترة السنوية، حسب ما نُشر على claude.com في سبتمبر 2026، مع نافذة استخدام متجددة مدتها خمس ساعات وحد أسبوعي. باقات Max، من US$100 شهريًا، أي نحو CA$138 قبل الضريبة، ترفع تلك الحدود لكن لا تزيلها. لا تشمل أي من الباقات بنك مهام، أو مؤقتًا، أو فحصًا للنقاط المطلوبة، أو إجابة نموذجية، أو درجة مُعايرة مقابل مقالات حقيقية مصحّحة.
سعر Prepamigo هو CA$24.98 شهريًا، أو CA$8.25 شهريًا في الباقة السنوية، وهو CA$98.98 للسنة، شامل الضريبة، ويمكنك الإلغاء في أي وقت. تشمل كل باقة تقييمًا غير محدود من دون حد يومي أو جلسة أو أسبوعي، ومحاولات غير محدودة، وبنك الأسئلة الكامل: 80 مجموعة تدريب كاملة وأكثر من 2,000 مهمة تدريبية عبر أقسام الكتابة والمحادثة والقراءة والاستماع، مكتوبة لتتبع أنواع المهام والتوقيت والصيغة في اختبار CELPIP العام.
عندما يكون Claude الأداة الأفضل
- صقل مقال قوي. إن كنت عند 10 بالفعل وتريد معرفة ما يلزم لدرجة 11 أو 12، فإن Opus 5 يتعرّف على الكتابة القوية بثبات ويشرح جيدًا. هذا هو المستوى الوحيد الذي تفوّق فيه علينا.
- إعادة كتابة جملة بخمس طرق. طلب بدائل لجملة ركيكة سريع والاقتراحات جيدة.
- التحدث في التفاصيل. إن أردت أن تجادل في سبب ضعف سبب معيّن، فالمحادثة هي الشكل المناسب. يمنحك Prepamigo حكمًا ودليلًا؛ ولا يتحدث معك.
- أي شيء خارج الاختبار. Claude مساعد عام وPrepamigo ليس كذلك.
ما لا ينبغي أن يكون Claude، بحسب الأدلة هنا، هو الشيء الذي يخبر كاتبًا عند 7 أو 8 بموقعه. وهؤلاء هم معظم المرشحين، وهذا بالضبط حيث يخطئ Claude ثلاث مرات من كل أربع.
الأسئلة الشائعة
هل يمكن لـ Claude تقييم كتابتي في CELPIP؟ سيعطيك رقمًا. في 36 إجابة رسمية ذات درجات موثّقة، كان Claude Opus 5 صحيحًا في 61% من الحالات وClaude Sonnet 5 في 56%، مقابل 86% لـ Prepamigo. في مقالات المستوى المتوسط: 25% و33% مقابل 100%.
هل Prepamigo أدق من Claude في الكتابة؟ إجمالًا، نعم، بفارق 25 إلى 30 نقطة. في المقالات القوية Opus 5 أفضل، 92% مقابل 83%. في مقالات المستوى المتوسط، حيث يقف معظم المرشحين، الفجوة 100% مقابل 25%.
لماذا يعطي Claude مقالي المتوسط درجة 9؟ من دون ما يقارن به، يبدو المقال النظيف المنظّم العام قويًا. أعطى Opus 5 درجة 9 أو 10 لسبعة من اثني عشر مقالًا موثّقًا عند 7 إلى 8. يقارن Prepamigo كل مقال بنماذج حقيقية مصحّحة لنفس المهمة.
كم تكلفة كل خيار؟ تبدأ باقة Claude Max من US$100 شهريًا، أي نحو CA$138 قبل الضريبة؛ وسعر Pro هو US$20 بحدود أشد. سعر Prepamigo هو CA$24.98 شهريًا شامل الضريبة، أو CA$8.25 شهريًا في الباقة السنوية، مع تقييم غير محدود و80 مجموعة تدريب.
لنفس المقارنة مع ChatGPT، اقرأ Prepamigo مقارنةً بـ ChatGPT للكتابة. ولمعرفة كيف يعمل مقيّم الكتابة، اقرأ داخل مقيّم الكتابة في Prepamigo. أو اكتب إجابة وشاهد الدرجة. يمكنك أيضًا اقرأ هذا الدليل بالإنجليزية.
