वेरिफाइड लेवल पर स्कोर किए गए निबंधों का हिस्सा
36 आधिकारिक CELPIP राइटिंग जवाब, तीन लेवल में से हर एक पर 12, दोनों राइटिंग टास्क में। हर GPT मॉडल को टास्क और निबंध दिया गया और सीधे शब्दों में CELPIP स्केल पर स्कोर करने के लिए कहा गया। Prepamigo का राइटिंग स्कोरर वैसे ही चला जैसे वह प्रोडक्शन में चलता है।
86%
Prepamigo राइटिंग स्कोरर
78%
GPT 5.6 sol
69%
GPT 5.6 luna
58%
GPT-4o mini
Prepamigo बनाम टॉप चैटबॉट प्लान
कनाडाई डॉलर में। Prepamigo की कीमतों में टैक्स शामिल है। Claude Max (US$100 से शुरू) और ChatGPT Pro (US$200) को टैक्स से पहले 1.38 की दर पर बदला गया है। सटीकता 36 आधिकारिक निबंधों का वह हिस्सा है जिन्हें वेरिफाइड लेवल पर स्कोर किया गया, जब नामित मॉडल को सीधे शब्दों में निबंध स्कोर करने के लिए कहा गया; एक रन।
ChatGPT शायद वह सबसे आम टूल है जिसे CELPIP उम्मीदवार अपनी राइटिंग जांचने के लिए इस्तेमाल करते हैं। ईमेल पेस्ट करो, स्कोर मांगो, एक नंबर और एक पैराग्राफ़ पा लो। यह तेज़ है, यह आपके फ़ोन पर है, और राइटिंग के लिए बीच में ट्रांसक्रिप्शन का कोई स्टेप नहीं है। तो हमने उस नंबर को टेस्ट किया। हमने तीन GPT मॉडल को वही 36 आधिकारिक CELPIP राइटिंग जवाब दिए जिन पर हमारा अपना स्कोरर मापा जाता है, हर लेवल पर बारह, और उनसे वैसे ही निबंध स्कोर करने को कहा जैसे कोई स्टूडेंट कहता।
छोटा जवाब यह है: Prepamigo का राइटिंग स्कोरर 86% बार वेरिफाइड लेवल पर पहुंचा। GPT 5.6 sol, जो ChatGPT के पेड प्लान के पीछे का मॉडल है, वहां 78% बार पहुंचा। GPT 5.6 luna 69% तक पहुंच पाया और GPT-4o mini 58% तक। आठ अंक असली अंतर है, और यह दो जगहों से आता है: स्केल का बीच का हिस्सा, जहां Prepamigo ने सभी बारह निबंध सही स्कोर किए और GPT 5.6 sol ने नौ, और टॉप, जहां GPT 5.6 sol ने एक चौथाई मज़बूत निबंधों को 9 पर रोक दिया।
हमें शुरू में ही कहना चाहिए कि GPT 5.6 sol हमारे टेस्ट किए गए जनरल-पर्पस राइटिंग ग्रेडर में सबसे अच्छा है, उन्हीं निबंधों पर किसी भी Claude मॉडल से काफ़ी आगे। इस लेख का बाकी हिस्सा नतीजों से लेवल दर लेवल गुज़रता है, समझाता है कि आठ अंक कहां से आते हैं, हर तरफ के फ़ीडबैक को देखता है, और तुलना करता है कि हर एक के साथ गंभीरता से राइटिंग की प्रैक्टिस करने की कीमत क्या पड़ती है।
सीधा टेस्ट: एक स्टूडेंट को असल में क्या मिलता है
छियासी प्रतिशत बनाम अठहत्तर। 36 निबंधों पर, यह GPT 5.6 sol के मुकाबले Prepamigo के तीन ज़्यादा सही स्कोर हैं, GPT 5.6 luna से छह ज़्यादा, और GPT-4o mini से दस ज़्यादा। दूसरे शब्दों में, Prepamigo, GPT 5.6 sol से 37% कम, luna से 55% कम और GPT-4o mini से 67% कम स्कोरिंग गलतियां करता है।
GPT मॉडलों को क्या दिया गया, यह मायने रखता है। हर एक को बताया गया कि वह एक अनुभवी CELPIP राइटिंग परीक्षक है, उसे टास्क ठीक वैसे ही दिया गया जैसे उम्मीदवार ने देखा था, जिसमें ईमेल टास्क के ज़रूरी पॉइंट और सर्वे टास्क के विकल्प शामिल थे, और उसे निबंध दिया गया। उससे 0 से 12 के बीच एक स्कोर मांगा गया। यह वही है जो आप ChatGPT में टाइप करते, और यह सिर्फ़ “इसे ग्रेड करो” से ज़्यादा इंसाफ़ वाला टेस्ट है, क्योंकि मॉडल को कम से कम यह पता है कि टास्क ने क्या मांगा था।
Prepamigo के स्कोरर को वही टास्क और वही निबंध मिला, साथ में वह जो प्रोडक्शन में उसके पास हमेशा होता है: तुलना के लिए उस टास्क के हर लेवल पर असली ग्रेड किए गए सैंपल निबंध, और एक रूल लेयर जो उन चीज़ों की जांच करता है जिन्हें एक रेटर सबसे पहले जांचता है, जैसे कि क्या हर ज़रूरी पॉइंट कवर हुआ है, क्या सर्वे जवाब ने असल में कोई पक्ष चुना है, क्या ईमेल में अभिवादन और समापन है, और क्या जवाब टास्क की मांगी गई लंबाई के आसपास भी है।
आठ अंक कहां से आते हैं: लेवल दर लेवल
कमज़ोर निबंध (वेरिफाइड स्कोर 4 या 5)
12 आधिकारिक निबंध। एकमात्र लेवल जहां GPT मॉडल थोड़ा आगे निकलते हैं।
83%
GPT 5.6 sol
83%
GPT 5.6 luna
83%
GPT-4o mini
75%
Prepamigo राइटिंग स्कोरर
कमज़ोर निबंधों पर, तीनों GPT मॉडल 83% पर हैं और Prepamigo 75% पर। यही वह एक लेवल है जहां ChatGPT आगे है, और हम इसे वैसे ही बता रहे हैं। Prepamigo की तीनों चूकें एक पायदान ऊपर, 6 या 7 की तरफ गईं, ऐसे निबंधों पर जो छोटे लेकिन सुथरे थे। GPT 5.6 sol की दोनों चूकें 6 थीं। कमज़ोर निबंध किसी चैटबॉट के लिए स्केल का आसान सिरा हैं: छोटी, सामान्य और गलतियों से भरी राइटिंग हर किसी को कमज़ोर लगती है।
मिडल निबंध (वेरिफाइड स्कोर 7 या 8)
12 आधिकारिक निबंध। वह लेवल जहां ज़्यादातर उम्मीदवार हैं।
100%
Prepamigo राइटिंग स्कोरर
75%
GPT 5.6 sol
67%
GPT-4o mini
58%
GPT 5.6 luna
बीच में, Prepamigo ने सभी बारह निबंधों को 7 से 8 के बैंड के भीतर स्कोर किया। GPT 5.6 sol ने नौ को सही पकड़ा; इसकी तीनों चूकें 6 थीं, एक पायदान नीचे। GPT 5.6 luna ने सात को सही पकड़ा, तीन निबंधों को नीचे 6 की तरफ खींचा, एक को 5 की तरफ और एक को ऊपर 9 की तरफ। GPT-4o mini ने आठ को सही पकड़ा और बाकी चार को ऊपर 9 की तरफ धकेल दिया।
7 या 8 टेस्ट पर सबसे आम असली स्कोर है, और यही वह स्कोर है जो तय करता है कि उम्मीदवार अपने टारगेट तक पहुंचा है या नहीं। GPT 5.6 sol ऐसे हर चार उम्मीदवारों में से एक को बताएगा कि वह फिसलकर 6 पर आ गया है। Luna हर दस में से चार को बताएगा। इनमें से कोई भी उस तरह की आफ़त नहीं है जैसी Claude के मिडल-बैंड नतीजे हैं, लेकिन यह उस प्रैक्टिस स्कोर के बीच का अंतर है जिसके आधार पर आप योजना बना सकते हैं और उस स्कोर के बीच जिस पर आपको दोबारा सोचना पड़ता है।
मज़बूत निबंध (वेरिफाइड स्कोर 10 या उससे ऊपर)
12 आधिकारिक निबंध। यहां चूकें 9 की हैं: निबंध मज़बूत था और ग्रेडर ने हाथ रोक लिया।
83%
Prepamigo राइटिंग स्कोरर
75%
GPT 5.6 sol
67%
GPT 5.6 luna
25%
GPT-4o mini
टॉप पर, Prepamigo ने बारह मज़बूत निबंधों में से दस पहचाने, GPT 5.6 sol ने नौ, luna ने आठ, और GPT-4o mini ने तीन। एक को छोड़कर हर चूक 9 थी। GPT-4o mini ने बारह मज़बूत निबंधों में से नौ को 9 दिया: यह बस 10 देता ही नहीं। अगर आपकी राइटिंग मज़बूत है और आप उसे ChatGPT के फ़्री टियर से जांचते हैं, जो अब भी बहुत सारा ट्रैफ़िक छोटे मॉडलों को भेजता है, तो लगभग हर बार आपको बताया जाएगा कि आप 9 हैं।
एक चैटबॉट बीच में और टॉप पर क्यों फिसलता है
एक मिडल-लेवल CELPIP निबंध टास्क को कवर करता है, व्यवस्थित है, और सामान्य भी है: वजहें बताई जाती हैं लेकिन विकसित नहीं की जातीं, सुरक्षित वोकैबुलरी, एक ही ढांचे के वाक्य। एक मज़बूत निबंध बेदाग नहीं होता; उसमें एक-दो चूकें होती हैं, और विकसित वाक्यों के बीच एक सादा वाक्य। जिस मॉडल के पास तुलना के लिए कोई ग्रेड किया हुआ उदाहरण नहीं है, उसे प्रभाव से तय करना पड़ता है। GPT 5.6 sol का प्रभाव थोड़ा सख्त है: सामान्य 7 उसे 6 लगता है, एक चूक वाला मज़बूत 10 उसे 9 लगता है। Luna और भी सख्त है। GPT-4o mini 9 को ही छत मानता है।
Prepamigo का स्कोरर किसी निबंध को अच्छी राइटिंग के किसी विचार के मुकाबले नहीं आंकता। यह उसकी तुलना उसी टास्क के असली ग्रेड किए गए निबंधों से करता है, हर लेवल पर एक, सभी असली जवाब जिनमें असली चूकें हैं। एक सामान्य लेकिन पूरा निबंध मिडल सैंपल के बगल में जा बैठता है क्योंकि वह उसी से मिलता-जुलता है। एक बेढंगे वाक्य वाला मज़बूत निबंध मज़बूत सैंपल के बगल में जा बैठता है, जिसमें भी एक ऐसा वाक्य है। इस तुलना के ऊपर एक रूल लेयर बैठा है उन चीज़ों के लिए जिन्हें गिनने में मॉडल कमज़ोर है: क्या हर ज़रूरी पॉइंट मौजूद है, क्या सर्वे जवाब ने कोई पक्ष चुना, क्या ईमेल में अभिवादन और समापन है, और वह कितना लंबा है। एक छूटा हुआ ज़रूरी पॉइंट टास्क फ़ुलफ़िलमेंट को 8 या उससे नीचे रोक देता है, अंग्रेज़ी चाहे जैसी हो, क्योंकि टेस्ट ऐसे ही काम करता है।
वर्कफ़्लो का अंतर: आपको क्या-क्या खुद लाना पड़ता है
राइटिंग के लिए, ChatGPT को ग्रेडर के तौर पर इस्तेमाल करना आसान है, और हम इसका उल्टा दिखावा नहीं करेंगे। निबंध पेस्ट करो, नंबर पाओ, व्याख्या मांगो। न रिकॉर्डिंग, न ट्रांसक्रिप्ट। किसी एक निबंध पर फटाफट दूसरी राय के लिए यह सुविधाजनक है और, GPT 5.6 sol के साथ, ठीक-ठाक सटीक भी।
जो आपको नहीं मिलता, वह है टास्क। ChatGPT पूछने पर CELPIP-जैसा प्रॉम्प्ट गढ़ सकता है, लेकिन असली टेस्ट के ज़रूरी पॉइंट, सर्वे विकल्पों और शब्द-संख्या के बारे में यह अंदाज़ा ही लगा रहा होता है। आपको ज़रूरी पॉइंट की जांच नहीं मिलती, क्योंकि इसे नहीं पता कि असली टेस्ट कौन-से पॉइंट लिस्ट करेगा। आपको अपने ही निबंध से सही लंबाई में फिर से लिखा गया मॉडल आंसर नहीं मिलता। और आप जो भी निबंध पेस्ट करते हैं, वह आपके मैसेज भत्ते में से गिना जाता है।
Prepamigo पर, आप बैंक से एक टास्क खोलते हैं, टाइमर चलता है, आप लिखते हैं, और सबमिट करने के लगभग एक मिनट बाद आपके पास चार डाइमेंशन स्कोर, एक कुल स्कोर, जो कुछ छूटा उसकी सूची, आपके अपने टेक्स्ट से कोट किए गए सुधार, और एक फिर से लिखा हुआ मॉडल आंसर होता है। महीने का चालीसवां निबंध भी आपको पहले जितनी ही मेहनत में पड़ता है।
वही निबंध, वही स्कोर
मुख्य रन के बाद हमने सभी 36 निबंधों को अलग-अलग दिनों में दो बार और स्कोर किया। Prepamigo के राइटिंग स्कोरर ने तीनों रन में 86%, 89% और 86% स्कोर किया, और वही बारह मिडल-लेवल निबंध हर बार बैंड के भीतर रहे। GPT 5.6 sol ने 78%, 83% और 81% स्कोर किया: अपने दूसरे और तीसरे रन में बेहतर, और इस बात की याद कि चैटबॉट का एक अकेला जवाब किसी भी दिशा में कुछ अंकों की किस्मत साथ लिए चलता है। अगर आप ChatGPT से ग्रेड करवाते ही हैं, तो दो बार पूछिए और कम वाला जवाब रखिए।
फ़ीडबैक: व्याख्या बनाम सबूत
ChatGPT अच्छी तरह समझाता है। पूछिए कि कोई निबंध 6 क्यों है और यह आपको साफ़ अंग्रेज़ी में, सुझावों के साथ बताएगा। पेंच यह है कि व्याख्या पहले से चुने हुए नंबर को सही ठहराने के लिए लिखी जाती है, इसलिए जब नंबर एक पायदान कम होता है, तो व्याख्या उससे मेल खाने वाली कमियां ढूंढ लेती है। जो उम्मीदवार असल में 7 पर था, वह ऐसी कमज़ोरियों के बारे में एक पन्ना पढ़ता है जो निर्णायक थीं ही नहीं।
Prepamigo का फ़ीडबैक टेक्स्ट से ऊपर की तरफ काम करता है। हर सुधार आपके निबंध के ठीक वही शब्द कोट करता है, और जो कुछ भी चेकर आपके टेक्स्ट में नहीं ढूंढ पाता, वह आपके देखने से पहले ही हटा दिया जाता है। छूटे हुए ज़रूरी पॉइंट का नाम लिया जाता है। हर डाइमेंशन को एक रोकने वाली वजह मिलती है, या साफ़ शब्दों में यह बयान कि उसे कोई चीज़ पीछे नहीं खींच रही। और आपको अपने ही जवाब से, टास्क की मांगी गई लंबाई में फिर से लिखा गया एक मॉडल आंसर मिलता है। नीचे का सेक्शन बताता है कि क्या बदला।
आपके राइटिंग फ़ीडबैक में क्या नया है
स्कोर तो आपको वापस मिलने वाली चीज़ का सिर्फ़ आधा हिस्सा है। राइटिंग फ़ीडबैक लेयर को स्कोरर के साथ-साथ नए सिरे से बनाया गया है, और इसमें हर चीज़ आपके अपने टेक्स्ट से जुड़ी है। यहां बताया गया है कि क्या बदला है।
- ऐसे सुधार जो आप अपने निबंध में खुद ढूंढ सकते हैं. ग्रामर, स्पेलिंग और वोकैबुलरी का हर सुधार आपके जवाब के ठीक वही शब्द कोट करता है, ताकि ऐप उन्हें वहीं हाइलाइट कर सके जहां आपने उन्हें लिखा था। जो कुछ भी चेकर आपके निबंध में शब्द-दर-शब्द नहीं ढूंढ पाता, वह आपके देखने से पहले ही हटा दिया जाता है।
- एक मॉडल आंसर, आपके अपने जवाब से बना हुआ. आपको अपने ही जवाब का एक फिर से लिखा हुआ वर्ज़न मिलता है जो आपके विचार बनाए रखता है, हर ज़रूरी पॉइंट को कवर करता है और टास्क के मांगे गए 150 से 200 शब्दों में उतरता है। अगर पहला रीराइट उस लंबाई से चूक जाता है, तो दिखाए जाने से पहले उसे एक बार फिर से लिखा जाता है।
- जो ज़रूरी पॉइंट आपसे छूटा, उसका नाम. ईमेल टास्क के लिए, फ़ीडबैक प्रॉम्प्ट के उन बुलेट पॉइंट की सूची देता है जिन्हें आपके जवाब ने कवर नहीं किया। एक छूटा हुआ पॉइंट टास्क-फ़ुलफ़िलमेंट स्कोर को भी 8 या उससे नीचे रोक देता है, ताकि नंबर और फ़ीडबैक कभी एक-दूसरे से असहमत न हों।
- हर डाइमेंशन के लिए एक रोकने वाली वजह. चार डाइमेंशन में से हर एक के लिए, फ़ीडबैक ठोस शब्दों में उस एक चीज़ का नाम लेता है जो उस स्कोर को नीचे रोक रही है, या साफ़ कहता है कि कोई चीज़ नहीं रोक रही और उसे कौन-सी चीज़ संभाल रही है। यह तय करना कि किसी डाइमेंशन में कोई समस्या नहीं है, एक असली जवाब है, कोई कमी नहीं।
- आलोचना सही जगह पर. कमज़ोर टोन टास्क-फ़ुलफ़िलमेंट की समस्या है, अस्पष्ट शब्द चुनना वोकैबुलरी की समस्या है, बिना रुके खिंचता वाक्य रीडेबिलिटी की समस्या है। हर पॉइंट उसी डाइमेंशन के नीचे दर्ज होता है जिससे वह जुड़ा है, बजाय इसके कि उसे कुल सारांश में मिला दिया जाए।
- वाक्य-स्तर के रीराइट. आपके निबंध के खास वाक्य एक बेहतर वर्ज़न और इस बारे में एक लाइन के साथ वापस आते हैं कि वह बेहतर क्यों है, ताकि आप बदलाव के बारे में पढ़ने के बजाय उसे देख सकें।
- आपका सबसे मज़बूत और सबसे कमज़ोर डाइमेंशन, आमने-सामने. फ़ीडबैक आपको बताता है कि चार डाइमेंशन में से कौन-सा आपके स्कोर को संभाल रहा है और कौन-सा उसे पीछे खींच रहा है, ताकि चार नंबरों को डिकोड किए बिना आपको पता हो कि अगली प्रैक्टिस किस पर करनी है।
फ़ीडबैक का हर कोटेशन दिखाए जाने से पहले आपके निबंध से मिलाया जाता है। अगर चेकर वे शब्द नहीं ढूंढ पाता, तो वह लाइन हटा दी जाती है। इसीलिए फ़ीडबैक कभी आपसे कुछ ऐसा ठीक करने को नहीं कहता जो आपने लिखा ही नहीं।
रोज़ प्रैक्टिस करने की कीमत क्या है
ChatGPT Plus की कीमत US$20 प्रति माह है, यानी लगभग CA$28, मासिक बिलिंग पर, जैसा सितंबर 2026 में बताया गया है, हर घूमती हुई विंडो में मैसेज की सीमा के साथ; ChatGPT Pro, US$200 प्रति माह पर, यानी टैक्स से पहले लगभग CA$276, उस सीमा को बढ़ा देता है। फ़्री टियर अपना बहुत सारा ट्रैफ़िक छोटे मॉडलों को भेजता है, और इस टेस्ट में उनमें से सबसे छोटे ने बारह में से तीन मज़बूत निबंध पहचाने। किसी भी प्लान में टास्क बैंक, टाइमर, ज़रूरी पॉइंट की जांच, मॉडल आंसर, या असली ग्रेड किए गए निबंधों के मुकाबले कैलिब्रेट किया गया स्कोर शामिल नहीं है।
Prepamigo की कीमत CA$24.98 प्रति माह है, या एनुअल प्लान पर CA$8.25 प्रति माह, जो साल भर के लिए CA$98.98 होती है, टैक्स सहित, और आप किसी भी वक्त कैंसिल कर सकते हैं। हर प्लान में असीमित स्कोरिंग शामिल है, बिना किसी डेली, सेशन या साप्ताहिक कैप के, असीमित अटेम्प्ट्स, और पूरा प्रश्न बैंक: 80 पूरे प्रैक्टिस सेट्स और Writing, Speaking, Reading तथा Listening में 2,000 से ज़्यादा प्रैक्टिस टास्क, जो CELPIP General टेस्ट के टास्क टाइप्स, टाइमिंग और फॉर्मेट के मुताबिक लिखे गए हैं।
ChatGPT कब बेहतर टूल है
- एक निबंध पर फटाफट दूसरी राय। GPT 5.6 sol एक ठीक-ठाक ग्रेडर है और दस सेकंड लेता है। अगर आपके पास टास्क पहले से है और आप बस एक और नज़रिया चाहते हैं, तो यह ठीक है।
- किसी वाक्य को पांच तरीकों से फिर से लिखना। किसी बेढंगे वाक्य के विकल्प मांगना तेज़ है और सुझाव अच्छे होते हैं।
- किसी बात पर चर्चा करना। अगर आप इस पर बहस करना चाहते हैं कि कोई वजह कमज़ोर क्यों है, तो बातचीत का तरीका ही सही है। Prepamigo आपको एक फैसला और सबूत देता है; यह चैट नहीं करता।
- टेस्ट के बाहर की कोई भी चीज़। ChatGPT एक जनरल असिस्टेंट है और Prepamigo नहीं है।
जो चीज़ इसे नहीं होना चाहिए, वह है 7 या 8 वाले लेखक को यह बताने वाली इकलौती चीज़ कि वह कहां खड़ा है, या एक मज़बूत लेखक को यह बताने वाली चीज़ कि वह 9 है। यही दो जगहें हैं जहां यह सबसे ज़्यादा बार गलत होता है।
अक्सर पूछे जाने वाले सवाल
क्या ChatGPT मेरी CELPIP राइटिंग स्कोर कर सकता है? हां, और ज़्यादातर चैटबॉट से बेहतर: 36 आधिकारिक जवाबों पर GPT 5.6 sol, 78% बार सही निकला, luna 69%, GPT-4o mini 58%, जबकि Prepamigo के लिए यह आंकड़ा 86% था।
क्या राइटिंग के लिए Prepamigo, ChatGPT से ज़्यादा सटीक है? सबसे अच्छे GPT मॉडल के मुकाबले आठ अंकों से। मिडल-लेवल निबंध 100% बनाम 75%; मज़बूत निबंध 83% बनाम 75%; कमज़ोर निबंध 75% बनाम 83%।
मुझे कौन-सा GPT मॉडल इस्तेमाल करना चाहिए? GPT 5.6 sol। GPT-4o mini नहीं, जिसने बारह मज़बूत निबंधों में से नौ को 9 दिया।
हर एक की कीमत कितनी है? ChatGPT Pro की कीमत US$200 प्रति माह है, यानी टैक्स से पहले लगभग CA$276; Plus की कीमत US$20 है, मैसेज की सीमाओं के साथ। Prepamigo की कीमत CA$24.98 प्रति माह है, टैक्स सहित, या एनुअल प्लान पर CA$8.25 प्रति माह, असीमित स्कोरिंग और 80 प्रैक्टिस सेट्स के साथ।
Claude के साथ यही तुलना देखने के लिए, राइटिंग के लिए Prepamigo बनाम Claude पढ़ें। राइटिंग स्कोरर कैसे काम करता है यह जानने के लिए, Prepamigo राइटिंग स्कोरर के भीतर की झलक पढ़ें। इसे अंग्रेज़ी में पढ़ने के लिए यहां क्लिक करें: इसे अंग्रेज़ी में पढ़ें। या पढ़ना छोड़कर एक जवाब लिखें।
