Produkto

Prepamigo vs ChatGPT para sa CELPIP Writing: Katumpakan, Limitasyon at Gastos

Setyembre 8, 2026

Bahagi ng mga essay na na-score sa verified level

36 opisyal na CELPIP writing response, 12 sa bawat isa sa tatlong antas, sa parehong writing task. Binigyan ang bawat GPT model ng task at ng essay at hiniling, sa payak na salita, na i-score ito sa CELPIP scale. Tumakbo ang writing scorer ng Prepamigo gaya ng ginagawa nito sa production.

86%

Prepamigo Writing Scorer

78%

GPT 5.6 sol

69%

GPT 5.6 luna

58%

GPT-4o mini

Prepamigo laban sa mga nangungunang chatbot plan

Dolyar Canadian. Kasama na ang buwis sa mga presyo ng Prepamigo. Ang Claude Max (mula sa US$100) at ChatGPT Pro (US$200) ay na-convert sa 1.38, bago buwis. Ang accuracy ay ang bahagi ng 36 opisyal na essay na na-score sa verified level kapag hiniling sa napiling modelo, sa payak na salita, na i-score ang essay; isang takbo.

Prepamigo
ChatGPT ProGPT 5.6 sol
Buwanang bayad
CA$24.98 (kasama buwis)
CA$276 (dagdag buwis)
Pag-score
Walang limitasyon
Limitado
Handang bangko ng tanong
Oo
Hindi
Practice set
80
Wala
Practice task
2,000+
Wala
Format ng CELPIP
Oo
Hindi
Katumpakan
86%
78%
Essay sa gitnang antas
100%
75%

Ang ChatGPT marahil ang pinakakaraniwang tool na ginagamit ng mga kandidato sa CELPIP para suriin ang kanilang writing. Idikit ang email, humingi ng score, kumuha ng numero at isang talata. Mabilis ito, nasa telepono mo, at para sa writing walang hakbang ng transcription na humahadlang. Kaya sinubok namin ang numero. Ibinigay namin sa tatlong GPT model ang parehong 36 opisyal na CELPIP writing response na pinagsusukatan ng aming sariling scorer, labindalawa sa bawat antas, at hiniling naming i-score ang mga essay sa paraang hihilingin ng isang estudyante.

Ang maikling sagot: natamo ng writing scorer ng Prepamigo ang verified level 86% ng oras. Ang GPT 5.6 sol, ang model sa likod ng mga bayad na plan ng ChatGPT, ay natamo ito 78% ng oras. Umabot ang GPT 5.6 luna sa 69% at ang GPT-4o mini sa 58%. Ang walong puntos ay isang totoong agwat, at nagmumula ito sa dalawang lugar: ang gitna ng scale, kung saan na-score ng Prepamigo nang tama ang lahat ng labindalawang essay at ng GPT 5.6 sol ang siyam, at ang pinakataas, kung saan pinigil ng GPT 5.6 sol ang ikaapat na bahagi ng malalakas na essay sa 9.

Dapat naming sabihin agad na ang GPT 5.6 sol ang pinakamahusay na general-purpose writing grader na nasubok namin, malayong nangunguna sa anumang Claude model sa parehong mga essay. Dadaanan ng natitirang bahagi ng artikulong ito ang mga resulta antas por antas, ipapaliwanag kung saan nagmumula ang walong puntos, titingnan ang feedback sa bawat panig, at ihahambing ang gastos ng seryosong pag-practice ng writing gamit ang bawat isa.

Ang payak na pagsubok: ang talagang nakukuha ng estudyante

Walumpu’t anim na porsyento laban sa pitumpu’t walo. Sa 36 essay, iyon ay tatlong dagdag na tamang score para sa Prepamigo kaysa sa GPT 5.6 sol, anim na dagdag kaysa sa GPT 5.6 luna, at sampung dagdag kaysa sa GPT-4o mini. Sa ibang salita, gumagawa ang Prepamigo ng 37% na mas kaunting pagkakamali sa scoring kaysa sa GPT 5.6 sol, 55% na mas kaunti kaysa sa luna at 67% na mas kaunti kaysa sa GPT-4o mini.

Mahalaga kung ano ang ibinigay sa mga GPT model. Sinabihan ang bawat isa na ito ay isang may-karanasang CELPIP writing examiner, ibinigay ang task nang eksakto gaya ng nakita ng kandidato, kasama ang mga kinakailangang punto para sa email task at ang mga opsyon para sa survey task, at ibinigay ang essay. Hiniling dito ang isang score mula 0 hanggang 12. Iyon ang ita-type mo sa ChatGPT, at mas patas itong pagsubok kaysa sa isang hubad na “i-grade mo ito” dahil alam man lang ng model kung ano ang hinihingi ng task.

Tumanggap ang scorer ng Prepamigo ng parehong task at parehong essay, kasama ang palagi nitong taglay sa production: mga totoong graded sample essay para sa task na iyon sa bawat antas na ikukumpara, at isang rule layer na sinusuri ang mga bagay na unang sinusuri ng isang rater, tulad ng kung nasakop ba ang bawat kinakailangang punto, kung talagang pumipili ng panig ang isang survey response, kung may pagbati at pagtatapos ang isang email, at kung malapit man lang ang sagot sa habang hinihingi ng task.

Kung saan nagmumula ang walong puntos: antas por antas

Mahihinang essay (verified score 4 o 5)

12 opisyal na essay. Ang iisang antas kung saan bahagyang nangunguna ang mga GPT model.

83%

GPT 5.6 sol

83%

GPT 5.6 luna

83%

GPT-4o mini

75%

Prepamigo Writing Scorer

Sa mahihinang essay, nasa 83% ang lahat ng tatlong GPT model at nasa 75% ang Prepamigo. Ito ang iisang antas kung saan nangunguna ang ChatGPT, at iniuulat namin ito nang ganoon. Ang tatlong miss ng Prepamigo ay lahat umakyat ng isang baitang na mas mataas, sa 6 o 7, sa mga essay na maikli pero maayos. Ang dalawang miss ng GPT 5.6 sol ay parehong 6. Ang mahihinang essay ang madaling dulo ng scale para sa isang chatbot: ang maikli, generic, at madalas magkamaling pagsulat ay mukhang mahina para sa kahit sino.

Gitnang essay (verified score 7 o 8)

12 opisyal na essay. Ang antas kung nasaan ang karamihan sa mga kandidato.

100%

Prepamigo Writing Scorer

75%

GPT 5.6 sol

67%

GPT-4o mini

58%

GPT 5.6 luna

Sa gitna, na-score ng Prepamigo ang lahat ng labindalawang essay sa loob ng 7 hanggang 8 na banda. Natamaan ng GPT 5.6 sol ang siyam; ang tatlong miss nito ay lahat 6, isang baitang sa ibaba. Natamaan ng GPT 5.6 luna ang pito, hinila ang tatlong essay pababa sa 6, isa sa 5 at isa pataas sa 9. Natamaan ng GPT-4o mini ang walo at itinulak ang natitirang apat pataas sa 9.

Ang 7 o 8 ang pinakakaraniwang totoong score sa test, at ito ang score na nagpapasya kung naabot na ng isang kandidato ang kanyang target. Sasabihin ng GPT 5.6 sol sa isa sa bawat apat na ganoong kandidato na bumaba siya sa 6. Sasabihin ito ng luna sa apat sa bawat sampu. Wala sa dalawa ang sakuna sa paraang ang mga resulta ng Claude sa gitnang banda, pero ito ang pagkakaiba sa pagitan ng isang practice score na maaari mong pagplanuhan at isang kailangan mong pagdudahan.

Malalakas na essay (verified score 10 pataas)

12 opisyal na essay. Ang mga miss dito ay 9: malakas ang essay at nagpigil ang grader.

83%

Prepamigo Writing Scorer

75%

GPT 5.6 sol

67%

GPT 5.6 luna

25%

GPT-4o mini

Sa pinakataas, nakilala ng Prepamigo ang sampu sa labindalawang malalakas na essay, ng GPT 5.6 sol ang siyam, ng luna ang walo, at ng GPT-4o mini ang tatlo. Bawat miss maliban sa isa ay 9. Binigyan ng GPT-4o mini ng 9 ang siyam sa labindalawang malalakas na essay: hindi lang talaga ito namimigay ng 10. Kung malakas ang iyong writing at sinusuri mo ito gamit ang free tier ng ChatGPT, na nagpapadala pa rin ng maraming traffic sa maliliit na model, sasabihin sa iyo na ikaw ay 9 halos sa bawat pagkakataon.

Ang 9 mula sa ChatGPT sa isang essay na inakala mong napakahusay ay mas malamang na isang pinigil na 10 kaysa sa isang totoong 9. Isulat itong muli nang isang beses na katabi ang model answer at i-score itong muli; ang isang tuloy-tuloy na 10 sa dalawang pagsubok ay 10.

Bakit nadudulas ang chatbot sa gitna at sa pinakataas

Ang isang CELPIP essay sa gitnang antas ay sumasakop sa task, maayos, at generic din: mga dahilan na ipinapahayag lang sa halip na pinalalawig, ligtas na bokabularyo, mga pangungusap na iisa ang hugis. Ang isang malakas na essay ay hindi perpekto; may isa o dalawang pagkakamali ito, at isang payak na pangungusap sa gitna ng mga pinalawig. Ang isang model na walang graded example na ikukumpara ay kailangang magpasya mula sa impresyon. Ang impresyon ng GPT 5.6 sol ay medyo mahigpit: ang generic na 7 ay nababasa bilang 6, ang malakas-na-may-pagkakamali na 10 ay nababasa bilang 9. Mas mahigpit pa ang luna. Itinuturing ng GPT-4o mini ang 9 bilang kisame.

Hindi hinuhusgahan ng scorer ng Prepamigo ang isang essay laban sa isang ideya ng magandang pagsulat. Inihahambing nito ito sa mga totoong graded essay para sa parehong task, isa sa bawat antas, lahat ay totoong sagot na may totoong mga pagkakamali. Ang isang generic pero kumpletong essay ay lumalapag sa tabi ng gitnang sample dahil iyon ang kahawig nito. Ang isang malakas na essay na may isang magaspang na pangungusap ay lumalapag sa tabi ng malakas na sample, na mayroon ding isa. Sa ibabaw ng paghahambing na iyon ay nakalagay ang isang rule layer para sa mga bagay na hindi magaling bilangin ng isang model: kung naroon ba ang bawat kinakailangang punto, kung pumili ba ng panig ang survey response, kung may pagbati at pagtatapos ba ang email, at kung gaano ito kahaba. Ang isang napalampas na kinakailangang punto ay nagpapanatili ng task fulfillment sa 8 o mas mababa anuman ang Ingles, dahil ganoon gumagana ang test.

Ang agwat sa workflow: kung ano ang kailangan mong dalhin

Para sa writing, madaling gamitin ang ChatGPT bilang grader, at hindi namin ikakaila iyon. Idikit ang essay, kumuha ng numero, humingi ng paliwanag. Walang recording, walang transcript. Para sa isang mabilis na pangalawang opinyon sa iisang essay, maginhawa ito at, gamit ang GPT 5.6 sol, katamtamang tumpak.

Ang hindi mo nakukuha ay ang task. Kaya ng ChatGPT gumawa ng CELPIP-style prompt kung hihilingin mo, pero hinuhulaan lang nito ang mga kinakailangang punto, ang mga opsyon ng survey at ang bilang ng salita na ginagamit ng totoong test. Hindi ka nakakakuha ng required-point check, dahil hindi nito alam kung aling mga punto ang ililista ng totoong test. Hindi ka nakakakuha ng model answer na muling isinulat mula sa sarili mong essay sa tamang haba. At bawat essay na idinidikit mo ay ibinabawas sa iyong message allowance.

Sa Prepamigo, magbubukas ka ng task mula sa bangko, tumatakbo ang timer, sumusulat ka, at mga isang minuto pagkatapos mong mag-submit, mayroon ka nang apat na dimension score, isang overall score, listahan ng anumang napalampas mo, mga pagwawasto na sinipi mula sa sarili mong teksto, at isang muling isinulat na model answer. Ang ikaapatnapung essay ng buwan ay may parehong pagsisikap gaya ng una.

Ang parehong essay, ang parehong score

Pagkatapos ng pangunahing takbo, na-score namin ang lahat ng 36 essay ng dalawa pang beses sa magkaibang araw. Nakakuha ang writing scorer ng Prepamigo ng 86%, 89% at 86% sa tatlong takbo, na ang parehong labindalawang essay sa gitnang antas ay nasa loob ng banda sa bawat pagkakataon. Nakakuha ang GPT 5.6 sol ng 78%, 83% at 81%: mas mahusay sa ikalawa at ikatlong takbo nito, at isang paalala na ang iisang sagot ng chatbot ay may dalang ilang puntos ng suwerte sa alinmang direksyon. Kung mag-grade ka gamit ang ChatGPT, magtanong nang dalawang beses at panatilihin ang mas mababang sagot.

Feedback: paliwanag laban sa ebidensya

Mahusay magpaliwanag ang ChatGPT. Tanungin mo kung bakit 6 ang isang essay at sasabihin nito sa iyo, sa malinaw na Ingles, na may mga suhestiyon. Ang problema ay isinulat ang paliwanag upang bigyang-katwiran ang isang numero na napili na, kaya kapag isang baitang na mababa ang numero, nakakahanap ang paliwanag ng mga pagkukulang na tugma dito. Ang isang kandidato na talagang nasa 7 ay nagbabasa ng isang pahina tungkol sa mga kahinaang hindi naman mapagpasya.

Gumagana ang feedback ng Prepamigo mula sa teksto pataas. Bawat pagwawasto ay nagsisipi ng eksaktong mga salita mula sa iyong essay, at anumang hindi mahanap ng checker sa iyong teksto ay tinatanggal bago mo ito makita. Ang isang napalampas na kinakailangang punto ay pinangangalanan. Bawat dimensyon ay nakakakuha ng isang limiting factor, o isang malinaw na pahayag na walang pumipigil dito. At nakakakuha ka ng model answer na muling isinulat mula sa sarili mong sagot sa habang hinihingi ng task. Inililista ng seksyon sa ibaba kung ano ang nagbago.

Ano ang bago sa iyong writing feedback

Ang score ay kalahati lamang ng natatanggap mo. Itinayong muli ang writing feedback layer kasabay ng scorer, at lahat ng nasa loob nito ay nakaangkla sa sarili mong teksto. Ito ang mga pagbabago.

  • Mga pagwawasto na mahahanap mo sa sarili mong essay. Bawat pagwawasto sa grammar, spelling at bokabularyo ay nagsisipi ng eksaktong mga salita mula sa iyong sagot, kaya kayang i-highlight ng app ang mga ito kung saan mo isinulat. Anumang hindi mahanap ng checker nang salita por salita sa iyong essay ay tinatanggal bago mo ito makita.
  • Isang model answer, na binuo mula sa sagot mo. Makakatanggap ka ng muling isinulat na bersyon ng sarili mong sagot na nagpapanatili ng iyong mga ideya, sumasakop sa bawat kinakailangang punto, at umaabot sa 150 hanggang 200 salita na hinihingi ng task. Kung hindi maabot ng unang rewrite ang habang iyon, ginagawa itong muli nang isang beses bago ipakita.
  • Ang kinakailangang puntong hindi mo natugunan, na pinangalanan. Para sa email task, inililista ng feedback ang mga bullet point mula sa prompt na hindi nasakop ng iyong sagot. Ang isang napalampas na punto ay nagpapanatili rin ng task-fulfillment score sa 8 o mas mababa, kaya hindi kailanman magkakasalungat ang numero at ang feedback.
  • Isang limiting factor sa bawat dimensyon. Para sa bawat isa sa apat na dimensyon, pinangangalanan ng feedback ang iisang bagay na pumipigil sa score na iyon, sa konkretong salita, o sinasabi nang malinaw na walang pumipigil at kung ano ang bumubuhat dito. Ang pagpapasyang walang problema ang isang dimensyon ay isang totoong sagot, hindi isang puwang.
  • Puna sa tamang lugar. Ang mahinang tono ay problema sa task fulfillment, ang malabong pagpili ng salita ay problema sa bokabularyo, ang run-on sentence ay problema sa readability. Bawat punto ay inilalagay sa ilalim ng dimensyong nagmamay-ari nito sa halip na isama lang sa pangkalahatang buod.
  • Mga rewrite sa antas ng pangungusap. Ang mga tiyak na pangungusap mula sa iyong essay ay ibinabalik na may pinahusay na bersyon at isang linya kung bakit ito mas maganda, para makita mo ang pagbabago sa halip na basahin lang ang tungkol dito.
  • Ang pinakamalakas at pinakamahina mong dimensyon, magkatabi. Sinasabi sa iyo ng feedback kung alin sa apat na dimensyon ang bumubuhat sa iyong score at alin ang pumipigil dito, para malaman mo kung ano ang susunod na sasanayin nang hindi kailangang unawain ang apat na numero.

Bawat sipi sa feedback ay sinusuri laban sa iyong essay bago ito ipakita. Kung hindi mahanap ng checker ang mga salita, tinatanggal ang linya. Kaya hindi kailanman sasabihin sa iyo ng feedback na ayusin ang isang bagay na hindi mo isinulat.

Ang gastos sa pagpractice araw-araw

Ang ChatGPT Plus ay US$20 kada buwan, humigit-kumulang CA$28, sinisingil buwan-buwan, gaya ng nailathala noong Setyembre 2026, may cap sa mga mensahe kada rolling window; ang ChatGPT Pro, sa US$200 kada buwan, humigit-kumulang CA$276 bago buwis, ay nagtataas ng cap. Ang free tier ay nagpapadala ng malaking bahagi ng traffic nito sa mas maliliit na model, at sa pagsubok na ito ang pinakamaliit sa kanila ay nakakilala ng tatlong malalakas na essay sa labindalawa. Wala sa mga plan na may bangko ng task, timer, required-point check, model answer, o score na na-calibrate laban sa mga totoong graded essay.

Ang Prepamigo ay CA$24.98 kada buwan, o CA$8.25 kada buwan sa annual plan, na CA$98.98 para sa taon, kasama na ang buwis, at maaari mong kanselahin anumang oras. Ang bawat plan ay may walang limitasyong pag-score na walang araw-araw, session, o weekly cap, walang limitasyong pagsubok, at ang buong bangko ng tanong: 80 kumpletong practice set at mahigit 2,000 practice task sa Writing, Speaking, Reading, at Listening, na sinulat upang sundin ang tipo ng task, timing, at format ng CELPIP General test.

Kailan mas mainam ang ChatGPT

  • Isang mabilis na pangalawang opinyon sa iisang essay. Ang GPT 5.6 sol ay isang disenteng grader at sampung segundo lang ang kailangan. Kung mayroon ka nang task at gusto mo lang ng isa pang pananaw, ayos ito.
  • Pagsulat muli ng isang pangungusap sa limang paraan. Ang paghingi ng mga alternatibo sa isang magaspang na pangungusap ay mabilis at maganda ang mga suhestiyon.
  • Pag-usapan ito. Kung gusto mong makipagtalo kung bakit mahina ang isang dahilan, angkop ang isang pag-uusap. Nagbibigay ang Prepamigo ng verdict at ebidensya; hindi ito nakikipag-chat.
  • Anumang bagay na wala sa test. Ang ChatGPT ay isang general assistant at hindi ang Prepamigo.

Ang hindi nito dapat maging papel ay ang tanging bagay na nagsasabi sa isang 7 o 8 na manunulat kung nasaan siya, o ang bagay na nagsasabi sa isang malakas na manunulat na siya ay 9. Iyon ang dalawang lugar kung saan ito pinakamadalas magkamali.

Mga Tanong

Kaya bang i-score ng ChatGPT ang aking CELPIP writing? Oo, at mas mahusay kaysa sa karamihan ng mga chatbot: tama ang GPT 5.6 sol 78% ng oras sa 36 opisyal na sagot, ang luna 69%, ang GPT-4o mini 58%, kumpara sa 86% para sa Prepamigo.

Mas tumpak ba ang Prepamigo kaysa sa ChatGPT sa writing? Ng walong puntos laban sa pinakamahusay na GPT model. Mga essay sa gitnang antas 100% kumpara sa 75%; malalakas na essay 83% kumpara sa 75%; mahihinang essay 75% kumpara sa 83%.

Aling GPT model ang dapat kong gamitin? GPT 5.6 sol. Hindi ang GPT-4o mini, na nagbigay ng 9 sa siyam sa labindalawang malalakas na essay.

Magkano ang gastos ng bawat isa? Ang ChatGPT Pro ay US$200 kada buwan, humigit-kumulang CA$276 bago buwis; ang Plus ay US$20 na may cap sa mensahe. Ang Prepamigo ay CA$24.98 kada buwan kasama na ang buwis, o CA$8.25 kada buwan sa annual plan, may walang limitasyong pag-score at 80 practice set.

Para sa parehong paghahambing laban sa Claude, basahin ang Prepamigo vs Claude para sa writing. Para makita kung paano gumagana ang writing scorer, basahin ang loob ng writing scorer ng Prepamigo. O Sumulat ng sagot at tingnan ang score. Basahin ang gabay na ito sa Ingles.

Prepamigo vs ChatGPT para sa CELPIP Writing: Katumpakan, Limitasyon at Gastos | PrepAmigo