제품

CELPIP 라이팅, Prepamigo와 ChatGPT 비교: 정확도, 한도, 그리고 비용

2026년 9월 8일

검증된 등급으로 채점된 에세이의 비율

36편의 공식 CELPIP 라이팅 응답, 세 등급에 각각 12편씩, 두 가지 라이팅 과제 모두 포함. 각 GPT 모델에게 과제와 에세이를 주고 평범한 말로 CELPIP 척도에 따라 채점하도록 요청했습니다. Prepamigo의 라이팅 채점기는 일반 프로덕션 구성으로 실행되었습니다.

86%

Prepamigo 라이팅 채점기

78%

GPT 5.6 sol

69%

GPT 5.6 luna

58%

GPT-4o mini

Prepamigo와 인기 챗봇 요금제 비교

캐나다 달러 기준입니다. Prepamigo 가격은 세금이 포함되어 있습니다. Claude Max(월 US$100부터)와 ChatGPT Pro(월 US$200)는 세전 가격을 1.38 환율로 환산한 값입니다. 정확도는 해당 모델에게 평범한 말로 에세이 채점을 요청했을 때 36편의 공식 에세이 중 검증된 등급과 일치한 비율이며, 1회 실행 결과입니다.

Prepamigo
ChatGPT ProGPT 5.6 sol
월 요금
CA$24.98 (세금 포함)
CA$276 (세금 별도)
채점
무제한
제한
완성된 문제 은행
있음
없음
연습 세트
80개
없음
연습 과제
2,000개+
없음
CELPIP 형식
있음
없음
정확도
86%
78%
중위 등급 에세이
100%
75%

ChatGPT는 아마도 CELPIP 응시자들이 자신의 글을 확인하는 데 가장 흔히 쓰는 도구일 것입니다. 이메일을 붙여넣고, 점수를 요청하고, 숫자와 설명 한 단락을 받습니다. 빠르고, 휴대폰에서 바로 되며, 라이팅에는 방해가 되는 전사 단계도 없습니다. 그래서 우리는 그 숫자를 테스트했습니다. 우리 자체 채점기의 성능을 측정하는 데 쓰는 동일한 36편의 공식 CELPIP 라이팅 응답을 각 등급별로 열두 편씩 세 가지 GPT 모델에게 주고, 학생이 요청하듯이 에세이 채점을 요청했습니다.

짧게 답하자면: Prepamigo의 라이팅 채점기는 86%의 확률로 검증된 등급을 맞혔습니다. ChatGPT 유료 요금제의 기반 모델인 GPT 5.6 sol은 78%였습니다. GPT 5.6 luna는 69%, GPT-4o mini는 58%에 그쳤습니다. 8포인트는 실질적인 격차이며, 두 곳에서 나옵니다: Prepamigo가 열두 편 모두를 정확히 채점한 반면 GPT 5.6 sol은 아홉 편만 맞힌 척도의 중간, 그리고 GPT 5.6 sol이 강한 에세이의 4분의 1을 9점에 묶어 둔 최상위입니다.

먼저 밝혀 두자면, GPT 5.6 sol은 우리가 테스트한 범용 라이팅 채점자 중 가장 뛰어나며, 같은 에세이에서 어떤 Claude 모델보다도 훨씬 앞섭니다. 이 글의 나머지 부분에서는 결과를 등급별로 살펴보고, 8포인트가 어디서 나오는지 설명하며, 양쪽의 피드백을 살펴보고, 각각으로 라이팅을 진지하게 연습할 때 드는 비용을 비교합니다.

평범한 테스트: 학생이 실제로 얻는 것

86% 대 78%. 36편의 에세이에서 이는 Prepamigo가 GPT 5.6 sol보다 3개, GPT 5.6 luna보다 6개, GPT-4o mini보다 10개 더 많은 정답을 냈다는 뜻입니다. 달리 말하면, Prepamigo는 GPT 5.6 sol보다 채점 실수를 37% 더 적게 하고, luna보다 55%, GPT-4o mini보다 67% 더 적게 합니다.

GPT 모델들에게 무엇을 주었는지가 중요합니다. 각 모델에게 당신은 경험 많은 CELPIP 라이팅 시험관이라고 알려주고, 이메일 과제의 필수 요점과 설문 과제의 선택지를 포함해 응시자가 본 그대로의 과제를 주고, 에세이를 주었습니다. 그리고 0점에서 12점 사이의 점수 하나를 요청했습니다. 이것이 ChatGPT에 직접 입력할 법한 내용이며, 모델이 적어도 과제가 무엇을 요구했는지는 알기 때문에 단순한 “이거 채점해 줘”보다 더 공정한 테스트입니다.

Prepamigo의 채점기도 같은 과제와 같은 에세이를 받았고, 거기에 프로덕션에서 항상 갖추고 있는 것도 함께 있었습니다: 비교할 수 있는 그 과제의 각 등급별 실제 채점 샘플 에세이, 그리고 채점관이 가장 먼저 확인하는 것들을 점검하는 규칙 레이어입니다. 예를 들어 모든 필수 요점이 다루어졌는지, 설문 응답이 실제로 한쪽 입장을 택했는지, 이메일에 인사말과 맺음말이 있는지, 응답 길이가 과제가 요구하는 분량에 근접하는지 같은 것들입니다.

8포인트는 어디서 나오는가: 등급별로 살펴보기

약한 에세이 (검증된 점수 4점 또는 5점)

공식 에세이 12편. GPT 모델들이 근소하게 앞서는 유일한 등급입니다.

83%

GPT 5.6 sol

83%

GPT 5.6 luna

83%

GPT-4o mini

75%

Prepamigo 라이팅 채점기

약한 에세이에서는 세 GPT 모델 모두 83%이고 Prepamigo는 75%입니다. 이것이 ChatGPT가 앞서는 유일한 등급이며, 우리는 그대로 보고합니다. Prepamigo가 놓친 세 편은 모두 짧지만 깔끔한 에세이에서 한 단계 높은 6점이나 7점으로 간 경우였습니다. GPT 5.6 sol이 놓친 두 편은 모두 6점이었습니다. 약한 에세이는 챗봇에게 척도의 쉬운 쪽 끝입니다: 짧고, 평범하고, 오류가 많은 글은 누가 봐도 약해 보이기 때문입니다.

중위 에세이 (검증된 점수 7점 또는 8점)

공식 에세이 12편. 대부분의 응시자가 위치한 등급입니다.

100%

Prepamigo 라이팅 채점기

75%

GPT 5.6 sol

67%

GPT-4o mini

58%

GPT 5.6 luna

중간에서는 Prepamigo가 열두 편 모두를 7~8점 범위 안에서 채점했습니다. GPT 5.6 sol은 아홉 편을 맞혔고, 놓친 세 편은 모두 한 단계 아래인 6점이었습니다. GPT 5.6 luna는 일곱 편을 맞혔고, 세 편을 6점으로, 한 편을 5점으로 끌어내렸으며 한 편은 9점으로 올렸습니다. GPT-4o mini는 여덟 편을 맞혔고 나머지 네 편은 9점으로 밀어 올렸습니다.

7점이나 8점은 시험에서 가장 흔한 실제 점수이며, 응시자가 목표에 도달했는지 여부를 가르는 점수입니다. GPT 5.6 sol은 그런 응시자 네 명 중 한 명에게 6점으로 떨어졌다고 말할 것입니다. Luna는 열 명 중 네 명에게 그렇게 말할 것입니다. 어느 쪽도 Claude의 중위 등급 결과처럼 재앙 수준은 아니지만, 계획을 세울 수 있는 연습 점수와 의심해 봐야 하는 연습 점수의 차이입니다.

강한 에세이 (검증된 점수 10점 이상)

공식 에세이 12편. 여기서 놓친 경우는 9점입니다: 에세이는 강했지만 채점자가 점수를 아꼈습니다.

83%

Prepamigo 라이팅 채점기

75%

GPT 5.6 sol

67%

GPT 5.6 luna

25%

GPT-4o mini

최상위에서는 Prepamigo가 강한 에세이 열두 편 중 열 편을 인식했고, GPT 5.6 sol은 아홉 편, luna는 여덟 편, GPT-4o mini는 세 편을 인식했습니다. 놓친 경우는 하나를 제외하고 모두 9점이었습니다. GPT-4o mini는 강한 에세이 열두 편 중 아홉 편에 9점을 주었습니다: 그냥 10점을 주지 않는 것입니다. 글이 강한데 여전히 많은 트래픽을 작은 모델로 보내는 ChatGPT 무료 등급으로 확인한다면, 거의 매번 9점이라는 말을 듣게 될 것입니다.

훌륭하다고 생각한 에세이에 ChatGPT가 9점을 주었다면, 진짜 9점보다는 점수를 아낀 10점일 가능성이 더 높습니다. 모범 답안을 옆에 두고 한 번 다시 쓴 뒤 다시 채점해 보세요. 두 번의 시도에서 일관되게 10점이 나오면 10점입니다.

챗봇은 왜 중간과 최상위에서 미끄러지는가

중위 등급 CELPIP 에세이는 과제를 다루고, 체계적이며, 동시에 평범합니다: 이유는 전개되기보다 단언되고, 어휘는 안전하며, 문장은 한 가지 모양입니다. 강한 에세이는 흠이 없지 않습니다. 한두 군데 실수가 있고, 잘 전개된 문장들 사이에 밋밋한 문장이 하나 섞여 있습니다. 비교할 채점 예시가 없는 모델은 인상으로 결정해야 합니다. GPT 5.6 sol의 인상은 조금 엄격합니다: 평범한 7점은 6점으로 읽히고, 실수가 하나 있는 강한 10점은 9점으로 읽힙니다. Luna는 그보다 더 엄격합니다. GPT-4o mini는 9점을 천장으로 취급합니다.

Prepamigo의 채점기는 에세이를 좋은 글에 대한 관념과 비교해 판단하지 않습니다. 같은 과제의 실제 채점 에세이, 각 등급별로 한 편씩, 모두 실제 실수가 담긴 실제 응답들과 비교합니다. 평범하지만 완결된 에세이는 가장 닮은 것이 중간 샘플이기 때문에 그 옆에 자리 잡습니다. 어색한 문장이 하나 있는 강한 에세이는 역시 어색한 문장이 하나 있는 강한 샘플 옆에 자리 잡습니다. 이 비교 위에는 모델이 세는 데 서투른 것들을 위한 규칙 레이어가 얹혀 있습니다: 모든 필수 요점이 들어 있는지, 설문 응답이 한쪽 입장을 택했는지, 이메일에 인사말과 맺음말이 있는지, 길이가 얼마나 되는지입니다. 필수 요점을 하나 놓치면 영어와 무관하게 과제 수행 점수는 8점 이하로 묶이는데, 시험이 그렇게 작동하기 때문입니다.

사용 흐름의 격차: 당신이 직접 가져와야 하는 것

라이팅에서 ChatGPT는 채점자로 쓰기 쉽고, 우리는 그렇지 않은 척하지 않겠습니다. 에세이를 붙여넣고, 숫자를 받고, 설명을 요청하면 됩니다. 녹음도, 전사문도 없습니다. 에세이 한 편에 대해 빠르게 다른 의견을 구하기에는 편리하며, GPT 5.6 sol이라면 꽤 정확하기까지 합니다.

얻지 못하는 것은 과제입니다. ChatGPT는 요청하면 CELPIP 형식의 프롬프트를 만들어낼 수 있지만, 실제 시험이 사용하는 필수 요점, 설문 선택지, 단어 수를 추측하고 있을 뿐입니다. 필수 요점 점검도 받지 못하는데, 실제 시험이 어떤 요점을 제시할지 모르기 때문입니다. 당신의 에세이를 알맞은 길이로 다시 쓴 모범 답안도 받지 못합니다. 그리고 붙여넣는 에세이 하나하나가 당신의 메시지 한도를 소모합니다.

Prepamigo에서는 은행에서 과제를 열면 타이머가 돌아가고, 글을 쓰고, 제출한 지 약 1분 후에 네 가지 영역별 점수, 종합 점수, 놓친 것들의 목록, 당신의 글에서 인용한 교정, 그리고 다시 쓴 모범 답안을 받습니다. 이달의 마흔 번째 에세이도 첫 번째 에세이와 똑같은 수고만 듭니다.

같은 에세이, 같은 점수

주요 실행 이후 36편의 에세이 전부를 다른 날에 두 번 더 채점했습니다. Prepamigo의 라이팅 채점기는 세 번의 실행에서 86%, 89%, 86%를 기록했고, 같은 열두 편의 중위 등급 에세이가 매번 범위 안에 들어왔습니다. GPT 5.6 sol은 78%, 83%, 81%를 기록했습니다: 두 번째와 세 번째 실행에서 더 나았는데, 이는 챗봇의 단일 답변에는 어느 방향으로든 몇 포인트의 운이 섞여 있다는 사실을 일깨워 줍니다. ChatGPT로 채점하기로 했다면, 두 번 묻고 더 낮은 답을 취하세요.

피드백: 설명 대 증거

ChatGPT는 설명을 잘합니다. 어떤 에세이가 왜 6점인지 물으면 명확한 영어로 제안까지 곁들여 알려줍니다. 함정은 그 설명이 이미 정해진 숫자를 정당화하기 위해 쓰인다는 것이어서, 숫자가 한 단계 낮으면 설명도 그에 맞춰 결점을 찾아냅니다. 실제로는 7점이었던 응시자는 결정적이지 않았던 약점에 대한 글 한 페이지를 읽게 됩니다.

Prepamigo의 피드백은 텍스트에서부터 위로 올라갑니다. 모든 교정은 당신의 에세이에서 정확한 표현을 인용하며, 검사기가 당신의 글에서 찾지 못한 내용은 당신에게 보이기 전에 제거됩니다. 놓친 필수 요점은 이름 그대로 지목됩니다. 각 영역에는 하나의 제한 요인이 제시되거나, 아무것도 발목을 잡고 있지 않다는 분명한 언급이 붙습니다. 그리고 과제가 요구하는 길이로 당신의 응답을 다시 쓴 모범 답안을 받습니다. 아래 섹션에서는 무엇이 달라졌는지 정리합니다.

라이팅 피드백에서 새로워진 점

점수는 당신이 돌려받는 것의 절반에 불과합니다. 라이팅 피드백 레이어는 채점기와 함께 새로 만들어졌으며, 그 안의 모든 내용은 당신이 직접 쓴 글에 근거합니다. 무엇이 달라졌는지 살펴보겠습니다.

  • 자신의 에세이에서 바로 찾을 수 있는 교정. 모든 문법, 철자, 어휘 교정은 당신의 응답에서 정확한 표현을 그대로 인용하므로, 앱이 당신이 쓴 그 자리에 바로 표시해 줄 수 있습니다. 검사기가 에세이에서 단어 그대로 찾아내지 못한 내용은 당신에게 보이기 전에 제거됩니다.
  • 당신의 답안으로 만든 모범 답안. 당신의 아이디어를 그대로 유지하면서 요구된 모든 요점을 다루고, 과제가 요구하는 150~200단어 분량에 맞춘 재작성 버전을 받게 됩니다. 첫 번째 재작성이 이 분량을 벗어나면, 보여드리기 전에 한 번 더 다시 작성됩니다.
  • 놓친 필수 요점을 이름 그대로. 이메일 과제에서는 피드백이 프롬프트의 요점 중 당신의 응답이 다루지 않은 것을 나열합니다. 요점을 하나라도 놓치면 과제 수행(task fulfillment) 점수는 8점 이하로 제한되므로, 숫자와 피드백이 서로 어긋나는 일이 없습니다.
  • 영역마다 하나의 제한 요인. 네 가지 영역 각각에 대해 피드백은 그 점수를 끌어내리는 단 하나의 요인을 구체적으로 짚거나, 아무 문제도 없다면 그렇다고 분명히 말하고 무엇이 그 점수를 떠받치고 있는지 알려줍니다. 어떤 영역에 문제가 없다고 판단하는 것도 빈칸이 아니라 하나의 진짜 답입니다.
  • 비판은 알맞은 자리에. 어조가 약한 것은 과제 수행 문제이고, 모호한 단어 선택은 어휘 문제이며, 끝없이 이어지는 문장은 가독성 문제입니다. 각 지적은 전체 요약에 뭉뚱그려지는 대신 그것을 담당하는 영역 아래에 정리됩니다.
  • 문장 단위 재작성. 에세이의 특정 문장들이 개선된 버전과 함께, 왜 더 나은지 한 줄 설명을 달고 돌아옵니다. 그래서 변화에 대해 읽는 것이 아니라 변화를 직접 볼 수 있습니다.
  • 가장 강한 영역과 가장 약한 영역을 나란히. 피드백은 네 가지 영역 중 어느 것이 당신의 점수를 떠받치고 어느 것이 발목을 잡고 있는지 알려주므로, 네 개의 숫자를 해독하지 않고도 다음에 무엇을 연습해야 할지 알 수 있습니다.

피드백의 모든 인용문은 표시되기 전에 당신의 에세이와 대조하여 확인됩니다. 검사기가 그 표현을 찾지 못하면 해당 줄은 제거됩니다. 그래서 피드백은 당신이 쓰지 않은 것을 고치라고 절대 말하지 않습니다.

매일 연습하는 데 드는 비용

ChatGPT Plus는 2026년 9월 게시된 기준으로 월 US$20, 약 CA$28이며 매월 결제되고, 순환 주기당 메시지 한도가 있습니다. ChatGPT Pro는 월 US$200, 세전 약 CA$276이며 그 한도를 높여줍니다. 무료 등급은 트래픽의 상당 부분을 더 작은 모델로 보내는데, 이 테스트에서 그중 가장 작은 모델은 강한 에세이 열두 편 중 세 편만 인식했습니다. 어떤 요금제도 과제 은행, 타이머, 필수 요점 점검, 모범 답안, 또는 실제 채점 에세이에 맞춰 보정된 점수를 포함하지 않습니다.

Prepamigo는 월 CA$24.98, 또는 연간 요금제로 월 CA$8.25(연 CA$98.98)이며 세금이 포함되어 있고 언제든지 해지할 수 있습니다. 모든 요금제에는 일일, 세션, 주간 한도가 전혀 없는 무제한 채점, 무제한 시도, 그리고 전체 문제 은행이 포함됩니다: Writing, Speaking, Reading, Listening 전 영역에 걸쳐 80개의 완성된 연습 세트와 2,000개 이상의 연습 과제로, CELPIP General 시험의 과제 유형, 시간 배분, 형식을 따르도록 작성되었습니다.

ChatGPT가 더 나은 도구일 때

  • 에세이 한 편에 대한 빠른 다른 의견. GPT 5.6 sol은 괜찮은 채점자이고 10초면 됩니다. 과제가 이미 있고 다른 시각만 원한다면 충분합니다.
  • 한 문장을 다섯 가지로 다시 쓰기. 어색한 문장의 대안을 요청하는 것은 빠르고, 제안도 좋습니다.
  • 이야기 나누기. 어떤 이유가 왜 약한지 따져보고 싶다면 대화가 알맞은 형태입니다. Prepamigo는 판정과 증거를 주지만 대화하지는 않습니다.
  • 시험 밖의 모든 것. ChatGPT는 범용 어시스턴트이고 Prepamigo는 그렇지 않습니다.

ChatGPT가 되어서는 안 되는 역할은 7점이나 8점 수준의 필자에게 지금 어디에 있는지 알려주는 유일한 존재, 또는 강한 필자에게 9점이라고 말하는 존재입니다. 바로 그 두 지점에서 가장 자주 틀리기 때문입니다.

자주 묻는 질문

ChatGPT로 CELPIP 라이팅을 채점할 수 있나요? 네, 그리고 대부분의 챗봇보다 낫습니다: 36편의 공식 응답에서 GPT 5.6 sol은 78%, luna는 69%, GPT-4o mini는 58%의 확률로 맞혔으며, Prepamigo는 86%였습니다.

라이팅에서 Prepamigo가 ChatGPT보다 더 정확한가요? 가장 좋은 GPT 모델보다 8포인트 앞섭니다. 중위 등급 에세이는 100% 대 75%, 강한 에세이는 83% 대 75%, 약한 에세이는 75% 대 83%입니다.

어떤 GPT 모델을 써야 하나요? GPT 5.6 sol입니다. 강한 에세이 열두 편 중 아홉 편에 9점을 준 GPT-4o mini는 아닙니다.

각각 비용은 얼마인가요? ChatGPT Pro는 월 US$200, 세전 약 CA$276입니다. Plus는 US$20이지만 메시지 한도가 있습니다. Prepamigo는 세금 포함 월 CA$24.98, 또는 연간 요금제로 월 CA$8.25이며 무제한 채점과 80개의 연습 세트를 제공합니다.

Claude와의 같은 비교를 보려면 라이팅에서 Prepamigo와 Claude 비교를 읽어보세요. 라이팅 채점기가 어떻게 작동하는지 보려면 Prepamigo 라이팅 채점기 내부 들여다보기를 읽어보세요. 아니면 바로 응답 작성하기를 해보고 점수를 확인해 보세요. 영어로 이 가이드 읽기

CELPIP 라이팅, Prepamigo와 ChatGPT 비교: 정확도, 한도, 그리고 비용 | PrepAmigo