Prepamigo Writing Scoring Engine so với các mô hình hàng đầu làm giám khảo
Tỷ lệ bài viết CELPIP mà điểm số khớp với điểm đã xác minh độc lập. 36 bài viết chính thức, chia đều giữa mức yếu, mức giữa và mức mạnh và cả hai dạng bài Writing. Mỗi mô hình được cung cấp đề bài và bài viết, rồi được yêu cầu, bằng lời đơn giản, chấm điểm theo thang CELPIP.
86%
Prepamigo Writing Scoring EnginePrepamigo
78%
GPT 5.6 solOpenAI
69%
GPT 5.6 lunaOpenAI
61%
GeminiGoogle
61%
Claude Opus 5Anthropic
58%
GPT-4o miniOpenAI
56%
Claude Sonnet 5Anthropic
Prepamigo so với các gói chatbot phổ biến nhất
Đơn vị: đô la Canada. Giá của Prepamigo đã bao gồm thuế. Claude Max (từ US$100) và ChatGPT Pro (US$200) được quy đổi theo tỷ giá 1.38, chưa gồm thuế. Độ chính xác là tỷ lệ trong 36 bài viết chính thức được chấm đúng mức điểm đã xác minh khi mô hình được nêu tên được yêu cầu, bằng lời đơn giản, chấm điểm bài viết đó; một lần chạy.
Bộ chấm điểm Writing của Prepamigo khớp với điểm đã xác minh trên 86% các bài viết CELPIP chính thức, vượt mọi mô hình hàng đầu được giao cùng công việc, và ở mức giữa, nơi phần lớn thí sinh đang ở, nó chấm đúng mọi bài viết.
Trang này giới thiệu Prepamigo Writing Scoring Engine, hệ thống chấm điểm mọi bài email và bài trả lời khảo sát được viết trên Prepamigo. Đây không phải một mô hình đa dụng được yêu cầu đi chấm bài. Đây là một bộ chấm điểm được xây dựng cho một việc duy nhất: đặt một bài viết CELPIP vào đúng mức mà một giám khảo được đào tạo sẽ đặt, và giải thích việc xếp mức đó bằng chính lời của người viết.
Kết quả là một bộ chấm điểm chính xác hơn bất kỳ mô hình hàng đầu nào khi được dùng theo cách một học viên sẽ dùng. Trên 36 bài viết CELPIP chính thức có điểm đã được xác minh độc lập, engine rơi đúng mức điểm 86% số lần. Khi được yêu cầu bằng lời đơn giản chấm cùng các bài viết đó, GPT 5.6 sol đạt 78%. GPT 5.6 luna đạt 69%, Gemini và Claude Opus 5 61%, GPT-4o mini 58%, và Claude Sonnet 5 56%.
Độ chính xác quan trọng nhất ở nơi thí sinh thực sự đang ở. Điểm 7 hoặc 8 là điểm Writing thực tế phổ biến nhất, và đó là điểm số quyết định một mục tiêu đã đạt được hay chưa. Engine đặt cả mười hai bài viết mức giữa vào đúng khoảng đó. Mô hình hàng đầu tốt nhất đặt đúng chín bài; Claude Opus 5 đặt đúng ba bài. Trang này giải thích engine chấm điểm như thế nào, nó so sánh ra sao, điều gì mới trong phần nhận xét đi kèm mỗi điểm số, và chi phí để luyện tập mà không cần đếm.
Độ chính xác so với điểm đã xác minh
Câu hỏi chúng tôi quan tâm rất đơn giản. Khi một học viên nộp một bài viết, điểm số hiện trên màn hình có khớp với điểm mà một giám khảo được đào tạo sẽ cho không? Để trả lời, chúng tôi dùng một bộ bài viết CELPIP chính thức, mỗi bài có một điểm số đã được xác minh độc lập, bao gồm cả hai dạng bài Writing và chia đều giữa mức yếu, mức giữa và mức mạnh: mười hai bài mỗi mức, tổng cộng 36 bài. Sáu bài mẫu mà engine dùng để chuẩn hóa không nằm trong số này.
Mọi hệ thống đều thấy cùng một đề bài, bao gồm các ý bắt buộc của bài email và các lựa chọn của bài khảo sát, và cùng một bài viết. Mỗi mô hình hàng đầu được cho biết nó là một giám khảo CELPIP Writing giàu kinh nghiệm và được yêu cầu cho một điểm số từ 0 đến 12. Engine chạy đúng như trong môi trường thực tế. Một điểm số là đúng khi nó rơi vào trong mức đã xác minh: 4 hoặc 5 với bài viết yếu, 7 hoặc 8 với bài mức giữa, 10 đến 12 với bài mạnh.
37%
ít lỗi hơn so với GPT 5.6 sol
5 điểm chấm sai trên 36, so với 8.
64%
ít lỗi hơn so với Claude Opus 5
5 điểm chấm sai trên 36, so với 14.
100%
bài viết mức giữa được chấm đúng
Mô hình tốt nhất trong số còn lại: 75%. Claude Opus 5: 25%.
Có ba điều đáng chú ý. Thứ nhất, khoảng cách so với mô hình hàng đầu tốt nhất là tám điểm, tương ứng với ba điểm số chấm đúng thêm trên 36 bài, và khoảng cách đó giữ nguyên ở mọi lần chạy lại. Thứ hai, khoảng cách so với các mô hình Claude là 25 đến 30 điểm, và nó tập trung ở giữa thang điểm, nơi một mô hình đa dụng đọc một bài viết sạch sẽ, chung chung thành một bài viết mạnh. Thứ ba, phép so sánh này chính là phép so sánh quan trọng với một học viên: nó đo lường điều bạn nhận được khi dán một bài viết vào chatbot và hỏi điểm, đúng như cách gần như tất cả mọi người đang dùng các mô hình này.
| Hệ thống | Tất cả bài viết | Yếu | Giữa | Mạnh |
|---|---|---|---|---|
| Prepamigo Writing Scoring Engine | 86% | 75% | 100% | 83% |
| GPT 5.6 sol | 78% | 83% | 75% | 75% |
| GPT 5.6 luna | 69% | 83% | 58% | 67% |
| Gemini | 61% | 58% | 42% | 83% |
| Claude Opus 5 | 61% | 67% | 25% | 92% |
| GPT-4o mini | 58% | 83% | 67% | 25% |
| Claude Sonnet 5 | 56% | 50% | 33% | 83% |
Tỷ lệ bài viết được chấm trong mức đã xác minh, một lần chạy. Mười hai bài mỗi mức, nên một bài viết tương đương khoảng tám điểm ở góc nhìn theo mức và ba điểm ở tổng thể.
Kết quả ở từng mức điểm
Một con số trung bình che giấu nơi các lỗi rơi vào. Với Writing, lỗi của một mô hình đa dụng rơi vào hai chỗ: mức giữa, nơi một bài viết sạch sẽ nhưng chung chung bị đọc thành bài mạnh, và mức cao nhất, nơi một bài viết mạnh có một sai sót bị giữ lại ở điểm 9.
Bài viết yếu · điểm đã xác minh 4 hoặc 5
12 bài viết chính thức cho mỗi hệ thống.
83%
GPT 5.6 sol
83%
GPT 5.6 luna
83%
GPT-4o mini
75%
Prepamigo Writing Engine
67%
Claude Opus 5
58%
Gemini
50%
Claude Sonnet 5
Bài viết mức giữa · điểm đã xác minh 7 hoặc 8
12 bài viết chính thức cho mỗi hệ thống. Mức mà phần lớn thí sinh đang ở.
100%
Prepamigo Writing Engine
75%
GPT 5.6 sol
67%
GPT-4o mini
58%
GPT 5.6 luna
42%
Gemini
33%
Claude Sonnet 5
25%
Claude Opus 5
Bài viết mạnh · điểm đã xác minh 10 trở lên
12 bài viết chính thức cho mỗi hệ thống. Gần như mọi lần chấm sai đều là điểm 9.
92%
Claude Opus 5
83%
Prepamigo Writing Engine
83%
Gemini
83%
Claude Sonnet 5
75%
GPT 5.6 sol
67%
GPT 5.6 luna
25%
GPT-4o mini
Với bài viết yếu, các mô hình GPT ở mức 83% và engine ở mức 75%. Ba lần chấm sai của engine đều lệch cao hơn một bậc, thành 6 hoặc 7, trên những bài ngắn nhưng gọn gàng; các lần chấm sai của mô hình Claude đi theo chiều ngược lại, cho những bài viết sơ sài điểm 3. Bài viết yếu là đầu dễ của thang điểm với bất kỳ ai, và đây là mức duy nhất mà một chatbot có thể ngang bằng hoặc vượt engine.
Ở mức giữa, engine đứng một mình với 100%. GPT 5.6 sol kéo ba trong mười hai bài xuống điểm 6. Claude Opus 5 đẩy bảy trong mười hai bài lên điểm 9 hoặc 10. Gemini đẩy năm bài lên. Một bài viết mức giữa đề cập đủ đề bài, có tổ chức và cũng chung chung; một mô hình không có gì để đối chiếu đọc nó theo cảm nhận, và cảm nhận thì khác nhau tùy mô hình. Engine đọc nó bằng cách đối chiếu với một bài điểm 7 thực tế đã được chấm.
Ở mức cao nhất, Claude Opus 5 là giám khảo tốt nhất trong bài kiểm tra, nhận đúng mười một trong mười hai bài viết mạnh so với mười bài của engine. Claude rộng rãi, điều đó đúng với bài viết mạnh và sai với mọi thứ khác. GPT-4o mini cho điểm 9 cho chín trong mười hai bài: nó không bao giờ cho điểm 10.
Tính ổn định và bền vững
Một bộ chấm điểm đáng tin cậy phải cho cùng một câu trả lời hai lần. Sau lần chạy chính, chúng tôi chấm lại cả 36 bài viết thêm hai lần vào những ngày khác nhau. Engine đạt 86%, 89% và 86%, với cùng mười hai bài viết mức giữa nằm trong khoảng ở mọi lần và không bài nào dịch chuyển quá một điểm giữa các lần chạy. GPT 5.6 sol đạt 78%, 83% và 81% trong cùng ba ngày đó.
Engine chạy mô hình chấm điểm với chế độ suy luận tắt và ở một mức temperature cố định, đó là điều khiến con số có thể lặp lại. Một câu trả lời đơn lẻ của chatbot mang theo vài điểm may rủi theo chiều này hay chiều kia; một điểm số ổn định qua nhiều ngày là một điểm số bạn có thể lên kế hoạch dựa vào.
Hai dạng bài, hai kiểu sai sót
CELPIP Writing có hai dạng bài, và chúng thất bại theo những cách khác nhau. Bài email cho bạn một tình huống và ba hoặc bốn ý bạn phải đề cập. Bài khảo sát cho bạn hai lựa chọn và yêu cầu bạn chọn một rồi bảo vệ nó. Một bộ chấm điểm coi hai dạng bài như nhau sẽ sai ở cả hai.
Với bài email, engine đúng trên 89% bài viết. Những sai sót khiến thí sinh mất điểm nhiều nhất ở đây không phải ngữ pháp; đó là một ý bị thiếu, một giọng điệu không phù hợp với người đọc, hoặc lời mở đầu và kết thúc không có mặt. Lớp quy tắc kiểm tra từng điều đó trước khi giám khảo đưa ra nhận định, và một ý bị thiếu giữ điểm hoàn thành nhiệm vụ ở mức 8 trở xuống dù tiếng Anh có trau chuốt đến đâu. Một chatbot được hỏi điểm bằng lời đơn giản không biết ý nào là bắt buộc trừ khi bạn dán chúng vào, và ngay cả khi đó nó hiếm khi kiểm tra từng ý một.
Với bài khảo sát, engine đúng trên 83% bài viết. Bài khảo sát thưởng cho một lập trường rõ ràng và hai lý do được phát triển, và phạt một bài trả lời nước đôi. Engine đọc lập trường trước tiên: một bài trả lời không bao giờ chọn dứt khoát không thể vượt quá mức giữa ở tiêu chí hoàn thành nhiệm vụ. Các chatbot có xu hướng thưởng cho một câu trả lời cân bằng, điều mà trong bài khảo sát là một sai lầm.
Ý nghĩa của một bộ chấm điểm hiểu từng dạng bài là điểm số phản ánh điều một giám khảo sẽ phản ứng lại ở dạng bài đó, chứ không phải một cảm nhận chung về tiếng Anh. Một bài email mức giữa thường là mức giữa vì ý thứ ba sơ sài; một bài khảo sát mức giữa thường là mức giữa vì một lý do được nêu ra mà không được phát triển. Engine cho bạn biết là điều nào, gọi đúng tên.
Nơi engine không phải là tốt nhất
Engine dẫn đầu ở tổng thể và ở mức giữa. Nó không dẫn đầu ở cả hai đầu thang điểm, và nói thẳng điều đó công bằng hơn là giấu nó sau một con số trung bình.
Với bài viết yếu, ba mô hình GPT mỗi mô hình đạt 83% so với 75% của engine. Các lần chấm sai của engine đều lệch cao hơn một bậc, trên những bài ngắn, gọn gàng nhưng không phát triển điều gì. Một mô hình GPT, vốn đọc bài viết chung chung thành bài yếu, chấm đúng những bài này. Nếu bạn đang ở mức yếu và chỉ muốn xác nhận điều đó, GPT 5.6 sol sẽ cho bạn điều đó thường xuyên hơn một chút. Nó cũng sẽ, ba lần trong mười hai, nói với một người viết mức giữa rằng họ là điểm 6.
Với bài viết mạnh, Claude Opus 5 đạt 92% so với 83% của engine. Claude đọc bài viết trau chuốt một cách rộng rãi, điều đó đúng với một bài viết mạnh. Cũng chính sự rộng rãi đó đã cho bảy trong mười hai bài viết mức giữa điểm 9 hoặc 10. Nếu bạn đã viết ở mức mạnh, Claude Opus 5 sẽ xác nhận điều đó thường xuyên hơn engine một chút. Nếu bạn chưa, đó là mô hình có nhiều khả năng nhất nói với bạn rằng bạn đã đạt.
Engine là bộ chấm điểm duy nhất trong bài kiểm tra nằm trong phạm vi mười điểm so với mô hình dẫn đầu ở mọi mức, và là bộ duy nhất đạt 100% ở mức giữa. Đó là hồ sơ mà một thí sinh cần: một bộ chấm điểm không xuất sắc ở một mức và sai ở mức khác, mà đúng gần như ở mọi nơi và đúng ở nơi phần lớn thí sinh đang ở.
Engine chấm một bài viết như thế nào
Đây là những gì xảy ra trong khoảng một phút, giữa lúc bấm nộp bài và lúc đọc điểm số.
- Lớp quy tắc đọc bài viết trước tiên. Trước khi bất kỳ mô hình nào nhìn thấy nó, engine đếm số từ, kiểm tra bài email có lời chào mở đầu và kết thúc, kiểm tra bài khảo sát có lựa chọn rõ ràng, và đối chiếu bài viết với các ý bắt buộc trong đề bài. Những kiểm tra này trở thành giới hạn cứng mà giám khảo không thể vượt qua: một bài khảo sát không bao giờ chọn phe, hoặc một bài email đọc như một bài trả lời khảo sát, không thể vượt quá mức giữa của thang điểm ở tiêu chí hoàn thành nhiệm vụ.
- Bài viết được so sánh với các bài mẫu thực tế đã chấm. Giám khảo thấy ba bài viết CELPIP thực tế cho cùng dạng bài, một ở mức yếu, một ở mức giữa, một ở mức cao nhất, tất cả với những sai sót thật của chúng, và đặt bài viết tương quan với chúng trên mỗi tiêu chí trong bốn tiêu chí: nội dung và mạch lạc, từ vựng, tính dễ đọc, hoàn thành nhiệm vụ. Tương đương bài mẫu mức giữa là 7 hoặc 8; tương đương bài mẫu mức cao nhất là 10 hoặc 11; rõ ràng mạnh hơn bài mẫu mức cao nhất là 12.
- Mọi nhận định đều cần bằng chứng. Với mỗi tiêu chí, giám khảo phải trích dẫn những cụm từ trong bài viết làm căn cứ cho điểm số trước khi cho điểm. Những trích dẫn không tìm thấy trong bài viết sẽ bị loại bỏ.
- Ý bị bỏ sót giới hạn điểm số. Nếu giám khảo báo cáo một ý bắt buộc bị thiếu, điểm hoàn thành nhiệm vụ được giữ ở mức 8 trở xuống, để con số và phần nhận xét khớp nhau.
- Bốn tiêu chí trở thành một điểm số. Điểm tổng là trung bình của bốn tiêu chí, sau khi các giới hạn của lớp quy tắc đã được áp dụng.
- Nhận xét được xây dựng từ cùng bằng chứng đó. Các lỗi được sửa, một bài mẫu ở độ dài phù hợp, các ý bị bỏ sót được gọi tên và một yếu tố kìm hãm cho mỗi tiêu chí, tất cả đều trích dẫn từ chính bài viết của người viết. Phần dưới đây liệt kê những gì đã thay đổi.
Chúng tôi cũng đã thử chuyển engine sang thiết kế hai giám khảo, bỏ phiếu rồi dung hòa mà bộ chấm điểm Speaking của chúng tôi dùng. Nó không giúp ích cho Writing: các mức điểm Writing chính thức nằm gần nhau hơn trên thang 0 đến 12 so với các mức Speaking, và việc buộc giám khảo phải chọn giữa các bài mẫu mà không có lựa chọn ở giữa đã đẩy bài viết mức giữa lên điểm 9. Engine Writing giữ lại thiết kế chấm đúng mức giữa.
Điều gì mới trong phần đánh giá bài viết của bạn
Điểm số chỉ là một nửa những gì bạn nhận lại. Lớp đánh giá bài viết đã được xây dựng lại cùng với hệ thống chấm điểm, và mọi thứ trong đó đều bám sát vào chính văn bản của bạn. Đây là những điều đã thay đổi.
- Những chỗ sửa bạn có thể tìm thấy ngay trong bài viết của mình. Mỗi chỗ sửa về ngữ pháp, chính tả và từ vựng đều trích dẫn đúng những từ trong bài của bạn, để ứng dụng có thể tô sáng chúng ngay tại chỗ bạn đã viết. Bất cứ điều gì bộ kiểm tra không tìm thấy nguyên văn trong bài viết của bạn sẽ bị loại bỏ trước khi bạn nhìn thấy.
- Một bài mẫu, được xây dựng từ chính bài của bạn. Bạn nhận được một phiên bản viết lại từ chính câu trả lời của mình, giữ nguyên các ý của bạn, đề cập đầy đủ mọi điểm bắt buộc và đạt đúng độ dài 150 đến 200 từ mà đề bài yêu cầu. Nếu bản viết lại đầu tiên chưa đạt độ dài đó, nó sẽ được làm lại một lần trước khi hiển thị.
- Điểm bắt buộc bạn đã bỏ sót, được nêu đích danh. Với bài viết email, phần đánh giá liệt kê những gạch đầu dòng trong đề bài mà câu trả lời của bạn chưa đề cập. Một điểm bị bỏ sót cũng giữ điểm hoàn thành nhiệm vụ ở mức 8 trở xuống, nên con số và phần đánh giá không bao giờ mâu thuẫn với nhau.
- Một yếu tố kìm hãm cho mỗi tiêu chí. Với mỗi tiêu chí trong bốn tiêu chí, phần đánh giá nêu đúng một điều đang kéo điểm đó xuống, bằng lời cụ thể, hoặc nói thẳng rằng không có gì kìm hãm và điều gì đang nâng đỡ điểm đó. Kết luận rằng một tiêu chí không có vấn đề là một câu trả lời thực sự, không phải một khoảng trống.
- Lời chê đặt đúng chỗ. Giọng văn yếu là vấn đề của hoàn thành nhiệm vụ, lựa chọn từ mơ hồ là vấn đề của từ vựng, câu quá dài lê thê là vấn đề của tính dễ đọc. Mỗi nhận xét được xếp vào đúng tiêu chí sở hữu nó thay vì bị gộp chung vào phần tóm tắt tổng thể.
- Viết lại ở cấp độ từng câu. Những câu cụ thể trong bài viết của bạn được trả lại kèm một phiên bản tốt hơn và một dòng giải thích vì sao nó tốt hơn, để bạn nhìn thấy sự thay đổi thay vì chỉ đọc về nó.
- Tiêu chí mạnh nhất và yếu nhất của bạn, đặt cạnh nhau. Phần đánh giá cho bạn biết tiêu chí nào trong bốn tiêu chí đang nâng điểm của bạn và tiêu chí nào đang kéo nó xuống, để bạn biết nên luyện gì tiếp theo mà không phải tự giải mã bốn con số.
Mọi trích dẫn trong phần đánh giá đều được đối chiếu với bài viết của bạn trước khi hiển thị. Nếu bộ kiểm tra không tìm thấy những từ đó, dòng nhận xét sẽ bị loại bỏ. Đó là lý do phần đánh giá không bao giờ bảo bạn sửa một điều bạn không hề viết.
Làm gì với điểm số
Một điểm số bạn có thể tin thay đổi cách bạn luyện tập. Với một chatbot, bạn không bao giờ chắc một bước từ 8 lên 9 là do bạn hay do mô hình, nên mọi điểm số đều phải đối chiếu với cảm giác. Với một bộ chấm điểm ổn định, chính xác, điểm số chính là phần nhận xét.
- Viết cùng một đề hai lần. Nộp bài, đọc các ý bị bỏ sót và yếu tố kìm hãm cho mỗi tiêu chí, viết lại với bài mẫu bên cạnh, rồi nộp lại. Một thay đổi từ một điểm trở lên giữa hai lần là một thay đổi trong bài viết của bạn, vì engine cho cùng một bài viết cùng một điểm số.
- Theo dõi tiêu chí yếu nhất, không phải tổng điểm. Điểm tổng là trung bình của bốn tiêu chí. Hai thí sinh cùng điểm 8 có thể có những vấn đề hoàn toàn khác nhau. Phần nhận xét gọi tên tiêu chí đang kìm hãm bạn, và đó là tiêu chí cần luyện.
- Coi điểm 9 là suýt đạt. Cả hai lần chấm sai của engine trên bài viết mạnh đều là điểm 9. Điểm 9 từ engine nghĩa là còn thiếu một lý do được phát triển hoặc một lựa chọn từ chính xác là tới điểm 10.
- Luân phiên hai dạng bài. Phần lớn thí sinh luyện dạng bài mình thích. Engine chấm bài email và bài khảo sát theo các bài mẫu khác nhau và quy tắc khác nhau, nên một điểm email mạnh không nói lên điều gì về bài khảo sát của bạn.
Luyện tập không giới hạn với CA$25 mỗi tháng
Độ chính xác chỉ có ích nếu bạn có thể dùng nó mỗi ngày. Một điểm Writing đáng tin cậy có giá trị nhất ở bài viết thứ ba mươi của bạn, không phải bài thứ ba, vì đó là lúc điểm số bắt đầu cho bạn biết liệu một thay đổi trong cách bạn viết có thực sự hiệu quả hay không. Vì vậy engine được định giá để được dùng mà không cần đếm.
Mọi gói Prepamigo đều bao gồm chấm điểm không giới hạn, số lần làm bài không giới hạn, và toàn bộ ngân hàng câu hỏi: 80 bộ đề luyện tập hoàn chỉnh và hơn 2,000 bài luyện tập trải rộng bốn kỹ năng Writing, Speaking, Reading và Listening, được viết theo đúng dạng bài, thời gian và định dạng của bài thi CELPIP General. Bạn viết, bạn nộp, và khoảng một phút sau bạn có điểm số, các lỗi được sửa và một bài mẫu.
Prepamigo
CA$25/ tháng
CA$24.98 mỗi tháng · CA$8.25 mỗi tháng theo gói năm (CA$98.98 mỗi năm) · đã gồm thuế · hủy bất cứ lúc nào
- Chấm điểm không giới hạn cho Writing và Speaking, không giới hạn theo ngày, theo buổi hay theo tuần.
- 80 bộ đề luyện tập và hơn 2,000 bài tập trải rộng cả bốn kỹ năng, theo đúng định dạng bài thi thật, nên bạn không bao giờ phải tự viết đề.
- Viết rồi nộp. Việc chấm điểm, sửa lỗi, kiểm tra ý bị bỏ sót và bài mẫu đều được xử lý cho bạn.
- Nhận xét bằng đúng lời của bạn, mọi trích dẫn đều được đối chiếu với những gì bạn thực sự đã viết.
Claude Max, để so sánh
US$100/ tháng
khoảng CA$138 chưa gồm thuế · gói 20x là US$200 mỗi tháng · Pro US$20 với giới hạn chặt hơn nhiều
- Ngay cả gói Max cũng có giới hạn. Một hạn mức sử dụng luân phiên 5 giờ và giới hạn theo tuần; khi bạn chạm một trong hai giới hạn, bạn phải chờ.
- Không có ngân hàng câu hỏi. Bạn phải tự chuẩn bị đề bài, tự quyết định xem chúng có giống bài thi thật không, và tự theo dõi những gì mình đã luyện.
- Không kiểm tra ý bắt buộc, không có bài mẫu. Bạn nhận được một con số và một đoạn văn.
- Một yêu cầu đơn giản, không phải một bộ chấm điểm đã chuẩn hóa. Khi được hỏi đơn giản, Claude Opus 5 khớp điểm đã xác minh 61% số lần và Claude Sonnet 5 56%, so với 86% của engine.
Giá và điều khoản sử dụng của các gói Claude theo công bố trên claude.com vào tháng 9 năm 2026 và có thể thay đổi. CELPIP là nhãn hiệu thuộc quyền sở hữu của chủ sở hữu; Prepamigo là một nền tảng luyện tập độc lập, không liên kết, không được chứng thực và không có quan hệ với đơn vị tổ chức kỳ thi. Các bài luyện tập của Prepamigo là tài liệu gốc được viết theo đúng định dạng công khai của bài thi.
Tình trạng phát hành
Prepamigo Writing Scoring Engine đã hoạt động ngay bây giờ cho mọi người dùng Prepamigo trên cả hai dạng bài Writing. Không có gì cần bật lên. Mọi bài email và bài trả lời khảo sát đều được nó chấm điểm, và mỗi điểm số đi kèm nhận xét được lấy từ chính bài viết của người viết.
Để xem các phép so sánh trực tiếp, đọc Prepamigo so với Claude cho Writing và Prepamigo so với ChatGPT cho Writing. Về phía Speaking, đọc Scoring Engine 2.0 cho Speaking. Hoặc Viết một bài trả lời và xem engine hoạt động. Đọc bài này bằng tiếng Anh
