Trả lời ngắn: có 3 cách được chấm Speaking IELTS online: AI chấm tự động (kết quả sau vài phút, rẻ nhất, review người dùng ghi nhận chênh thi thật khoảng ±0,5 band), giáo viên chấm qua ghi âm (sâu hơn về ý, chờ 1–3 ngày) và mock test 1-1 (sát phòng thi nhất, đắt nhất). Không cách nào thay được cả hai cách còn lại: AI đo phát âm, độ trôi chảy, từ vựng, ngữ pháp rất ổn định nhưng chưa đánh giá tốt việc trả lời đúng trọng tâm và tính tự nhiên khi bị hỏi xoáy Part 3. Bài này chỉ cách ghép cả ba theo giai đoạn ôn.
Reading và Listening có đáp án — làm xong biết ngay đúng sai. Writing chậm hơn nhưng bài viết nằm đó cho bạn soi lại. Speaking thì khác: lời nói ra là biến mất, và người nói gần như không tự nghe được lỗi của mình trong lúc nói — não đang bận tìm ý. Kết quả là rất nhiều bạn luyện nói hằng ngày mà band đứng yên, vì lặp lại đúng những lỗi cũ với sự tự tin ngày càng cao.
Muốn tiến bộ, vòng lặp phải có một khâu bắt buộc: người-hoặc-máy nghe bạn nói và trả về nhận xét đối chiếu được với thang điểm. Chấm Speaking online hiện có 3 cách làm khâu này, mỗi cách mạnh yếu khác nhau — bài này so sánh sòng phẳng để bạn ghép chúng đúng chỗ, thay vì hỏi "cách nào tốt nhất".
| AI chấm tự động | Giáo viên chấm qua ghi âm | Mock test 1-1 trực tuyến | |
|---|---|---|---|
| Cách hoạt động | Ghi âm câu trả lời, máy phân tích và trả điểm 4 tiêu chí trong vài phút | Gửi file ghi âm, giáo viên nghe và trả nhận xét sau 1–3 ngày | Thi thử qua video call đúng kịch bản 3 part, 11–14 phút |
| Mạnh nhất ở | Tần suất: chấm được mỗi ngày, không ngại bị nghe | Nhận xét có ngữ cảnh, chỉ được lỗi tư duy triển khai ý | Áp lực thật: tương tác hai chiều, bị hỏi xoáy như phòng thi |
| Yếu ở | Chưa đánh giá tốt mức độ trả lời đúng trọng tâm câu hỏi và tính tự nhiên | Chậm; chất lượng phụ thuộc từng giáo viên | Đắt nhất, mỗi tuần thường chỉ làm được 1 lần |
| Chi phí | Rẻ nhất, nhiều nơi có lượt miễn phí | Trung bình | Cao nhất |
Cần nói rõ để công bằng với cả ba: đây không phải cuộc đua một người thắng. Các nền tảng AI như ELSA hay các công cụ chấm của trung tâm trong nước, dịch vụ giáo viên chấm ghi âm, và mock test với giáo viên — mỗi loại giải một bài toán khác nhau. Người học khôn dùng cả ba ở ba giai đoạn khác nhau (mục 5).
Nhóm việc AI làm tốt và ổn định hơn tai người: đo phát âm đến từng âm tiết và trọng âm; đếm tốc độ nói, tần suất ngập ngừng, quãng lặng; thống kê độ đa dạng từ vựng và lỗi ngữ pháp lặp lại qua transcript; và — lợi thế ít ai nhắc — so sánh chính bạn với bạn của tuần trước trên cùng thước đo, điều giáo viên chấm mỗi tuần một lần khó làm nhất quán. Về con số: các đánh giá người dùng phổ biến ghi nhận điểm AI chênh với điểm thi thật khoảng ±0,5 band, có trường hợp ±0,75 (số liệu tổng hợp từ review công khai, kiểm tháng 8/2026) — đủ tin để định vị vùng band và theo dõi tiến bộ, không đủ để coi là điểm thi chính thức.
Nhóm việc AI chưa bằng người: đánh giá ý trả lời có đúng trọng tâm câu hỏi không; cảm nhận mức tự nhiên của tương tác; nhận ra humour, sắc thái, ý ẩn dụ; và phân biệt câu trả lời học thuộc trôi chảy với câu nói thật. Đặc biệt ở Part 3 — nơi giám khảo hỏi xoáy theo chính câu bạn vừa nói — máy không tái tạo được sức ép ứng biến đó. Ai nói với bạn "AI chấm chính xác như giám khảo" là đang bán hàng; ai nói "AI vô dụng" thì đang bỏ phí công cụ luyện tần suất cao rẻ nhất hiện có.
Trong kho luyện tập của 8020 có cue card dạng xác suất cao: "Describe a method you use to calm yourself down when you are under a great deal of pressure" — yêu cầu kể phương pháp, tình huống hay dùng, một lần nó thất bại và vì sao nó hợp với riêng bạn. Câu hỏi nối Part 3 đi kèm: áp lực công việc thời nay có thật sự mới không, người sử dụng lao động chịu trách nhiệm đến đâu về sức khoẻ tinh thần nhân viên.
Đề này minh hoạ đúng ranh giới của mục 3. Phần AI chấm chắc tay: bạn nói đủ 2 phút không, tốc độ và ngập ngừng ra sao, có dùng được từ vựng chủ đề (cope with, wind down, take a step back) hay quanh quẩn "stress, relax"; lỗi thì quá khứ khi kể lại lần thất bại. Phần cần người nghe: bạn có thật sự kể một lần cụ thể nó thất bại — chi tiết đắt nhất, dễ bị lướt nhất của đề — hay lại vòng về bài mẫu "nghe nhạc rất thư giãn"; và ở Part 3, bạn ứng biến thế nào khi bị đẩy từ chuyện cá nhân sang trách nhiệm xã hội. Máy đo phần cơ; người soi phần ý.
8020 xây khu Speaking A→Z theo đúng triết lý ở mục 5: luyện đủ bộ từ âm IPA, kỹ năng từng part đến bộ đề theo chủ đề của cửa sổ hiện hành; nói vào là có AI chấm chuyên sâu trả nhận xét theo tiêu chí, và sau mỗi buổi thi thử hệ thống dựng lộ trình 3–6 tuần riêng — chỉ ra điểm nghẽn và việc cần làm mỗi tuần. Phần đo-được-bằng-máy được làm dày để bạn luyện hằng ngày không tốn tiền; phần cần tai người, 8020 nói thẳng là nên tìm người nghe trước kỳ thi thay vì hứa máy thay được giám khảo. Luyện chủ đề nào trước thì bám nhóm chủ đề Part 1 thường gặp và cách xử lý cue card Part 2 không học thuộc.
Mới bắt đầu, band chưa rõ: chấm AI một bài đủ 3 part trước — rẻ nhất để có bản đồ lỗi. Đang kẹt ở một band suốt nhiều tuần: đến lượt tai người; thứ giữ bạn lại thường là lỗi ý và tính tự nhiên, đúng vùng máy yếu. Còn dưới 3 tuần đến ngày thi: dồn tiền cho 1–2 mock test 1-1, luyện AI xen giữa để giữ nhịp mỗi ngày. Ngân sách bằng 0: vẫn đủ vòng lặp — ghi âm, chấm bằng lượt AI miễn phí, và tự nghe lại bản ghi sau 24 giờ; tai bạn của ngày hôm sau khách quan hơn tai bạn của lúc vừa nói xong nhiều.
Cuối cùng, một lời cho nhóm đông nhất mà ít lên tiếng nhất: những bạn ngại bị nghe. Nỗi ngại này là lý do thật khiến nhiều người trì hoãn việc được chấm cho tới sát ngày thi — và nó cũng là lợi thế ít được nhắc của chấm AI: máy không phán xét, không nhớ mặt bạn, và bạn được sai thoải mái ở nơi không ai chứng kiến. Dùng AI như phòng tập kín để vượt qua giai đoạn ngại, rồi hãy bước ra cho người thật nghe — thứ tự đó tự nhiên hơn nhiều so với ép mình đặt mock test ngay từ tuần đầu.
Reading và Listening chấm tự động; Writing được AI chấm theo 4 tiêu chí và chỉ ra từng lỗi.
Vào kho đề →Chính xác ở phần đo được bằng máy: phát âm từng âm, tốc độ nói, ngập ngừng, độ đa dạng từ vựng và lỗi ngữ pháp lặp lại. Các review người dùng phổ biến ghi nhận điểm AI chênh thi thật khoảng ±0,5 band, có trường hợp ±0,75. Mức đó đủ để định vị vùng band và theo dõi tiến bộ theo tuần, nhưng chưa đủ thay giám khảo ở phần ý trả lời đúng trọng tâm và tính tự nhiên.
Hai công cụ cho hai việc khác nhau. AI thắng ở tần suất và chi phí — chấm được mỗi ngày, trả kết quả sau vài phút, nên hợp cho vòng luyện nền sửa lỗi cơ học. Giáo viên thắng ở độ sâu — chỉ được lỗi triển khai ý, câu trả lời lạc trọng tâm, thói quen nghe gượng. Cách dùng hiệu quả là AI hằng ngày, tai người mỗi 2 tuần, và mock test 1-1 sát ngày thi.
Đáng nhất ở giai đoạn 2–3 tuần trước ngày thi, vì nó tái tạo thứ duy nhất AI và chấm ghi âm không có: sức ép tương tác hai chiều, đặc biệt khi bị hỏi xoáy ở Part 3 theo chính câu bạn vừa nói. Trước giai đoạn đó, tiền mock test tiêu hiệu quả hơn nếu chuyển thành nhiều lượt chấm AI và một hai lần giáo viên chấm ghi âm để sửa lỗi nền.
Nhiều nền tảng AI có lượt chấm miễn phí, trong đó có khu Speaking A→Z của 8020 — nói vào là nhận nhận xét theo tiêu chí, kèm lộ trình 3–6 tuần dựng sau mỗi buổi thi thử. Nếu ngân sách bằng 0, vẫn dựng được vòng lặp tự luyện: ghi âm câu trả lời, dùng lượt AI miễn phí, và tự nghe lại bản ghi sau 24 giờ — tai của ngày hôm sau khách quan hơn hẳn lúc vừa nói xong.
Bốn thứ chính: ý trả lời có đúng trọng tâm câu hỏi không; mức tự nhiên của tương tác hai chiều; sắc thái như humour hay ý ẩn dụ; và khả năng ứng biến khi bị hỏi xoáy ở Part 3. Máy cũng khó phân biệt câu trả lời học thuộc trôi chảy với lời nói thật. Đó là vùng của giáo viên và mock test — cũng là lý do đừng luyện đến ngày thi mà chưa từng có người nghe mình nói.
Luyện nền: chấm AI mỗi ngày 1–2 chủ đề, mỗi lượt chỉ sửa một lỗi để không loãng. Mỗi 2 tuần gửi một bản ghi tốt nhất cho giáo viên chấm để soi phần máy không thấy. Trước thi 2–3 tuần làm 1–2 mock test 1-1 trọn bộ 11–14 phút. Nhịp này giữ được cả tần suất cao của máy lẫn độ sâu của người mà không đội chi phí lên quá một hai buổi học truyền thống.