Tất cả bài viết · Đăng ngày 2026-08-04
Độ khó của Part 7 là thứ đo được — và khi đã nhìn ra cấu trúc, bạn sẽ biết cách làm bài
Bài giải thích kỹ thuật dành cho những ai tò mò. Loạt bài về độ khó gồm mỗi Part một bài, đăng theo thứ tự; đây là bài thứ bảy và cũng là bài khép lại. Bài này xử lý phần khó giải thích nhất trong toàn bộ TOEIC — Part 7, bài đọc hiểu — trình bày cách chúng tôi biến độ khó của nó thành một thứ đo lường được, cách chúng tôi hiệu chuẩn thước đo này dựa trên một bộ đề thi thử thương mại, và (hữu ích nhất cho bạn) một khi nhìn ra một câu hỏi được làm khó bằng cách nào, bạn sẽ biết nên dành thời gian vào đâu. Không cần bất kỳ nền tảng thống kê nào.
Vì sao độ khó của Part 7 là thứ khó giải thích nhất
Khi một câu Part 5 khó, thường bạn có thể chỉ vào một điểm ngữ pháp và nói "chính là nó". Khi một câu Part 1 khó, bạn có thể chỉ vào một mẫu câu. Nhưng Part 7 không có điểm đơn lẻ như vậy: một bài đọc, ba bốn câu hỏi, và độ khó rải khắp trong độ dài của văn bản, trong cách diễn đạt của các phương án, trong vị trí giấu bằng chứng. Hỏi mười thí sinh "bài này khó ở đâu", bạn sẽ nhận được mười câu trả lời đều đúng — nhưng đều chỉ đúng một phần.
Với một ứng dụng luyện thi, đây là vấn đề bắt buộc phải giải quyết, vì lý do mà loạt bài này vẫn luôn nhấn mạnh: nhãn độ khó quyết định tổ hợp câu hỏi mà bạn thực sự luyện tập, và một thứ không nói rõ được thì cũng không kiểm tra được, không hiệu chuẩn được. Nếu "khó" chỉ là cảm giác nhất thời của người ra đề, thì cái gọi là phân bố độ khó chỉ là phân bố của cảm giác.
Vì vậy chúng tôi tách độ khó của Part 7 ra để đo.
Định nghĩa của độ khó, và vật thay thế của nó
Trắc nghiệm học (psychometrics) có một định nghĩa không mập mờ về độ khó: độ khó của một câu hỏi chính là tỷ lệ thí sinh thật trả lời đúng nó (thuật ngữ gọi là giá trị p). Câu có 85% người làm đúng là câu dễ, câu có 40% người làm đúng là câu khó — thẳng thắn như vậy.
Nhưng định nghĩa này có một tiền đề khắc nghiệt: phải có một lượng lớn thí sinh đã làm chính câu hỏi đó. ETS có dữ liệu này; mọi bên thứ ba — kể cả chúng tôi, kể cả mọi nhà xuất bản — đều không có. Cho nên bất kỳ ai in dòng "độ khó: cao" bên cạnh một câu hỏi thực chất đều đang dùng một vật thay thế nào đó. Khác biệt duy nhất nằm ở chỗ: vật thay thế đó là phán đoán của một con người, hay là một bộ quy tắc có thể chạy lại và kiểm chứng được.
Chúng tôi chọn vế sau. Cách làm: xác định một tập hợp các đặc điểm cấu trúc khiến câu hỏi trở nên khó hơn, rồi đo từng câu một. Vì các đặc điểm được tính từ chính văn bản của câu hỏi, cùng một thước đo có thể đo ngân hàng câu hỏi của chúng tôi — và đo bất kỳ bộ đề nào in trên giấy. Điểm này sẽ trở nên rất quan trọng ở phần dưới.
Một câu Part 7 có thể bị làm khó từ những hướng nào
Dưới đây là những đặc điểm chính mà chúng tôi thực sự tính toán cho từng câu Part 7. Danh sách này đồng thời là lời giới thiệu cho nửa sau của bài viết: mỗi hướng làm khó một câu hỏi đều tương ứng với một cách dành thời gian vào đúng chỗ.
1. Dạng câu hỏi — bạn được yêu cầu làm loại việc gì
Câu hỏi Part 7 không phải một loại, mà là một phổ. Xếp theo mức "đáp án cần bao nhiêu bước xử lý", từ nông đến sâu:
| Dạng câu hỏi | Việc bạn phải làm |
|---|---|
| Câu chi tiết (What is indicated about…?) | Định vị một sự kiện trong bài |
| Câu ý chính / mục đích (What is the purpose of…?) | Khái quát cả bài, không phải bất kỳ câu đơn nào |
| Câu từ vựng (The word "…" is closest in meaning to) | Chọn nghĩa theo ngữ cảnh, không theo từ điển |
| Câu chèn câu (chọn vị trí [1]–[4]) | Phán đoán sự liên kết của một câu với đoạn trước và sau |
| Câu NOT (What is NOT mentioned…?) | Xác nhận ba phương án là đúng, cái còn lại là đáp án |
| Câu suy luận (What is suggested/implied…?) | Ghép hai sự kiện trong bài thành một kết luận không được viết ra |
| Câu liên kết nhiều đoạn (bài đôi / bài ba) | Áp quy tắc ở một văn bản vào trường hợp cụ thể ở văn bản khác |
Càng xuống dưới, một câu càng ngốn nhiều giây. Thứ tự này không phải do chúng tôi phát minh — nó chính là "đáp án nằm cách bề mặt văn bản bao xa".
2. Khoảng cách diễn đạt lại — cốt lõi thật sự của Part 7
Đây là đặc điểm quan trọng nhất trong toàn bộ Part 7. Đáp án đúng gần như không bao giờ lặp lại từ ngữ của bài đọc.
Bài viết: Refunds are issued within five business days of our receiving the returned item. Câu hỏi dễ cho đáp án thế này: Within five business days (chép nguyên văn). Đáp án của đề thi thật thế này: About a week after the store gets the product back — "năm ngày làm việc" biến thành "khoảng một tuần", "chúng tôi nhận được hàng trả lại" biến thành "cửa hàng lấy lại sản phẩm". Mọi từ khóa đều đã bị thay, còn nghĩa thì không đổi một chữ nào.
Với mỗi câu, chúng tôi tính độ trùng lặp từ ngữ giữa các phương án và các câu trong bài. Độ trùng lặp càng thấp — đáp án được "dịch" càng triệt để — câu hỏi càng khó, vì bạn không thể tìm ra nó bằng cách quét từ khóa.
3. Mật độ bẫy — những phương án sai trông giống đáp án
Hình ảnh phản chiếu của khoảng cách diễn đạt lại: các phương án sai chứa bao nhiêu từ thực sự có trong bài. Một phương án bê nguyên "five business days" vào nhưng gắn nó với sự kiện sai (chẳng hạn gắn vào số ngày giao hàng thay vì số ngày hoàn tiền) là đòn chí mạng với người đọc kiểu quét. Từ ngữ của bài xuất hiện trong càng nhiều phương án sai, câu đó càng nguy hiểm.
4. Vị trí bằng chứng — đáp án được chôn ở đâu
Bằng chứng nằm ở đoạn đầu và nằm ở đoạn cuối có chi phí khác nhau; gói gọn trong một câu và rải trong hai đoạn còn khác nhau hơn nữa. Chúng tôi ghi lại vị trí đoạn văn chứa bằng chứng của từng câu. Nhân tiện, dữ liệu này bạn nhìn thấy được trong ứng dụng: sau khi trả lời, câu chứa bằng chứng sẽ được tô sáng ngay trong bài đọc.
5. Hình dạng bộ đề — bạn phải đọc bao nhiêu chữ cho mỗi câu
Bài đơn, bài đôi, bài ba, cộng với tổng độ dài văn bản. Đo trên khối lượng của đề thi thật, chúng tôi có một mốc chuẩn rất dễ nhớ: ở Part 7, trung bình mỗi câu hỏi gánh khoảng 84 từ cần đọc. Một bài 300 từ kèm ba câu hỏi là tải trọng tiêu chuẩn; cũng ba câu đó trên bài 500 từ, riêng chi phí đọc đã đẩy độ khó lên rồi.
Nói cụ thể hơn "dài" là dài bao nhiêu: trong đề thi thật, độ dài của bài đơn đi theo số câu hỏi — văn bản kèm 2 câu (chuỗi tin nhắn, hóa đơn) khoảng 110–200 từ, kèm 3 câu khoảng 180–300 từ, còn bài báo hay thư trang trọng kèm 4 câu là 250–400 từ. Ngân hàng câu hỏi của chúng tôi kiểm soát bằng đúng các khoảng này: bộ đề mới có số từ nằm ngoài khoảng thì không được nhận vào.
Nhân đây cũng xin nói rõ một điều có thể bạn đã nhận ra trong ứng dụng: ngân hàng còn giữ một phần các bộ Part 7 được làm ngắn có chủ ý, chỉ dùng cho luyện tập hằng ngày — thân thiện hơn với người học tranh thủ vài phút lúc di chuyển, hoặc còn đang xây sức bền đọc. Bài thi thử chỉ rút các bộ đề đúng độ dài của đề thi thật, nên trải nghiệm thi thử và ước tính điểm của bạn không bao giờ bị pha loãng bởi bài ngắn. Trong tương lai, chúng tôi cũng cân nhắc bổ sung các câu hỏi nhập môn kiểu "baby TOEIC" cho người học còn chật vật ở trình độ thấp hơn — đọc cho trọn trước đã, rồi mới luyện đọc cho nhanh.
6. Thể loại văn bản — đây là loại tài liệu gì
Thông báo, email, quảng cáo, bài báo, hội thoại trực tuyến. Chúng không tương đương nhau: một bài article mang tính nghị luận tự nhiên khó hơn một chuỗi text-message, nhưng đổi lại thể hội thoại mang theo dạng câu khó riêng của nó (câu hỏi ý định: "Cô ấy ngụ ý gì khi viết câu này?").
Gộp các đặc điểm này lại, mỗi câu nhận một điểm độ khó, rồi được cắt thành ba mức easy / medium / hard. Chỉ còn lại một vấn đề: đặt vạch cắt ở đâu mới là đúng?
Hiệu chuẩn thước đo trên một bộ đề thi thử thương mại
Vạch chia không thể tự bịa ra, mà phải đối chiếu với một tham chiếu bên ngoài. Chúng tôi dùng bộ 《全新!新制多益 TOEIC 題庫解析 狠準 6 回》 (tác giả Hackers Academia, bản Đài Loan do 國際學村 xuất bản) — một bộ đề thi thử trọn vẹn sáu đề, được thị trường công nhận là có độ hoàn thiện rất cao. Chọn nó vì một lý do rất thực tế: sách in kèm mỗi câu hỏi mức đánh giá độ khó của chính nhà xuất bản (cao / trung bình / thấp), cho chúng tôi 1.200 phán đoán theo từng câu, có sẵn, do biên tập viên chuyên nghiệp thực hiện, để đối chiếu.
Rồi đến bước then chốt: cùng một chương trình trích xuất đặc điểm, chạy trên ngân hàng câu hỏi của chúng tôi và chạy trên các câu hỏi của sách tham chiếu. Một dụng cụ đo, hai kho ngữ liệu — so sánh mới có ý nghĩa. Vạch chia (điểm cắt của ba mức độ khó) được hiệu chuẩn theo đúng tỷ lệ mà sách tham chiếu tự in ra — trước tiên để thước đọc ra được câu trả lời của chính nhà xuất bản trên đề thật, rồi mới dùng thước đó đọc ngân hàng của chúng tôi. Nội dung mới trước khi vào ngân hàng phải vượt qua các cổng kiểm tự động: độ dài phải nằm trong khối lượng đọc trên mỗi câu của đề thi thật, và hồ sơ độ khó phải nằm trong dung sai của hồ sơ tham chiếu.
Bộ tham chiếu này còn tiện thể cho chúng ta một điều hữu ích với mọi thí sinh: chính nhà xuất bản cũng đánh giá phần Đọc khó hơn phần Nghe rất nhiều. Ở các Part Nghe, câu được xếp mức "thấp" (dễ) chiếm 34–45%; ở phần Đọc chỉ có 10–12% — và 29% số câu Part 7 được xếp mức "cao". Nếu bạn luôn cảm thấy phần Đọc vất vả hơn phần Nghe, thì đó không phải vấn đề của bạn — đó là hình dạng của kỳ thi này.
Những lưu ý trung thực
- Sách tham chiếu là đề thi thử của nhà xuất bản, không phải tài liệu chính thức của ETS. Về mặt định dạng, nó cực kỳ đáng tin (gần như không có biến động giữa sáu đề — đúng dáng vẻ của việc sao chép trung thực khung ra đề chính thức); về mặt độ khó, nó mang phán đoán của biên tập viên, không phải tỷ lệ trả lời đúng của thí sinh thật.
- Chúng tôi chỉ đưa ra khẳng định ở cấp độ phân bố, không ở cấp độ từng câu. Chúng tôi từng chạy kiểm chứng theo từng câu ở Part 5: các đặc điểm cấu trúc giải thích rất ít độ khó của "một câu riêng lẻ". Cho nên cách dùng đúng của công cụ này là so sánh và căn chỉnh cấu thành độ khó của hai ngân hàng câu hỏi — chứ không phải tuyên bố điểm số của một câu cụ thể nào đó là chính xác tuyệt đối. Điểm của từng câu luôn kèm biên độ sai số, và không bao giờ là căn cứ duy nhất để phán xét một câu.
- Đích đến thật sự là tỷ lệ trả lời đúng. Khi thống kê làm bài ẩn danh tích lũy dần, mỗi câu sẽ dần có được giá trị p thật của nó, và lúc đó cây thước cấu trúc này sẽ được hiệu chuẩn lại bằng dữ liệu thật. Trước lúc đó, đây là cách đo trung thực nhất mà chúng tôi làm được.
Khi đã nhìn ra cấu trúc: làm bài sao cho hiệu quả
Giờ hãy đọc ngược danh sách đặc điểm ở trên. Mỗi hướng làm khó một câu hỏi là một chỉ dẫn cho biết thời gian của bạn nên đặt vào đâu.
Đọc câu hỏi trước, phân loại trước, rồi mới quyết định cách đọc bài
Nhận một cụm câu hỏi, hãy dành năm giây xếp từng câu vào bảng dạng câu ở trên. Bước này quyết định cách bạn đọc:
- Câu ý chính / mục đích — bằng chứng gần như luôn nằm ở đoạn đầu (với thư từ là một hai câu mở đầu) cộng đoạn cuối. Không cần đọc kỹ phần giữa vẫn trả lời được, nên đây là câu bạn nên giải quyết luôn ngay khi đọc xong đoạn một.
- Câu chi tiết — bắt từ định vị trong câu hỏi (ngày tháng, số tiền, tên người là đáng tin nhất, vì chúng không thể bị diễn đạt lại), quét đến vùng đó rồi chậm lại đọc kỹ. Nhớ lấy khoảng cách diễn đạt lại: thứ bạn tìm là nơi ý nghĩa của câu hỏi xuất hiện, không phải từ ngữ của câu hỏi.
- Câu từ vựng — thay lần lượt bốn phương án vào câu gốc. Đáp án đúng là cái đứng vững "trong chính câu này", và thường không phải nghĩa phổ biến nhất của từ đó. Dạng này không đòi hỏi hiểu cả bài — là dạng có suất sinh lời trên mỗi giây cao nhất toàn Part 7.
- Câu suy luận — đáp án là tổ hợp của hai sự kiện, và hai sự kiện đó thường cách nhau một đoạn. Đồng thời cảnh giác cái bẫy theo chiều ngược lại: bài viết "khách hàng được mời tham dự", phương án viết "khách hàng sẽ tham dự" — phương án vượt quá phạm vi bài đọc chống lưng thì trông thuận mắt mấy cũng sai.
Tính câu NOT với giá gấp ba
"Điều nào sau đây không được nhắc đến?" xét về chi phí không phải một câu, mà là ba — bạn phải lần lượt tìm bằng chứng trong bài cho ba phương án, cái còn lại mới là đáp án. Nó đáng làm, nhưng phải làm cuối cùng: khi bạn đã đọc quen bài vì các câu khác trong cụm, việc đối chiếu ba lần "có được nhắc đến" sẽ nhanh hơn nhiều. Đặt sai thứ tự, bạn sẽ đọc cùng một bài hai lần vô ích.
Cảnh giác với phương án "chép nguyên văn"
Đây là bài học từ đặc điểm mật độ bẫy, đáng tách thành một mục riêng: thấy phương án giống hệt từng chữ với bài đọc, hãy nghi ngờ trước đã. Người ra đề biết người vội vàng dựa vào quét từ khóa, nên cái bẫy ít tốn công nhất là gắn từ ngữ của bài gốc vào sai đối tượng, sai thời gian hoặc sai điều kiện. Ngược lại, một phương án diễn đạt lại bài gốc một cách triệt để lại càng đáng được cân nhắc nghiêm túc — đáp án đúng thường trông như vậy.
Câu chèn câu: để đại từ và từ nối làm việc cho bạn
Câu được cho gần như chắc chắn giấu một cái móc: These changes (đoạn trước bắt buộc phải nhắc đến nhiều thay đổi), However (câu trước bắt buộc phải theo hướng ngược lại), He then (đoạn trước bắt buộc phải có người này và một hành động trước đó). Tìm cái móc trong câu trước, rồi quay lại bài tìm vị trí có thể móc vào — bốn ứng viên thường bị loại ngay hai tại chỗ.
Câu liên kết nhiều đoạn: quy tắc ở một bài, trường hợp cụ thể ở bài kia
Trong bài đọc đôi và ba, chắc chắn có câu hỏi không thể trả lời chỉ dựa vào bất kỳ một bài nào. Cấu trúc của chúng cố định đến kinh ngạc: một bài đưa quy tắc (miễn phí vận chuyển cho đơn từ NT$800, thành viên giảm 10%, giá điều chỉnh sau tháng Ba), bài kia đưa một trường hợp cụ thể (một hóa đơn NT$740, đơn hàng của một thành viên, một thư hỏi giá gửi vào tháng Tư). Động tác của bạn: khi đọc bài thứ nhất, thấy con số, ngày tháng, ngưỡng điều kiện thì đánh dấu lại — đáp án của câu liên kết gần như luôn treo trên những điểm này. Thấy câu hỏi "khách hàng này thực tế phải trả bao nhiêu" mà số tiền không được viết rõ trong bất kỳ bài nào, đó chính là đề đang kiểm tra việc bạn nối hai bài lại với nhau.
Cuối cùng là thời gian, vì Part 7 trước hết là bài thi tốc độ
Phần Đọc có 100 câu trong 75 phút, và Part 7 chiếm 54 câu. Lời khuyên phân bổ thời gian phổ biến là ép Part 5 dưới 10 phút, Part 6 dưới 8 phút, để dành cho Part 7 khoảng 55 phút — trung bình mỗi câu một phút, tính cả thời gian đọc. Kết hợp với khối lượng khoảng 84 từ đọc trên mỗi câu, điều này đòi hỏi tốc độ đọc ổn định cộng với toàn bộ kỷ luật "không đọc lại" ở trên.
Đây cũng là lý do trong bài viết về ước tính điểm, ứng dụng dùng số giây thực tế trên mỗi câu của bạn để mô phỏng đồng hồ thi: câu không kịp làm thì khi tính điểm chẳng khác gì đoán mò. Ở Part 7, cái giá của việc bỏ nguyên một cụm bốn câu lớn hơn cái giá của việc nán thêm ba mươi giây ở một câu khó — nếu phải bỏ, hãy bỏ câu lẻ (nhất là câu NOT), đừng bỏ cả cụm.
Tóm tắt trong một câu
Độ khó của Part 7 không phải một màn sương. Nó là tổng của vài đặc điểm đo được theo từng câu — dạng câu hỏi, khoảng cách diễn đạt lại, mật độ bẫy, vị trí bằng chứng, khối lượng đọc, thể loại văn bản; chúng tôi hiệu chuẩn phép đo này trên một bộ đề thi thử thương mại sáu đề có in đánh giá từng câu của nhà xuất bản, để cấu thành độ khó của ngân hàng câu hỏi được căn theo một tham chiếu bên ngoài, kiểm tra được — chứ không theo cảm giác của chính chúng tôi. Và đọc ngược cùng danh sách đặc điểm đó, bạn có ngay chiến lược làm bài: mỗi thủ pháp làm khó một câu hỏi đều báo trước đáp án giấu ở đâu, và phút tiếp theo của bạn nên đặt vào đâu.