บทความทั้งหมด · เผยแพร่เมื่อ 2026-08-01
ภาพรวมความยาก: "ยากเหมือนข้อสอบจริง" หมายความว่าอย่างไร — เราวัดอย่างไร ใช้อะไรเป็นเกณฑ์เปรียบเทียบ และเรื่องไหนที่เราไม่อ้าง
คำอธิบายทางเทคนิคสำหรับผู้ที่มีความอยากรู้ นี่คือบทสรุปภาพรวมของซีรีส์ระดับความยาก โดยหลังจากนี้จะมีบทความแยกเฉพาะสำหรับแต่ละ Part บทความนี้จะครอบคลุมส่วนที่เป็นพื้นฐานร่วมกันของบทความถัดไปทั้งหมด ได้แก่ นิยามอย่างเป็นทางการของความยากในทฤษฎีการทดสอบ เหตุผลที่ไม่มีใคร (รวมถึงเรา) สามารถวัดความยากได้โดยตรง สิ่งที่เราใช้เป็นเกณฑ์อ้างอิงภายนอก ตลอดจนสิ่งที่ยินดีกล่าวอ้างและไม่ยินดีกล่าวอ้าง หลังจากอ่านบทความนี้แล้ว บทความของแต่ละ Part จะสามารถเข้าสู่เนื้อหาเรื่องแหล่งที่มาของความยากใน Part นั้นๆ ได้โดยตรง โดยไม่จำเป็นต้องมีพื้นฐานทางสถิติใดๆ
ทำไม "ความยาก" ถึงใช้อย่างรู้สึกเอาไม่ได้
ข้อสอบแบบฝึกหัดทุกข้อในคลังข้อสอบจะมีป้ายกำกับติดอยู่ ได้แก่ ง่าย ปานกลาง ยาก ช่องข้อมูลนี้ดูเหมือนเป็นเรื่องธรรมดาทั่วไป แต่กลับเป็นจุดที่เกิดปัญหาได้ง่ายที่สุดในคลังข้อสอบทั้งหมด — เพราะเวลาที่มันผิดพลาด จะไม่มีอะไรส่งเสียงเตือนเลย
หากเฉลยข้อไหนผิด จะมีคนแจ้งเข้ามา หากไฟล์เสียงเสีย คุณกดฟังก็รู้ทันที แต่ถ้าข้อสอบข้อหนึ่งถูกติดป้ายว่า "ยาก" ทั้งที่จริงแล้วง่ายมาก กลับไม่มีสัญญาณเตือนใดๆ เลย มันยังคงปรากฏขึ้นตามปกติ คิดคะแนนตามปกติ และดูเหมือนเป็นข้อสอบยากข้อหนึ่งตามปกติ
ป้ายกำกับนี้ทำหน้าที่สำคัญสองประการ ประการแรก มันเป็นตัวกำหนดชุดข้อสอบที่คุณจะได้ฝึกฝน — การฝึกซ้อมและการสอบจำลองจะมีประสิทธิผลได้ จะต้องมีลำดับความยากง่ายที่สมเหตุสมผล ซึ่งสิ่งนี้จะเกิดขึ้นได้ก็ต่อเมื่อคำว่า "ยาก" หมายถึงยากจริงๆ เท่านั้น ประการที่สอง มันช่วยให้เราอธิบาย "วิธีรับมือกับข้อสอบยาก" ได้อย่างชัดเจน หากเราไม่สามารถบอกได้ว่าทำไมข้อสอบข้อหนึ่งถึงยาก เราก็ทำได้เพียงให้คำแนะนำประเภท "ฝึกซ้อมให้มากๆ" ซึ่งแม้จะถูกต้องแต่ไม่มีประโยชน์ ในทางกลับกัน ขอเพียงเราแยกแยะความยากออกมาเป็นแหล่งที่มาที่รูปธรรมและระบุได้ แหล่งที่มาเหล่านั้นก็จะกลายเป็นรายการหัวข้อสำหรับฝึกซ้อมในตัวเอง
นิยามอย่างเป็นทางการของความยาก และเงื่อนไขเบื้องต้นอันแสนทารุณ
วิชาจิตวิทยาการวัดผล (Psychometrics) ให้นิยามความยากไว้อย่างชัดเจนโดยไม่อ้อมค้อม:
ความยากของข้อสอบข้อหนึ่ง คือสัดส่วนของผู้สอบจริงที่ตอบข้อนั้นถูกต้อง
ศัพท์เฉพาะทางเรียกว่า ค่า p ข้อที่มีอัตราการตอบถูก 85% คือข้อสอบง่าย ข้อที่มีอัตราการตอบถูก 40% คือข้อสอบยาก ตรงไปตรงมาแบบนี้เลย มันไม่ใช่ความรู้สึกของผู้เชี่ยวชาญว่ายากหรือไม่ แต่คือจำนวนคนที่ทำผิดจริงในความเป็นจริง
แต่คำนิยามนี้มีเงื่อนไขเบื้องต้นอันแสนทารุณอย่างหนึ่ง: คุณต้องให้ผู้สอบจำนวนมากทำข้อสอบข้อนี้เสียก่อน ETS มีข้อมูลประเภทนี้ — ข้อสอบจริงทุกข้อผ่านการทดลองสอบล่วงหน้าก่อนนำมาใช้งานจริง แต่สำนักพิมพ์ ติวเตอร์ หรือแอปพลิเคชันภายนอกใดๆ ไม่มีข้อมูลนี้เลย ไม่ใช่ว่าเราปกปิดไว้ แต่เป็นเพราะทุกสำนักพิมพ์ ทุกสถาบันกวดวิชา และทุกแอป ต่างไม่มีข้อมูลนี้เหมือนกันทั้งหมด
ดังนั้น ผู้ที่พิมพ์คำว่า "ความยาก: สูง" ไว้ข้างข้อสอบทุกคน แท้จริงแล้วต่างใช้ตัวชี้วัดทดแทนบางอย่าง ตัวเรื่องนี้เองไม่ได้มีปัญหาอะไร การใช้ตัวชี้วัดทดแทนถือเป็นเรื่องปกติในสาขานี้ ความแตกต่างที่แท้จริงอยู่แค่ตรงที่ว่า:
ตัวชี้วัดทดแทนนั้น เป็นการตัดสินตามอคติส่วนบุคคลของคนคนหนึ่ง หรือเป็นชุดกฎเกณฑ์ที่สามารถรันซ้ำ ตรวจสอบ และถูกโต้แย้งลบล้างได้?
เราเลือกอย่างหลัง วิธีการของเราคือ ไม่สนใจป้ายกำกับความยากที่ใครประทับไว้เลย แต่ใช้วิธีคำนวณชุดคุณลักษณะเชิงโครงสร้างที่ทำให้ข้อสอบยากขึ้นจากตัวข้อความของข้อสอบเองโดยตรง แล้วประเมินทีละข้อ เนื่องจากคุณลักษณะเหล่านี้คำนวณจากข้อความ โปรแกรมชุดเดียวกันนี้จึงสามารถวัดคลังข้อสอบของเราได้ และวัดข้อสอบฉบับพิมพ์บนกระดาษชุดใดก็ได้เช่นกัน — ซึ่งจุดนี้คือหัวใจสำคัญของหัวข้อถัดไป
"ยากเหมือนข้อสอบจริง" สามารถหมายถึง 3 สิ่งได้อย่างซื่อตรง
วลีนี้มักถูกนำมาใช้รวมๆ เป็นประโยคเดียว แต่แท้จริงแล้วมันปะปนระดับความหมายไว้ 3 ระดับ และมีเพียง 2 ระดับแรกเท่านั้นที่ใครๆ ในปัจจุบันสามารถตรวจสอบได้
| ข้อกล่าวอ้าง | ตรวจสอบได้หรือไม่ | |
|---|---|---|
| 1 | โครงสร้างการออกข้อสอบเดียวกัน — ประเภทข้อสอบเดียวกัน สัดส่วนเดียวกัน โครงสร้างเหมือนกันในทุกชุดข้อสอบ | ได้ เป็นวัตถุวิสัย |
| 2 | การกระจายความยากเดียวกัน — ตัดสินตามเกณฑ์อ้างอิงภายนอก สัดส่วน ง่าย/ปานกลาง/ยาก เหมือนกัน | ได้ แต่ต้องระบุว่า "ตัดสินโดยใคร" |
| 3 | อัตราการตอบถูกเดียวกัน — สัดส่วนของผู้สอบจริงที่ตอบถูกในข้อสอบแต่ละข้อเท่ากัน | ไม่ได้ เว้นแต่จะมีข้อมูลอย่างเป็นทางการหรือตัวอย่างการตอบข้อสอบจำนวนมาก |
เราสามารถสนับสนุนข้อ (1) ได้อย่างเต็มที่ สนับสนุนข้อ (2) ภายใต้ข้อสงวนที่ชัดเจน และชี้แจงอย่างชัดเจนว่าข้อ (3) ยังไม่ได้รับการยืนยัน
ใครก็ตามที่กล่าวอ้างข้อ (3) โดยไม่มีข้อมูลการตอบข้อสอบจำนวนมาก ย่อมเป็นการคาดเดาประเภทหนึ่ง ซึ่งรวมถึงตัวเราเองด้วย — และในตอนท้ายของทุกบทความในซีรีส์นี้จะย้อนกลับมาเน้นย้ำจุดนี้เสมอ
สิ่งที่เราใช้เปรียบเทียบ: ชุดข้อสอบจำลอง 6 ชุดที่มีวางจำหน่ายในท้องตลาด
สเกลวัดไม่สามารถคิดขึ้นมาเองได้ แต่ต้องอิงกับเกณฑ์อ้างอิงภายนอก สิ่งที่เราใช้คือ 《全新!新制多益 TOEIC 題庫解析 狠準 6 回》 (ชุดข้อสอบจำลองของ Hackers Academia ฉบับไต้หวัน จัดพิมพ์โดย 國際學村) ซึ่งเป็นชุดข้อสอบจำลองเต็มรูปแบบ 6 ชุดที่ได้รับการยอมรับในท้องตลาดว่ามีความสมบูรณ์สูงมาก
เหตุผลในการเลือกหนังสือเล่มนี้เป็นไปในทางปฏิบัติอย่างยิ่ง: ข้อสอบทุกข้อในหนังสือมีป้ายกำกับระดับความยากของสำนักพิมพ์เองพิมพ์ไว้ (สูง/กลาง/ต่ำ) สิ่งนี้ทำให้เรามีผลการตัดสินระดับข้อสอบรายข้อจากบรรณาธิการมืออาชีพจำนวนหลายพันข้อให้ใช้อ้างอิง — ซึ่งเป็นสิ่งที่จำเป็นอย่างยิ่งในการประเมินว่าเครื่องมือวัดของเราแม่นยำหรือไม่
และนี่คือขั้นตอนสำคัญของวิธีการทั้งหมด:
ใช้โปรแกรมสกัดคุณลักษณะชุดเดียวกัน รันทั้งคลังข้อสอบของเรา และรันข้อสอบจากหนังสืออ้างอิง
เครื่องมือวัดชิ้นเดียว กับชุดข้อมูลข้อความสองชุด นี่คือเงื่อนไขเบื้องต้นที่มีความหมายมากกว่า — เราไม่ได้ใช้มาตรฐานของตัวเองมาประเมินตัวเอง แต่เปรียบเทียบทั้งสองฝ่ายบนไม้บรรทัดเล่มเดียวกัน
ไม้บรรทัดนี้วัดกลุ่มประชากรได้แม่นยำ แต่วัดรายบุคคลได้ไม่แม่นยำ
นี่คือจุดที่สำคัญที่สุดและมองข้ามได้ง่ายที่สุดของวิธีการทั้งหมด ซึ่งควรค่าแก่การอธิบายให้ชัดเจนด้วยข้อเปรียบเทียบ
ลองจินตนาการถึงเครื่องชั่งน้ำหนักที่มีความคลาดเคลื่อน ±5 กิโลกรัม คุณไม่สามารถใช้มันตัดสินได้ว่า "สัปดาห์นี้ฉันน้ำหนักเพิ่มขึ้น 1 กิโลกรัมหรือไม่" — เพราะค่าความคลาดเคลื่อนใหญ่กว่าความเปลี่ยนแปลงที่คุณต้องการวัด ตัวเลขที่วัดได้จึงแทบไม่มีความหมาย แต่ถ้าคุณใช้เครื่องชั่งน้ำหนักเครื่องเดียวกันนี้วัดคน 1,000 คน แล้วไปวัดคนอีกกลุ่มหนึ่งจำนวน 1,000 คน ค่าเฉลี่ยของทั้งสองกลุ่มยังคงนำมาเปรียบเทียบกันได้: เพราะความคลาดเคลื่อนบางครั้งก็สูงไป บางครั้งก็ต่ำไป หลังจากวัด 1,000 ครั้ง ค่าความคลาดเคลื่อนจะหักล้างกันไปเองโดยประมาณ และผลต่างที่เหลืออยู่นั้นคือของจริง
ตัวจัดหมวดหมู่เชิงโครงสร้างของเราก็คือเครื่องชั่งน้ำหนักเครื่องนั้น มันเชื่อถือไม่ได้อย่างมากเมื่อใช้ตัดสินว่าข้อสอบเพียงข้อเดียวยากหรือไม่ — นี่ไม่ใช่ว่าเราถ่อมตน แต่เป็นเพราะเราได้ทดสอบจริงแล้วว่ามันเชื่อถือไม่ได้แค่ไหน ตัวเลขและวิธีวัดถูกเขียนไว้ในบทความ Part 5 (เร็ว ๆ นี้) แล้ว แต่เมื่อนำชุดกฎเกณฑ์เดียวกันนี้ไปใช้กับข้อสอบมากกว่า 1,000 ข้อ การตัดสินผิดพลาดเป็นรายข้อจะกระจายออกไปทั้งสองฝั่งและหักล้างกันเอง สัดส่วนที่เหลืออยู่จึงเป็นสิ่งที่น่าเชื่อถือ
ดังนั้นเส้นแบ่งจึงอยู่ตรงนี้:
- พูดได้ว่า: ใน Part 5 ของเรา ประเภท "คำศัพท์ 4 คำที่เป็นอิสระต่อกัน" มีสัดส่วน 42.3% ส่วนหนังสืออ้างอิงมีสัดส่วน 33.1% ✓
- พูดไม่ได้ว่า: ข้อสอบข้อนี้เป็นข้อสอบยาก เพราะตัวจัดหมวดหมู่จัดให้อยู่ในประเภทที่ยากที่สุด ✗
ผลในทางปฏิบัติมีความตรงไปตรงมาอย่างยิ่ง: เราจะไม่ใช้ผลลัพธ์จากการจัดหมวดหมู่นี้ไปเขียนทับป้ายกำกับความยากของข้อสอบข้อใดข้อหนึ่ง ไม้บรรทัดเล่มนี้ถูกนำมาใช้ในจุดที่มันสามารถยึดยืนได้อย่างมั่นคง นั่นคือการควบคุมองค์ประกอบภาพรวมของเนื้อหาใหม่ ไม่ใช่การให้คะแนนข้อสอบรายข้อ การเปรียบเทียบความยากทั้งหมดในซีรีส์นี้ ต้องอ่านภายใต้ข้อจำกัดนี้ด้วย
ข้อจำกัดของเกณฑ์อ้างอิงชุดนี้ เราจะไม่ปกปิดหรือสร้างภาพลบมันทิ้ง
- นี่คือข้อสอบจำลองจากสำนักพิมพ์ ไม่ใช่ข้อสอบทางการจาก ETS ดังนั้น ในทางรูปแบบจึงเป็นหลักฐานที่แข็งแกร่ง (ข้อสอบทั้ง 6 ชุดแทบจะไม่มีความแปรผันเลย สะท้อนถึงการคัดลอกโครงสร้างการออกข้อสอบอย่างเป็นทางการได้อย่างซื่อตรง) ส่วนในทางความยากจึงเป็นหลักฐานที่อ่อนกว่า (ข้อสอบเขียนขึ้นโดยสำนักพิมพ์เอง ส่วนการจัดระดับความยากเป็นการตัดสินของบรรณาธิการ) เราจึงตั้งใจรายงานการเปรียบเทียบรูปแบบด้วยน้ำเสียงที่มั่นใจ และรายงานการเปรียบเทียบความยากด้วยน้ำเสียงที่มีข้อสงวน
- มันมีเพียง 6 ชุดเท่านั้น สำหรับคุณลักษณะเชิงโครงสร้างที่ปรากฏขึ้นเป็นประจำในข้อสอบทุกชุด 6 ชุดก็เพียงพอแล้วสำหรับการยืนยัน แต่สำหรับความแตกต่างเพียงเล็กน้อยของสัดส่วน 6 ชุดนั้นยังไม่เพียงพอ
ผลลัพธ์ในปัจจุบัน: ข้อสอบของเราไม่ได้ง่ายไปกว่าหนังสืออ้างอิง
ขอเริ่มด้วยชุดตัวเลขที่เข้าใจผิดได้ง่ายที่สุดก่อน หากพิจารณาเพียงสัดส่วนของคำว่า "ยาก" บนป้ายกำกับของทั้งสองฝ่าย ดูเหมือนว่าเราจะง่ายกว่าในทุกๆ ส่วน:
| Part | เกณฑ์อ้างอิงประเมินเป็น "สูง" | เราติดป้ายเป็น "ยาก" |
|---|---|---|
| 2 | 20% | 18.9% |
| 3 | 12% | 21.7% |
| 4 | 18% | 16.2% |
| 5 | 33% | 10.3% |
| 6 | 28% | 25.8% |
| 7 | 29% | 21.6% |
จากทั้งหมด 6 Part มีถึง 4 Part ที่ต่างกันเพียงไม่กี่เปอร์เซ็นต์ ช่องว่าง 23 เปอร์เซ็นต์ใน Part 5 ดูเหมือนจะรุนแรงมาก — แต่มันคือบทเรียนที่สำคัญที่สุดในซีรีส์นี้ เพราะเมื่อเราเปลี่ยนมาใช้วิธีวัดเชิงโครงสร้าง แทนที่จะเปรียบรูปป้ายกำกับของทั้งสองฝ่าย ผลลัพธ์กลับตาลปัตรตรงกันข้าม:
| การจัดตัวเลือก Part 5 | เรา | เกณฑ์อ้างอิง |
|---|---|---|
| ตระกูลคำเดียวกันและมีคำใบ้ข้างเคียง (ง่ายที่สุด) | 3.6% | 2.9% |
| ตระกูลคำเดียวกัน ไม่มีคำใบ้ | 29.4% | 28.4% |
| คำไวยากรณ์ / ตัวเลือกคำปรากฏร่วม | 24.7% | 25.6% |
| คำศัพท์ 4 คำที่เป็นอิสระต่อกัน (ยากที่สุด) | 42.3% | 33.1% |
แบบฝึกหัดของเรามี "การจัดตัวเลือกที่ยากที่สุด" มากกว่าหนังสืออ้างอิงประมาณ 9 เปอร์เซ็นต์ ไม่ใช่น้อยกว่า ส่วนสองหมวดตรงกลางนั้นแทบจะทับซ้อนกันโดยสมบูรณ์
กล่าวอีกนัยหนึ่ง: ช่องว่าง 23 เปอร์เซ็นต์นั้นคือภาพลวงตาที่เกิดจากการติดป้ายกำกับ ไม่ใช่ความแตกต่างของเนื้อหา ผู้สร้างข้อสอบของเรามีแนวโน้มที่จะติดป้ายข้อสอบที่มีไวยากรณ์ซับซ้อนซ่อนเงื่อนว่าเป็นข้อสอบยาก ในขณะที่เกณฑ์การประเมินของหนังสืออ้างอิงมองว่าภาระทางคำศัพท์และการใช้คำร่วมกันคือสิ่งที่ยากที่สุด — ทั้งสองฝ่ายกำลังใช้ไม้บรรทัดคนละเล่มวัดสิ่งเดียวกัน ป้ายกำกับของเราเป็นไปอย่างระมัดระวัง ไม่ใช่เนื้อหาของเราที่ไม่ยาก
นี่คือข้อสรุปที่สามารถสรุปได้ในปัจจุบัน และมีผลต่อภาพรวมไม่ใช่ข้อสอบรายข้อ: บนแกนเดียวที่เราสามารถวัดได้อย่างเป็นวัตถุวิสัย ข้อสอบของเรามีความยากอย่างน้อยเทียบเท่ากับหนังสืออ้างอิง และในหมวดหมู่ที่ยากที่สุด เรายังมีสัดส่วนมากกว่าด้วยซ้ำ เราจะไม่ฉวยโอกาสนี้อ้างว่า "เรายากกว่า TOEIC จริง" — เพราะนั่นจำเป็นต้องมีข้อ (3) และยังไม่มีใครสามารถพิสูจน์ข้อ (3) ได้
สิ่งที่เราไม่อ้าง
- เราไม่มีข้อมูลอัตราการตอบถูก ไม่มีเนื้อหาใดในนี้ที่สามารถยืนยันได้ว่าข้อสอบข้อใดข้อหนึ่งจะยากสำหรับผู้สอบจริงเท่ากับข้อสอบจริง
- เกณฑ์อ้างอิงคือข้อสอบจำลองจากสำนักพิมพ์ ไม่ใช่ ETS ข้อสรุปด้านรูปแบบมีความแข็งแกร่ง ส่วนข้อสรุปด้านความยากนั้นต่อยอดมาจากการตัดสินของบรรณาธิการ
- ไฟล์เสียงพาร์ทการฟังของเราสะอาดกว่าการสอบจริง เสียงฟังสร้างขึ้นด้วยประสาทซิมูเลชัน TTS ซึ่งเราสามารถควบคุมและวัดความเร็วการพูดตลอดจนการกระจายของสำเนียงได้ แต่การกลืนเสียง การพูดแทรกซ้อน และเสียงรบกวนบรรยากาศในการอัดเสียงจริงนั้น เรายังไม่สามารถจำลองได้ในขณะนี้ สิ่งนี้ทำให้การฟังของเราง่ายกว่าการสอบจริงเล็กน้อยในมุมที่ตัวชี้วัดของเราเองมองไม่เห็น — เรายินดีที่จะบอกคุณตรงๆ มากกว่าที่จะปล่อยให้คุณไปค้นพบในวันสอบจริง
- เราไม่ตัดสินความยากของข้อสอบข้อใดข้อหนึ่งโดยลำพัง เหตุผลคือเรื่องเครื่องชั่งน้ำหนักข้างต้น: ไม้บรรทัดนี้เชื่อถือได้เมื่อวัดกลุ่มประชากร แต่เชื่อถือไม่ได้เมื่อวัดรายบุคคล การเปรียบเทียบทั้งหมดคือ "องค์ประกอบของคลังข้อสอบสองคลัง" ไม่ใช่ "ข้อนี้ยากแค่ไหน"
- สเกลวัดทั้งสองท้ายที่สุดแล้วไม่ใช่สเกลเดียวกัน ระดับ สูง/กลาง/ต่ำ ของหนังสืออ้างอิงเป็นการตัดสินของบรรณาธิการ ส่วนของเราเป็นการตัดสินของผู้เขียน มีเพียงความแตกต่างขนาดใหญ่เท่านั้นที่เหมาะแก่การนำไปปฏิบัติ ความแตกต่างเพียงเล็กน้อยถือเป็นสัญญาณรบกวน (Noise)
สิ่งที่จะทำให้เรื่องนี้มีความแน่นอนยิ่งขึ้น
เรียงลำดับตามคุณค่า:
- อัตราการตอบถูกจากผู้เรียน นี่ต่างหากคือการวัดที่แท้จริง ผลการทำข้อสอบรายข้อกำลังได้รับการสะสมโดยไม่ระบุตัวตน สิ่งที่ขาดคือจำนวน เมื่อถึงวันนั้น ไม้บรรทัดเชิงโครงสร้างชุดนี้จะได้รับการปรับเทียบใหม่โดยข้อมูลจริง — หรือกระทั่งถูกแทนที่
- ส่วนต่างระหว่างคะแนนประเมินกับคะแนนอย่างเป็นทางการ ทุกครั้งที่ผู้เรียนกรอกคะแนนอย่างเป็นทางการกลับเข้ามา เราจะสามารถตรวจสอบได้ว่า "การประเมินของเราสามารถติดตามคะแนนอย่างเป็นทางการได้ใกล้เคียงภายในกี่คะแนน" ซึ่งต้องการตัวอย่างเพียงไม่กี่สิบตัวอย่างก็คุ้มค่าแก่การนำมาอ้างอิงแล้ว
บทถัดไป
เมื่อมีพื้นฐานร่วมกันแล้ว บทความของแต่ละ Part ก็จะสามารถเข้าสู่หัวข้อของตัวเองได้โดยตรง: ความยากของ Part นั้นมาจากไหนอย่างเป็นรูปธรรม และเมื่อรู้แล้วคุณควรทำข้อสอบอย่างไร
- Part 1: คำบรรยายภาพ ความยากอยู่ที่ "Aspect" ของประโยค — ข้อแตกต่างขั้นต่ำระหว่างสภาวะกับการกระทำ
- Part 2: ถาม-ตอบ ความยากอยู่ที่รูปแบบโจทย์และระดับความอ้อมของคำตอบ
- Part 3/Part 4: บทสนทนาและการพูดคนเดียว ความยากอยู่ที่ข้อสอบเชิงอนุมาน ภาพประกอบตาราง และข้อสอบวัดเจตนาผู้พูด
- Part 5: เติมคำในประโยคเดี่ยว ความยากเกือบทั้งหมดอยู่ที่การจัดเรียงตัวเลือกทั้ง 4 ตัวเลือก
- Part 6: เติมคำในย่อหน้า ความยากอยู่ที่ความต่อเนื่องข้ามประโยคและประโยคแทรก
- Part 7: การอ่าน ความยากอยู่ที่ระยะห่างของการพาราเฟรส (Paraphrase Distance) — คำตอบที่ถูกต้องแทบจะไม่ใช้คำซ้ำกับเนื้อเรื่องเลย
ครึ่งหลังของทุกบทความจะนำเอาแหล่งที่มาของความยากใน Part นั้นมาอ่านย้อนกลับ เพื่อเปลี่ยนให้เป็นกลยุทธ์ในการทำข้อสอบ: ทุกเทคนิคที่ใช้ทำให้ข้อสอบยากขึ้น ต่างบอกใบ้ล่วงหน้าว่าคำตอบซ่อนอยู่ที่ไหน