บทความทั้งหมด · เผยแพร่เมื่อ 2026-08-27

ใบคะแนน TOEIC มีมากกว่าคะแนน: ABILITIES MEASURED คืออะไร และมันช่วยปรับเทียบคะแนนประเมินของคุณอย่างไร

บนใบคะแนน TOEIC ใต้ตัวเลขคะแนนสองตัวที่พิมพ์ตัวโต มีแถวกราฟแท่งแนวนอนที่คนส่วนใหญ่มองผ่านครั้งเดียวแล้วไม่กลับมาดูอีกเลย — ABILITIES MEASURED เปอร์เซ็นต์ตอบถูกของความสามารถสิบด้าน บทความนี้จะอธิบายว่าทำไมแถบเหล่านั้นจึงเป็นส่วนที่มีข้อมูลหนาแน่นที่สุดของใบคะแนนทั้งใบ และเมื่อคุณกรอกคะแนนจริงเข้า พิชิต 990 แอปนำมันมา "ปรับเทียบ" คะแนนประเมินของคุณอย่างไร — คงรูปแบบจุดแข็งและจุดอ่อนที่สั่งสมจากการฝึกหลายเดือนไว้ และปรับเฉพาะระดับโดยรวมให้ตรงกับผลคะแนนทางการ เราขอยอมรับตรง ๆ ด้วยว่า เวอร์ชันแรกของเราจัดการเรื่องนี้ผิดไป

ตอนท้ายของบทความ พิชิต 990 ประเมินคะแนน TOEIC ของคุณอย่างไร เราให้สัญญาไว้ข้อหนึ่ง: เมื่อผลสอบจริงทยอยเข้ามา การประเมินจะยิ่งแม่นยำขึ้น บทความนี้คือภาคต่อของสัญญานั้น — ใบคะแนนมาถึงแล้ว แล้วยังไงต่อ?

ลองวาดฉากให้ชัดเจน คุณฝึกกับแอปมาสามเดือน ตอบคำถามรวมหลายร้อยข้อจาก Part ต่าง ๆ แอปบอกว่า Part 5 ของคุณอยู่ที่ 85% ส่วน Part 7 อยู่ที่ 55% แถมวาดแผนภูมิเรดาร์ให้ด้วย แล้วคุณก็ไปสอบ TOEIC จริง สองสามสัปดาห์ต่อมาใบคะแนนส่งมาถึง ตอนนี้ในมือคุณมีข้อมูลเกี่ยวกับ "ความสามารถภาษาอังกฤษของคุณ" อยู่สองชุด ชุดหนึ่งคือโปรไฟล์ละเอียดที่สั่งสมจากการฝึกหลายร้อยข้อ อีกชุดคือตัวเลขทางการที่มีตราประทับของ ETS สองชุดนี้แทบจะไม่มีทางตรงกัน

แอปควรเชื่อชุดไหน?

สองวิธีที่คิดได้ทันที ผิดทั้งคู่

วิธีที่หนึ่ง: ยึดใบคะแนนเป็นหลัก — เขียนทับทั้งหมด คะแนนทางการย่อมมีน้ำหนักกว่าการประเมินของเราแน่นอน — งั้นก็ลบการประเมินทิ้ง เริ่มใหม่จากใบคะแนน ปัญหาคือใบคะแนนมีตัวเลขแค่สองตัว — การฟังหนึ่ง การอ่านหนึ่ง มันไม่รู้ว่า Part 5 ของคุณแข็งกว่า Part 7 ตั้งสามสิบจุดเปอร์เซ็นต์ ยิ่งไม่รู้ว่าคุณทำชุดบทอ่านเดี่ยวได้ดี แต่กลับทำชุดบทอ่านสามบทไม่ได้ — ข้อมูลพวกนี้ใช้เวลาสามเดือนกับอีกหลายร้อยข้อกว่าจะได้มา ตัวเลขสองตัวบรรจุไม่หมด การเขียนทับการประเมินก็คือการโยนของมีค่าที่สุดที่แอปมีทิ้งไป

วิธีที่สอง: ใบคะแนน "ไว้อ้างอิงเฉย ๆ" — การประเมินคงเดิม สัญชาตญาณตรงกันข้าม: เชื่อโมเดลของตัวเองต่อไป แต่ในบทความก่อนเรายอมรับไปแล้วว่า ค่าคงที่ของโมเดลมาจากการใช้เหตุผล ไม่ได้ปรับจากข้อมูลจริง ความยากของคลังข้อสอบเรากับข้อสอบจริงมีความคลาดเคลื่อน และความคลาดเคลื่อนนั้นต่างกันไปตามแต่ละคน ถ้าแอปบอกว่าคุณได้ 750 แต่ใบคะแนนบอก 680 การแสดง 750 ต่อไปไม่ใช่ความมั่นใจ — คือการอุดหู

สองวิธีต่างทิ้งข้อมูลไปคนละครึ่ง ส่วนคำตอบที่ถูกซ่อนอยู่ในข้อสังเกตข้อเดียว: ข้อมูลสองชุดนี้เก่งกันคนละเรื่อง

ใบคะแนนรู้ "ระดับความสูง" ประวัติการฝึกรู้ "แนวสันเขา"

ลองนึกภาพความสามารถของคุณเป็นเทือกเขา: เจ็ด Part คือยอดเขาเจ็ดยอดที่สูงต่ำต่างกัน

ประวัติการฝึกของคุณ — หลายร้อยข้อ กินเวลาหลายสัปดาห์ บันทึกทีละข้อ — ได้วาดแนวสันเขาของเทือกเขานี้ออกมา: ยอดไหนสูง หุบไหนต่ำ ต่างกันเท่าไร แนวสันเขานี้ละเอียดถึงขั้นแยกชุดบทอ่านเดี่ยว ชุดบทอ่านคู่ และชุดบทอ่านสามบทของ Part 7 ออกเป็นความชันสามแบบได้ แต่มันมีจุดอ่อนติดตัวมาแต่กำเนิดอยู่ข้อหนึ่ง: ระดับความสูงของแนวสันเขาทั้งเส้นอาจถูกกำกับไว้ผิด ข้อสอบของเราไม่ได้ออกโดย ETS การปรับเทียบความยากจึงเลี่ยงความคลาดเคลื่อนเชิงระบบไม่ได้ — รูปทรงสันเขาของคุณถูกต้อง แต่ทั้งเทือกอาจถูกวาดสูงไปหรือต่ำไปหลายสิบเมตร

ใบคะแนนตรงกันข้ามพอดี คะแนนของ ETS ผ่านการเทียบมาตรฐานขนาดใหญ่ — มันคือความจริงเรื่องระดับความสูง แต่กับแนวสันเขา มันแทบจะเงียบสนิท: การฟังหนึ่งตัวเลข การอ่านหนึ่งตัวเลข — มีแค่ "ยอดเขาเฉลี่ย" สองยอดเท่านั้น

ดังนั้นวิธีที่ถูกจึงมีทางเดียว: ใช้ใบคะแนนปรับเทียบระดับความสูง ใช้ประวัติการฝึกรักษาแนวสันเขา

ABILITIES MEASURED คืออะไร?

แต่ใบคะแนนก็ไม่ได้เงียบเรื่องแนวสันเขาไปเสียทั้งหมด — และนี่คือจังหวะที่แถบซึ่งถูกมองข้ามเหล่านั้นได้ออกโรง

ครึ่งล่างของใบคะแนน TOEIC ฉบับทางการ (ฉบับกระดาษ — ตามกำหนดการทางการของไต้หวัน จะส่งไปรษณีย์ราววันทำการที่ 16 หลังสอบ ส่วนการเช็กคะแนนออนไลน์เปิดตั้งแต่วันทำการที่ 10 แต่เห็นเฉพาะคะแนน) พิมพ์คำว่า ABILITIES MEASURED: การฟังห้าหัวข้อ การอ่านห้าหัวข้อ แต่ละหัวข้อมีเปอร์เซ็นต์ตอบถูก มันไม่ได้แบ่งตาม Part แต่แบ่งตาม "ความสามารถ" — ห้าหัวข้อของการฟังคร่าว ๆ คือ "จับใจความบทสนทนาสั้น" "จับใจความบทสนทนายาว" "ฟังรายละเอียดบทสนทนาสั้น" "ฟังรายละเอียดบทสนทนายาว" "ฟังความหมายแฝงของผู้พูด" ส่วนห้าหัวข้อของการอ่านคือ "การอนุมาน" "การหาข้อมูลเฉพาะ" "การเชื่อมโยงข้อมูลข้ามประโยคข้ามบทความ" "คำศัพท์" "ไวยากรณ์"

ตัวเลขสิบตัวนี้ ETS คำนวณจากข้อสอบชุดที่คุณทำจริง ๆ — การฟังหนึ่งร้อยข้อ การอ่านหนึ่งร้อยข้อ พูดอีกอย่างคือ นี่คือข้อมูลแนวสันเขาฉบับทางการแบบหยาบ หน้ากรอกคะแนนของ พิชิต 990 ตอนนี้มีส่วนที่กดขยายได้ เพื่อให้คุณกรอกเปอร์เซ็นต์ทั้งสิบค่านี้ สิบแถวในแอปตั้งใจใช้ถ้อยคำตรงตามที่พิมพ์บนใบคะแนน เรียงตามลำดับการพิมพ์บนใบคะแนน คุณถือใบคะแนนไว้ในมือแล้วกรอกจากบนลงล่างได้เลย ทั้งสิบช่องล้วนไม่บังคับ — กรอกได้กี่ช่องนับเท่านั้น ไม่กรอกเลยสักช่องก็ยังได้

การปรับเทียบคำนวณอย่างไร?

สามขั้น

ขั้นที่หนึ่ง: รักษาแนวสันเขา จุดตั้งต้นของแต่ละ Part คืออัตราตอบถูกที่คุณฝึกออกมาเอง — ไม่ใช่ค่าเฉลี่ยจากใบคะแนน คุณถนัด Part 5 แต่ไม่ถนัด Part 7 ใช่ไหม? หลังปรับเทียบก็ยังเป็นเช่นนั้น

ขั้นที่สอง: นำผลวิเคราะห์ความสามารถมารวมเข้าไป — ในฐานะหลักฐาน ไม่ใช่ความจริง ตรงนี้มีรายละเอียดที่มองข้ามง่าย: จำนวนข้อที่อยู่เบื้องหลังเปอร์เซ็นต์สิบตัวนั้นต่างกันมาก ในข้อสอบหนึ่งชุด Part 1 มีแค่ 6 ข้อ แต่ Part 3 มีถึง 39 ข้อ — ฉะนั้นแถบที่ว่าด้วย "ฟังรายละเอียดบทสนทนาสั้น" มีหลักฐานรองรับบางกว่าที่เห็นมาก เรานำค่าความสามารถแต่ละค่าไปรวมกับค่าประเมินของ Part ที่เกี่ยวข้อง โดยถือเสมือนว่าเป็นข้อมูลสังเกตใหม่ตามจำนวนข้อนั้น และให้น้ำหนักเท่ากับจำนวนข้อที่เกี่ยวข้องในข้อสอบ: หลักฐานของ Part 3 ถูกนำเข้าด้วยน้ำหนัก 39 ข้อ ส่วน Part 1 แค่ 6 ข้อ และอีกฟากของตาชั่งคือประวัติการฝึกของคุณเอง — ถ้า Part ใดมีข้อมูลจากการฝึกที่มีน้ำหนักเทียบเท่าหลายสิบข้อแล้ว ตัวเลขความสามารถจะแค่ดันการประเมินไปนิดหนึ่ง ไม่ใช่แทนที่ทั้งหมด กลับกัน ผู้ใช้ใหม่ที่เพิ่งเริ่มและแทบไม่มีบันทึก ตัวเลขความสามารถก็แทบจะชี้ขาดทุกอย่าง สูตรเดียวกันครอบคลุมผู้ใช้ทั้งสองแบบโดยอัตโนมัติ ไม่มีเงื่อนไขแยก "ผู้ใช้ใหม่หรือเก่า" ที่ไหนเลย

ขั้นที่สาม: เลื่อนทั้งหมวดไปพร้อมกัน ให้ตรงกับระดับความสูง เมื่อสองขั้นแรกเสร็จ ให้บวกค่าชดเชยเท่ากันกับค่าประเมินของทุก Part ในหมวดนั้น จนคะแนนการฟัง (หรือการอ่าน) ที่คำนวณย้อนกลับจากการประเมิน เท่ากับพอดี กับคะแนนทางการที่คุณกรอก ขั้นนี้แม่นยำทางคณิตศาสตร์ — เพราะจำนวนข้อของทุก Part ในแต่ละหมวดรวมกันได้หนึ่งร้อยพอดี เมื่อเพิ่มทุก Part ขึ้นหนึ่งจุดเปอร์เซ็นต์ จำนวนข้อที่คาดว่าจะตอบถูกของทั้งหมวดก็เพิ่มขึ้นหนึ่งข้อพอดี — ดังนั้นไม่ว่ารูปทรงในขั้นก่อนหน้าจะขยับอย่างไร ตัวเลขที่คำนวณย้อนกลับตอนท้ายย่อมเป็นตัวเลขบนใบคะแนนของคุณเสมอ คะแนนทางการคืออำนาจสูงสุดเสมอ ผลวิเคราะห์ความสามารถรับหน้าที่แค่จัดสรร ไม่แตะยอดรวม

แผนภูมิเรดาร์ก็ใช้ตรรกะเดียวกัน: ความสามารถสิบด้านของ ETS กับหกแกนของเรดาร์หกเหลี่ยมในแอปจับคู่กันแทบหนึ่งต่อหนึ่ง ("ไวยากรณ์" คู่กับไวยากรณ์ "การเชื่อมโยงข้อมูล" คู่กับการอนุมาน…) ผลวิเคราะห์ที่คุณกรอกจึงดันเรดาร์ไปทางใบคะแนนด้วย — ดัน ไม่ใช่เขียนทับ

เวอร์ชันแรกของเราทำผิด

พูดตรง ๆ: เวอร์ชันแรกของฟีเจอร์นี้ใช้ "วิธีที่หนึ่ง" ข้างต้นเป๊ะ ๆ กรอกคะแนนปุ๊บ การประเมินทั้งหมดถูกลบแล้วสร้างใหม่ สำหรับผู้ใช้ใหม่ที่เริ่มจากศูนย์ไม่มีปัญหา — เพราะไม่มีแนวสันเขาให้รักษาตั้งแต่แรก แต่สำหรับคนที่ฝึกมาหลายเดือน นี่เท่ากับเอาบันทึกหลายร้อยข้อไปแลกกับตัวเลขสองตัว หลังปล่อยฟีเจอร์ เราลองไล่สถานการณ์ "ฝึกสามเดือนแล้วไปสอบ" ด้วยตัวเอง พบว่าไม่ถูกต้อง และภายในไม่กี่วันก็เปลี่ยนมาเป็นวิธีปรับเทียบแบบปัจจุบัน ขอบันทึกไว้ตรงนี้: แม้แต่ข้อมูลที่เป็นทางการก็อาจลบข้อมูลที่มีค่าทิ้งได้ — "น่าเชื่อถือกว่า" ไม่ได้แปลว่า "ควรเขียนทับ"

สองสัปดาห์หลังสอบ แอปจะเตือนคุณ

ยังมีปัญหาที่รากฐานกว่านั้น: คนส่วนใหญ่ไม่รู้ด้วยซ้ำว่าใบคะแนนมีค่าพอจะกรอกเข้าแอป พฤติกรรมเดิมของแอปคือ — พอวันสอบผ่านไป ตัวนับถอยหลังบนหน้าแรกก็เงียบหายไป แล้วก็ไม่มีอะไรเกิดขึ้นอีกเลย ราวกับการสอบไม่มีบทต่อ

ตอนนี้ ตั้งแต่สองสัปดาห์หลังวันสอบ (จังหวะที่คะแนนออนไลน์เช็กได้แล้ว ฉบับกระดาษก็ใกล้ถึง) ถ้าคุณยังไม่กรอกผลของรอบนั้น หน้าแรกจะปรากฏการ์ดใบหนึ่ง: "ใบคะแนนมาถึงแล้วหรือยัง?" แตะแล้วเปิดหน้ากรอกคะแนนทันที — คะแนน ผลวิเคราะห์ความสามารถ แล้วเลยไปถึงการวางเป้าหมายราย Part สำหรับการสอบครั้งถัดไป ต่อเนื่องรวดเดียว ไม่อยากสนใจก็ปิดได้ แอปจะไม่ถามซ้ำสำหรับการสอบครั้งเดิม และเมื่อลงทะเบียนสอบครั้งถัดไป ระบบจะเปิดใช้การเตือนสำหรับครั้งนั้นอีกครั้ง การเตือนจะปรากฏถึงแค่สามเดือนหลังสอบเท่านั้น — ผ่านไปสามเดือนแล้วค่อยมาถาม "ใบคะแนนถึงหรือยัง" ฟังดูเหมือนแอปไม่เคยใส่ใจคุณเลย

ข้อจำกัดที่ขอพูดตรง ๆ

ตามธรรมเนียม ขอระบุขีดจำกัดให้ชัด

  • ตารางจับคู่ความสามารถกับ Part คือดุลยพินิจของเรา ไม่ใช่สูตรของ ETS ETS ไม่เปิดเผยว่าข้อไหนถูกนับเข้าความสามารถใด ดังนั้น "ไวยากรณ์ 70% ควรแบ่งให้ Part 5 เท่าไร Part 6 เท่าไร" คือน้ำหนักที่เราใช้เหตุผลกำหนดเอง แต่การเลื่อนขนานในขั้นที่สามรับประกันว่า ต่อให้ตารางจับคู่คลาดเคลื่อนแค่ไหน มันกระทบได้แค่รูปทรงของการจัดสรร ขยับคะแนนรวมที่คำนวณย้อนกลับไม่ได้
  • การสอบหนึ่งครั้งคือการสุ่มตัวอย่างหนึ่งครั้ง คนเดียวกันสอบใหม่ห่างกันสองสัปดาห์ คะแนนย่อมแกว่งอยู่แล้ว — สภาพร่างกายวันนั้น ชุดข้อสอบที่จับได้ ดวงตอนเดา ใบคะแนนคือจุดข้อมูลเดี่ยวที่ดีที่สุดที่หาได้ แต่ก็ยังเป็นจุดข้อมูลเดี่ยว นี่คืออีกเหตุผลที่เรานำผลวิเคราะห์ความสามารถมาประกอบกับค่าประเมิน แทนที่จะใช้มันแทนค่าประเมินเดิม
  • ข้อมูลในใบคะแนนอาจล้าสมัยได้ คะแนนที่คุณกรอกอาจมาจากการสอบเมื่อสามสัปดาห์ก่อน และสามสัปดาห์นั้นคุณก็ยังฝึกต่อ การปรับเทียบถือมันเป็น "หลักฐาน ณ ปัจจุบัน" จึงมีเหลื่อมเวลาเล็กน้อย — แต่ก็ยังดีกว่าเมินเฉยหรือลอกมาทั้งดุ้น และการฝึกหลังจากนั้นก็ยังอัปเดตการประเมินตามปกติ
  • คะแนนที่คุณกรอกกำลังให้คะแนนเราด้วย ทุกครั้งที่คุณกรอกคะแนนทางการ ก่อนจะปรับเทียบอะไร แอปจะบันทึกไว้เป็นการภายในว่า "การประเมินของเราตอนนั้น" ห่างจาก "คะแนนจริง" เท่าไร คำสัญญาในบทความก่อน — "ค่าคงที่จะถูกขัดเกลาด้วยข้อมูลจริง" — เดินเครื่องด้วยระยะห่างเหล่านี้เอง ขณะที่คุณปรับเทียบแอป คุณก็กำลังปรับเทียบเราด้วย

การกรอกคะแนนอยู่ในขั้นตอนปรึกษาเป้าหมายของ พิชิต 990 ซึ่งเปิดจากการ์ดเป้าหมายบนหน้าแรก (เส้นทางนี้จะรันการปรับเทียบตามบทความนี้ทันที และตั้งแต่สองสัปดาห์หลังสอบ หน้าแรกก็จะเสนอให้เอง) ส่วน "ตั้งค่า → กรอกคะแนน TOEIC ทางการ" จะบันทึกไว้ก่อน แล้วนำไปใช้ในการปรึกษาครั้งถัดไป อยากเข้าใจโมเดลเบื้องหลังตัวประเมิน — การแจกแจงภายหลังแบบเบย์เซียนที่ลดน้ำหนักข้อมูลตามเวลา ช่วงความไม่แน่นอน ทำไมไม่ใช้ IRT — อ่านได้ที่ พิชิต 990 ประเมินคะแนน TOEIC ของคุณอย่างไร

← บทความทั้งหมด