บทความทั้งหมด · เผยแพร่เมื่อ 2026-08-04
ขอแก้ต่างให้ “การตะลุยโจทย์”: คำให้การจากวิตเกนสไตน์ นักภาษาศาสตร์ วิทยาศาสตร์ความจำ และ AI
คำว่า “ตะลุยโจทย์” ฟังดูเหมือนมีความผิดติดตัวมาตั้งแต่ต้น ทั้งชวนให้นึกถึงโรงเรียนกวดวิชา มรดกจากการศึกษาเพื่อสอบ และตัวการที่ทำให้คน “สอบได้คะแนนสูงแต่พูดอังกฤษไม่ได้” ราวกับว่าการเรียนภาษาที่แท้จริงอยู่ที่อื่น ส่วนการตะลุยโจทย์เป็นเพียงของทดแทนราคาถูก บทความนี้จะขอแก้ต่างให้การตะลุยโจทย์อย่างจริงจัง พยานที่ขึ้นให้การมีทั้งนักปรัชญาภาษาคนสำคัญที่สุดคนหนึ่งแห่งศตวรรษที่ยี่สิบ นักภาษาศาสตร์หลายคนที่ลงมือนับข้อมูลภาษาจริง ปรากฏการณ์ด้านความจำที่ผ่านการพิสูจน์มานานกว่าร้อยปี และพยานที่คาดไม่ถึงอีกหนึ่งราย นั่นคือตัวโมเดลภาษาขนาดใหญ่เอง ขอบอกคำตัดสินล่วงหน้าไว้ก่อนว่า การตะลุยโจทย์ไม่ใช่ทางอ้อมที่พาออกห่างจากการเรียนภาษา หากคุณยังย้ายไปอยู่ประเทศที่ใช้ภาษาอังกฤษไม่ได้ นี่คือเส้นทางที่ใกล้เคียงทางตรงที่สุดแล้ว
ข้อกล่าวหาคืออะไร
ลองฟังข้อกล่าวหาให้ครบถ้วนก่อน เพราะมันสมควรได้รับการพิจารณาอย่างจริงจัง
คำวิจารณ์มีใจความประมาณนี้ ภาษาเป็นสิ่งที่ใช้สื่อสาร ไม่ใช่ใช้สอบ การนั่งทำข้อสอบปรนัยทั้งวันฝึกได้เพียง “เทคนิคทำข้อสอบ” ไม่ว่าจะเป็นการตัดตัวเลือก การจับคู่คำสำคัญ หรือสัญชาตญาณต่อรูปแบบโจทย์ แต่ไม่ได้ฝึกตัวภาษาเอง นี่จึงเป็นเหตุผลที่ผู้สอบในเอเชียตะวันออกมักถูกมองว่า “คะแนนสูงแต่พูดไม่ได้” และเป็นเหตุผลที่ “การตะลุยโจทย์” ฟังดูคล้ายความหมกมุ่นกับการสอบที่ไม่ค่อยดีต่อสุขภาพ มากกว่าจะเป็นการเรียนรู้อะไรสักอย่าง
ข้อกล่าวหานี้ฟังดูหนักแน่น เพราะมีสมมติฐานหนึ่งซ่อนอยู่เบื้องหลัง และมันดูเหมือนเป็นเรื่องที่เห็นได้ชัดในตัวเองว่า
ภาษาคือชุดกฎบวกกับคลังคำศัพท์ เมื่อเชี่ยวชาญกฎแล้ว คุณก็ “รู้” ภาษานั้น ส่วนโจทย์มีไว้เพียงวัดว่าคุณรู้หรือไม่ การวัดซ้ำไม่ได้ทำให้สิ่งที่ถูกวัดดีขึ้น
ถ้าสมมติฐานนี้จริง การตะลุยโจทย์ก็น่าสงสัยอยู่ไม่น้อย เพราะตรวจสุขภาพหนึ่งร้อยครั้งก็ไม่ได้ทำให้ร่างกายแข็งแรงขึ้น
ปัญหาคือสมมติฐานนี้ผิด และการล้มล้างมันคือหนึ่งในการเปลี่ยนจุดยืนที่โด่งดังที่สุดในประวัติศาสตร์ปรัชญาศตวรรษที่ยี่สิบ
นักปรัชญาผู้เปลี่ยนใจ
วิตเกนสไตน์เขียนหนังสือสองเล่มซึ่งสะท้อนมุมมองต่อภาษาสองแบบ และเล่มที่สองมีไว้รื้อถอนสิ่งที่เล่มแรกเสนอ
เล่มแรก Tractatus Logico-Philosophicus (ปกรณ์ตรรกปรัชญา) เสนอว่าแก่นแท้ของภาษาคือตรรกะ ประโยคคือภาพแทนข้อเท็จจริง และเมื่อวิเคราะห์โครงสร้างทางตรรกะจนกระจ่าง ภาษาก็จะโปร่งใส ตอนตีพิมพ์หนังสือเล่มนี้ เขาเชื่อว่าตนแก้ปัญหาทางปรัชญาเสร็จหมดแล้ว จึงออกไปเป็นครูประถมในชนบทออสเตรีย ลองสังเกตความคล้ายคลึงระหว่างแนวคิดนี้กับสมมติฐานในหัวข้อก่อนหน้า: หากภาษาลดรูปเหลือระบบกฎอันกระชับได้จริง “การเรียนกฎ” ย่อมเป็นทางตรง ส่วน “การสัมผัสภาษาปริมาณมาก” ก็เป็นเพียงทางอ้อมที่เทอะทะ
จากนั้นเขาก็เปลี่ยนใจ นักปรัชญาที่หักล้างตัวเองต่อสาธารณะนั้นหาได้ยาก คนส่วนใหญ่ใช้ทั้งชีวิตปกป้องงานที่เขียนในวัยหนุ่ม แต่งานที่วิตเกนสไตน์หักล้างกลับเป็นผลงานสร้างชื่อของตนเอง Philosophical Investigations (การสืบสวนทางปรัชญา) ในช่วงหลังรื้อจุดยืนเดิมแทบทีละข้อ จนเหลือข้อเสนอหลักว่า ความหมายของคำไม่ได้อยู่ในคำนิยาม แต่อยู่ในการใช้จริงภายในภาษา ภาษาไม่ใช่ระบบตรรกะที่ลอยอยู่กลางอากาศ แต่เป็น “เกมภาษา” นับไม่ถ้วนซึ่งฝังตัวอยู่ในชีวิตประจำวัน การจินตนาการถึงภาษาหนึ่งก็คือการจินตนาการถึงรูปแบบชีวิตแบบหนึ่ง
เขายังทิ้งข้อโต้แย้งที่สำคัญต่อผู้เรียนเป็นพิเศษไว้ด้วย ภายหลังเรียกกันว่า “ปฏิทรรศน์การทำตามกฎ” กฎใดก็ตามที่เขียนอธิบายไว้อย่างชัดเจนก็ยังไม่อาจกำหนดวิธีนำตัวเองไปใช้ได้ทั้งหมด คุณต้องมีความสามารถในการ “รู้ว่าจะใช้กฎนี้อย่างไร” อยู่เสมอ และความสามารถนั้นไม่ใช่กฎอีกข้อ แต่เป็นสัมผัสที่ฝึกขึ้นจากการลงมือทำ หากแปลเป็นภาษาของการเตรียมสอบ กฎทุกข้อในหนังสือไวยากรณ์ล้วนสมมติว่าผู้อ่านได้เห็นตัวอย่างมามากพอแล้ว กฎคือการจัดระเบียบย้อนหลัง ไม่ใช่เครื่องกำเนิดล่วงหน้า
สิ่งที่น่าสนใจที่สุดคือคำที่เขาเลือกใช้บรรยายจุดเริ่มต้นของภาษา เมื่อกล่าวถึงการเรียนภาษาแม่ของเด็ก เขาใช้คำเยอรมันว่า Abrichtung ซึ่งโดยทั่วไปใช้หมายถึง การฝึกสัตว์ และใกล้เคียงกับการ “ฝึกซ้ำ” ในภาษาไทย ตามมุมมองของเขา การสอนภาษา “ไม่ใช่การอธิบาย แต่คือการฝึก” นักปรัชญาภาษาที่ได้รับการยกย่องว่าลุ่มลึกที่สุดคนหนึ่งแห่งศตวรรษที่ยี่สิบ เลือกอุปมาที่ใกล้กับ “การตะลุย” มากกว่า “การอธิบาย” อย่างเห็นได้ชัดเมื่อต้องบรรยายการเรียนภาษา
สำหรับการเรียนภาษา พวกเราเห็นด้วยกับแนวคิดของ วิตเกนสไตน์ ในยุคหลังที่ว่า ภาษาของมนุษย์ไม่สามารถสรุปย่อให้อยู่ในกฎไวยากรณ์ไม่กี่ข้อได้ วิวัฒนาการหลายร้อยปีทำให้ทุกภาษามีการใช้ที่ไม่ได้เป็นไปตามหลักตรรกะ ตัวอย่างเช่น คุณสามารถเข้าใจคำว่า give และคำว่า in ได้เป็นอย่างดี แต่ก็ไม่มีทางเดาได้เลยว่าเมื่อประกอบกันเป็น give in จะหมายถึง "ยอมจำนน" หากภาษานั้นมีเหตุผลจริงๆ มันคงยอมจำนน (give in) ต่อคุณไปตั้งนานแล้ว
นักภาษาศาสตร์นับมาแล้ว: เนื้อแท้ของภาษาคือธรรมเนียมการใช้
ปรัชญาชี้ทิศทาง ส่วนภาษาศาสตร์ให้ตัวเลข
ในปี 1983 Pawley และ Syder เสนอข้อสังเกตที่วงการไม่อาจหลีกเลี่ยงได้นับแต่นั้นว่า ประโยคส่วนใหญ่ที่กฎไวยากรณ์สร้างขึ้นนั้น “ถูกไวยากรณ์ทุกประการ แต่ไม่มีใครพูดแบบนั้น” หากต้องการถามเวลา ไวยากรณ์ก็อนุญาตทั้ง "What is the hour?" และ "How late is it?" (ซึ่งบังเอิญตรงกับตรรกะของภาษาดัตช์) ทุกประโยคมีรูปแบบถูกต้อง แต่มีเพียง "What time is it?" เท่านั้นที่เป็นภาษาอังกฤษ ความคล่องแคล่วของเจ้าของภาษาไม่ได้เกิดจากการคำนวณกฎแบบทันทีทันใด แต่เกิดจากการหยิบสำนวนสำเร็จรูปจาก คลังธรรมเนียมการใช้ ขนาดมหึมา
ต่อมาภาษาศาสตร์คลังข้อมูลได้แปลงเรื่องนี้เป็นตัวเลข หลังพิจารณาข้อมูลภาษาจริง Sinclair เสนอ “หลักสำนวน” ว่า หลักข้อแรกของการใช้ภาษาไม่ใช่การประกอบคำอย่างเสรีตามกฎ แต่คือ การเลือกจากชิ้นส่วนกึ่งสำเร็จรูป Erman และ Warren (2000) ลงมือนับจริง ๆ แล้วพบว่า หากหยิบภาษาอังกฤษจริงมาสักช่วงหนึ่ง ประมาณครึ่งหนึ่ง จะประกอบขึ้นจากชุดคำสำเร็จรูปทั้งขนาดเล็กและใหญ่เหล่านี้ งานทั้งเล่มของ Wray (2002) ก็ได้ข้อสรุปเดียวกันว่า ลำดับคำแบบสูตรสำเร็จไม่ใช่เศษริมขอบของภาษา แต่คือเนื้อแท้ของมัน
และธรรมเนียมเหล่านี้เองที่ไม่อาจอนุมานด้วยตรรกะได้
- heavy rain เปลี่ยนเป็น strong rain ไม่ได้ แต่ strong coffee ก็เปลี่ยนเป็น heavy coffee ไม่ได้เช่นกัน
- “ตัดสินใจ” ใช้ make a decision แต่ “ทำการบ้าน” ใช้ do homework
- วิธีตอบรับคำขอ "Would you mind closing the window?" คือ "Not at all" ตามตรรกะหมายถึง “ฉันไม่รังเกียจเลย” แต่ตามธรรมเนียมหมายถึง “ได้ ฉันจะปิดให้”
- เมื่อถูกถามว่า "You haven't sent the report, have you?" ภาษาอังกฤษตอบตามข้อเท็จจริงว่า "No" (ยังไม่ได้ส่ง) แต่สัญชาตญาณภาษาไทยจะตอบว่า “ใช่ (ยังไม่ได้ส่ง)” คือเห็นด้วยกับข้อความเดิม ไม่มีฝ่ายใดมีตรรกะมากกว่าอีกฝ่าย ทั้งสองเป็นเพียงธรรมเนียมคนละชุด
ทีนี้ลองดูว่า TOEIC ทดสอบอะไร Part 5 ทดสอบคำที่ใช้ร่วมกันและสำนวน Part 2 ทดสอบธรรมเนียมการโต้ตอบ Part 3 และ 4 ทดสอบแบบแผนประจำของบทสนทนาในที่ทำงาน ส่วน Part 6 และ 7 ทดสอบถ้อยคำสำเร็จรูปในจดหมายธุรกิจอย่าง "Please find attached" และ "effective immediately" สิ่งเหล่านี้ไม่ใช่เกร็ดจุกจิกเพื่อสอบ แต่คือเนื้อแท้ของภาษา ซึ่งก็คือครึ่งหนึ่งที่นักภาษาศาสตร์นับพบ คลังข้อสอบ TOEIC ที่ดีจึงเป็นเสมือน “หนังสือรวมธรรมเนียมการใช้ภาษาอังกฤษในที่ทำงาน” เพียงแต่จัดหน้าให้อยู่ในรูปข้อสอบปรนัย
สมองเรียนรู้เช่นนี้อยู่แล้ว: ความถี่และสถิติ
เมื่อธรรมเนียมการใช้ไม่อาจอนุมานได้ ก็ต้องซึมซับผ่านการพบเจอ โชคดีที่สมองถูกสร้างมาเพื่อการนี้โดยเฉพาะ
การทดลองคลาสสิกของ Saffran, Aslin และ Newport (1996) พบว่า ทารกวัยแปดเดือนซึ่งได้ฟังกระแสพยางค์ประดิษฐ์ต่อเนื่องเพียงสองนาที สามารถแยกขอบเขตของ “คำ” ได้จากสถิติว่าพยางค์ใดมักตามหลังพยางค์ใด สมองคือเครื่องจักรทางสถิติ และเครื่องจักรทางสถิติมีเชื้อเพลิงเพียงอย่างเดียวคือขนาดตัวอย่าง
ทฤษฎีการเรียนรู้ภาษาจากการใช้ของ Tomasello เชื่อมหลักนี้เข้ากับการได้มาซึ่งภาษา เด็กไม่ได้รับไวยากรณ์ชุดหนึ่งแล้วค่อยนำไปใช้ แต่ค่อย ๆ อนุมานโครงสร้างที่เป็นนามธรรมมากขึ้นจากเหตุการณ์การใช้ภาษาที่เป็นรูปธรรมครั้งแล้วครั้งเล่า Nick Ellis (2002) ขยายแนวคิดนี้ไปยังภาษาที่สอง การเรียนภาษาต่างประเทศของผู้ใหญ่ส่วนใหญ่ก็เป็น การนับสถิติของข้อมูลรับเข้าโดยไม่รู้ตัว เช่นกัน ทุกครั้งที่พบภาษาคือการขีดเพิ่มอีกหนึ่งแต้มให้กับคำที่มักปรากฏร่วมกันหรือโครงสร้างบางแบบ ความถี่ไม่ใช่ปัจจัยเสริม แต่เป็นปัจจัยหลัก
เรื่องนี้ยังอธิบายคำแนะนำที่ทุกคนเห็นพ้องอยู่แล้วว่า “วิธีเรียนภาษาที่ดีที่สุดคือย้ายไปอยู่ที่นั่น” การเรียนแบบแช่ตัวได้ผลไม่ใช่เพราะมีภาษาอังกฤษลอยอยู่ในอากาศ แต่เพราะ ปริมาณที่ได้รับ การอาศัยอยู่ท่ามกลางภาษาทำให้คุณพบตัวอย่างธรรมเนียมการใช้นับพันนับหมื่นแบบโดยไม่ต้องตั้งใจในแต่ละวัน เครื่องจักรทางสถิติจึงทำงานเต็มกำลัง วิตเกนสไตน์คงบอกว่าคุณได้เข้าไปร่วมในรูปแบบชีวิตนั้นแล้ว
หากย้ายไม่ได้ คุณก็ต้องจัดปริมาณให้ตัวเอง การอ่านอย่างกว้างขวางเป็นวิธีหนึ่ง การตะลุยโจทย์เป็นอีกวิธีหนึ่ง และดังที่จะเห็นในหัวข้อถัดไป วิธีหลังยังมีข้อได้เปรียบด้านประสิทธิภาพที่วัดผลได้ด้วย
วิทยาศาสตร์ความจำ: ทำแบบทดสอบดีกว่าอ่านซ้ำ และตอบผิดดีกว่าไม่เคยผิด
สมมติว่าคุณยอมรับว่าการสัมผัสภาษาปริมาณมากเป็นสิ่งจำเป็น ยังเหลืออีกคำถามหนึ่งว่า รูปแบบ ของการสัมผัสนั้นสำคัญหรือไม่ การอ่านบทความสิบชิ้นกับการตอบคำถามสิบข้อพร้อมคำอธิบายให้ผลเหมือนกันหรือเปล่า
คำตอบคือไม่เหมือน และทิศทางของผลลัพธ์อาจตรงข้ามกับสัญชาตญาณ หนึ่งในผลการวิจัยที่ได้รับการทำซ้ำอย่างหนักแน่นที่สุดในวิทยาศาสตร์ความจำคือ “ผลของการทดสอบ” Roediger และ Karpicke (2006) ให้ผู้เข้าร่วมศึกษาบทความเดียวกัน กลุ่มหนึ่งอ่านซ้ำหลายครั้ง อีกกลุ่มทำแบบทดสอบแทน หนึ่งสัปดาห์ต่อมา กลุ่มที่ถูกทดสอบจำได้ดีกว่าอย่างชัดเจน การอ่านซ้ำสร้างภาพลวงตาอันลื่นไหลว่า “ฉันรู้แล้ว” แต่ การดึงข้อมูลจากความจำ ต่างหากที่ทิ้งร่องรอยไว้ Karpicke และ Blunt (2011) แสดงผลที่ไปไกลกว่านั้นในวารสาร Science ว่า การฝึกดึงข้อมูลยังเหนือกว่าการทำแผนผังมโนทัศน์ ซึ่งถือเป็นเทคนิคการเรียนอันประณีตด้วยซ้ำ
Bjork สรุปปรากฏการณ์กลุ่มนี้ไว้ด้วยคำว่า “ความยากที่พึงประสงค์” ยิ่งเรียนแล้วรู้สึกราบรื่นเท่าไร สิ่งที่หลงเหลืออยู่ก็ยิ่งน้อย สิ่งที่สมองต้องออกแรงค้นคืนต่างหากจึงจะติดแน่น และการตอบโจทย์ก็เปลี่ยนทุกการพบเจอให้เป็นการดึงข้อมูล คุณเลื่อนผ่านไปเฉย ๆ ไม่ได้ แต่ต้องตัดสินใจเลือกคำตอบ
แม้แต่คำตอบผิดก็ยังมีคุณค่า งานของ Kornell และคณะพบว่า การเดาผิดก่อนแล้วจึงเห็นคำตอบที่ถูกต้องช่วยให้จำได้ดีกว่าการเห็นคำตอบโดยตรง ดังนั้นข้อที่ตอบผิดจึงไม่ใช่บันทึกแห่งความล้มเหลว แต่คือ บัญชีช่องว่างด้านธรรมเนียมการใช้ ของคุณ ข้อละหนึ่งรายการพร้อมพิกัดกำกับ หากคุณพลาด "meet a deadline" สักครั้งใน Part 5 ธรรมเนียมข้อนั้นจะถูกทำเครื่องหมายไว้ และครั้งต่อไปที่พบในอีเมลจริง มันจะไม่ใช่เสียงรบกวนเบื้องหลังอีกต่อไป
เมื่อนำข้อแนะนำของวิทยาศาสตร์การเรียนรู้มาวางเทียบกับสิ่งที่การตะลุยโจทย์มอบให้ จะพบว่าสองคอลัมน์ตรงกันอย่างแทบชวนให้เขิน
| สิ่งที่วิทยาศาสตร์การเรียนรู้แนะนำ | สิ่งที่การตะลุยโจทย์มอบให้ |
|---|---|
| สัมผัสธรรมเนียมการใช้จริงในปริมาณมาก | ทุกข้อคือตัวอย่างธรรมเนียมฉบับเข้มข้น ไม่ว่าจะเป็นจดหมายธุรกิจ สายจากลูกค้า หรือคำตอบโต้ที่เป็นธรรมชาติ |
| ดึงข้อมูลแทนการอ่านซ้ำ | ทุกข้อบังคับให้ตัดสินใจ การกวาดตาอ่านอย่างเฉื่อยชาไม่นับ |
| ข้อมูลป้อนกลับทันที | คุณรู้ทันทีว่าตอบถูกหรือผิด และคำอธิบายจะบอกว่าเพราะเหตุใด |
| เรียนรู้จากความผิดพลาด | คำตอบผิดชี้ตรงไปยังธรรมเนียมที่คุณยังไม่ได้ซึมซับ |
| เว้นระยะ | ห้าข้อบนรถไฟ สามข้อระหว่างต่อคิว กระจายไปตามวันต่าง ๆ อย่างเป็นธรรมชาติ และได้ผลกว่าการอัดรวดเดียวหนึ่งสัปดาห์ก่อนสอบ |
เมื่อแยกการ “ตะลุยโจทย์” ออกเป็นองค์ประกอบ จะได้ว่า การสัมผัสธรรมเนียมอย่างเข้มข้น × การบังคับดึงข้อมูล × ข้อมูลป้อนกลับทันที × การเว้นระยะอย่างเป็นธรรมชาติ ไม่มีองค์ประกอบใดเป็น “เทคนิคทำข้อสอบ” และทั้งสี่อย่างล้วนอยู่ในรายการที่วิทยาศาสตร์การเรียนรู้สั่งมา
เหตุใดโมเดลภาษาขนาดใหญ่จึงต้องมีคำว่า “ใหญ่”
พยานฝ่ายมนุษย์ให้การจบแล้ว พยานคนสุดท้ายค่อนข้างพิเศษ เพราะไม่ใช่มนุษย์และเพิ่งเรียนรู้ที่จะพูดเมื่อไม่กี่ปีก่อน
ในตอนแรก นักวิทยาศาสตร์คอมพิวเตอร์พยายามสอนภาษาให้เครื่องจักรด้วยสมมติฐานเดียวกับตอนเปิดบทความนี้ เขียนไวยากรณ์เป็นกฎ สร้างคำศัพท์ไว้ในพจนานุกรม แล้วให้โปรแกรมวิเคราะห์และสร้างภาษาจากสิ่งเหล่านั้น แนวทางนี้ได้รับการศึกษาจริงจังมาหลายสิบปี และผลลัพธ์ก็เป็นที่รู้กันดี มันทำงานได้กับประโยคของเล่น แต่แตกเป็นเสี่ยงเมื่อเจอภาษาจริง กฎเพิ่มจำนวนไม่รู้จบ ข้อยกเว้นถูกนำไปปะข้อยกเว้นอีกที และไม่มีวันตามทันสิ่งที่ภาษาใช้จริง Fred Jelinek ผู้บุกเบิกการรู้จำเสียงพูด มีคำกล่าวติดตลกที่เล่าต่อกันมาว่า ทุกครั้งที่เขาไล่นักภาษาศาสตร์ออกหนึ่งคน ความแม่นยำในการรู้จำจะสูงขึ้น มุกนี้กลายเป็นป้ายบอกทางให้คนทั้งวงการในเวลาต่อมา
ความก้าวหน้าครั้งใหญ่ที่แท้จริงเกิดขึ้นเมื่อเลิกยึดกฎเป็นจุดเริ่มต้นอย่างสิ้นเชิง จากวิธีทางสถิติ สู่การเรียนรู้เชิงลึก และต่อเนื่องมาถึงโมเดลภาษาขนาดใหญ่ ที่คอมพิวเตอร์เพิ่งจัดการภาษาธรรมชาติได้เป็นเรื่องเป็นราว ไม่ใช่เพราะในที่สุดมีใครเขียนไวยากรณ์ครบถ้วน แต่เพราะโมเดลถูกแช่อยู่ในข้อความจริงหลายล้านล้านคำ และนับธรรมเนียมการใช้ทีละแบบ นี่คือเส้นทางเดียวกับที่วิตเกนสไตน์ชี้ไว้ Rich Sutton สรุปประวัติศาสตร์นี้ไว้ในบทความชื่อดัง "The Bitter Lesson" ว่า แนวทางที่ฝังความรู้ของผู้เชี่ยวชาญมนุษย์ลงในระบบพ่ายแพ้ครั้งแล้วครั้งเล่าให้แก่แนวทางที่เรียนรู้ด้วยตัวเองจากการคำนวณและข้อมูล
คำว่า “ใหญ่” นี่เองคือหัวใจ หากภาษาลดรูปเหลือกฎไม่กี่ข้อได้จริง โมเดลก็ไม่จำเป็นต้องใหญ่เลย เพียงติดตั้งกฎก็จบ โปรแกรมไม่กี่พันบรรทัดก็เหลือเฟือ ที่โมเดลต้องใหญ่และคลังข้อมูลต้องมหาสมุทร เพราะเนื้อแท้ของภาษาคือคลังธรรมเนียมการใช้ที่ลดทอนไม่ได้ และต้องจดจำทีละรายการ จำนวนพารามิเตอร์ของโมเดลขนาดใหญ่จึงอ่านได้ว่าเป็นคำตอบทางวิศวกรรมต่อคำถาม “ภาษาหนึ่งมีธรรมเนียมการใช้มากเพียงใด” และคำตอบก็คือมากถึงระดับพันล้านหรือล้านล้าน
ยิ่งไปกว่านั้น ลองดูวิธีฝึกโมเดลเหล่านี้แล้วคุณจะรู้สึกคุ้นเคย ซ่อนคำถัดไป ให้โมเดลเดา ตรวจคำตอบ ปรับแก้ แล้วไปข้อต่อไป วันละหลายพันล้านข้อ วัตถุประสงค์การฝึกของ BERT มีชื่อเรียกตรงตัวในงานวิจัยว่า cloze task ซึ่งเป็นรูปแบบเดียวกับข้อสอบ TOEIC Part 5 และ Part 6 กล่าวอีกอย่างคือ โครงการขนาดใหญ่เพียงโครงการเดียวในประวัติศาสตร์ที่ประสบความสำเร็จในการสอนภาษาธรรมชาติให้แก่ “ผู้เรียน” ที่ไม่ใช่มนุษย์ ใช้วิธีตะลุยโจทย์ เพียงแต่ตะลุยในปริมาณระดับดาราศาสตร์
แน่นอนว่าสมองไม่ใช่ transformer และไม่ควรลากอุปมานี้ไปไกลเกินควร แต่ทิศทางของผลลัพธ์นั้นยากจะหลบเลี่ยง เครื่องจักรไม่มีปรัชญาและไม่มีความเห็นต่อวัฒนธรรมการเรียนของเอเชียตะวันออกหรือโลกตะวันตก มันเพียงรายงานว่าวิธีใดได้ผล เส้นทางที่พยายามอนุมานภาษาจากกฎล้มเหลว ส่วนเส้นทางที่ซึมซับธรรมเนียมในปริมาณมากประสบความสำเร็จ
สิ่งที่ต้องแยกให้ออก และสิ่งที่ต้องยอมรับ
คำแก้ต่างจะน่าเชื่อถือก็ต่อเมื่อขีดเส้นแบ่งให้ชัดเจน เริ่มจากแยกสองเรื่องนี้ก่อน
การตะลุยโจทย์ไม่ใช่การฝึกโครงสร้างประโยคแบบกลไก “การฝึกรูปแบบ” ตามแนวพฤติกรรมนิยมในทศวรรษ 1960 ซึ่งเปลี่ยนกรอบประโยคซ้ำไปมาโดยไม่ผูกกับความหมาย ถูกวงการสอนภาษาปฏิเสธไปอย่างถูกต้องแล้ว หากผู้วิจารณ์หมายถึงสิ่งนั้น พวกเขาก็พูดถูก แต่โจทย์ TOEIC ไม่ใช่สิ่งนั้น ทุกข้อต้องการให้คุณ ประมวลความหมาย อ่านข้อความหรือฟังบทสนทนา แล้วตัดสินความหมายที่ได้รับ ตามคำของ Krashen นี่คือ “ข้อมูลภาษาที่เข้าใจได้” คลังข้อสอบที่ดีจึงเป็นกองข้อมูลภาษาที่เข้าใจได้ เรียงตามระดับความยาก และแนบคำอธิบายมาด้วย
ในแบบทดสอบความเข้าใจ “การเตรียมสอบ” กับ “การเรียนรู้” แทบเป็นเรื่องเดียวกัน TOEIC L&R ไม่มีเรียงความให้ท่องแม่แบบ ไม่มีข้อเขียนให้เดาทาง ข้อสอบสองร้อยข้อถามเพียงสองเรื่องว่า คุณเข้าใจสิ่งที่อ่านหรือไม่ และเข้าใจสิ่งที่ฟังหรือไม่ ในการสอบที่วัดความเข้าใจ เทคนิคทำข้อสอบที่ดีที่สุดก็คือความเข้าใจนั่นเอง นี่คือเหตุผลเชิงโครงสร้างที่ทำให้ TOEIC เหมาะแก่การตะลุยโจทย์ เส้นทางสู่คะแนนกับเส้นทางสู่ภาษาเป็นเส้นเดียวกันอย่างหาได้ยาก
จากนั้นต้องยอมรับสามเรื่อง
- การตะลุยโจทย์ไม่ได้ฝึกการผลิตภาษา สมมติฐานผลผลิตของ Swain และสมมติฐานปฏิสัมพันธ์ของ Long ต่างชี้ว่า หากต้องการพูดและเขียน คุณต้องลงมือพูดและเขียนจริง การตะลุยโจทย์ดูแลด้านข้อมูลรับเข้า ส่วนด้านผลผลิตต้องจัดแยกต่างหาก (พูดตามตรง TOEIC L&R ก็ทดสอบเฉพาะด้านข้อมูลรับเข้าอยู่แล้ว)
- การจำเฉลยไม่ถือเป็นการตะลุยโจทย์ หาก “ตะลุย” หมายถึงจำว่า “ข้อนี้ตอบ B” ฝ่ายวิจารณ์ก็ชนะเต็มประตู การเรียนรู้อยู่ภายในตัวโจทย์ ทั้งบทอ่านที่ต้องอ่าน เสียงที่ต้องฟัง คำอธิบายที่ต้องศึกษา และข้อผิดที่ต้องย้อนกลับไปทบทวน สิ่งที่คุณตะลุยคือภาษาอังกฤษในโจทย์ ไม่ใช่ตัวอักษรข้างหมายเลขข้อ
- คุณภาพของโจทย์กำหนดคุณภาพของสิ่งที่ได้สัมผัส สิ่งที่คุณพบซ้ำในปริมาณมากคือภาษาภายในโจทย์ ดังนั้นภาษานั้นต้องเป็นภาษาอังกฤษที่ใช้จริง คลังข้อสอบคุณภาพต่ำเท่ากับบังคับให้คุณพบธรรมเนียมที่ไม่มีอยู่จริงครั้งแล้วครั้งเล่า ซึ่งเลวร้ายยิ่งกว่าไม่ตะลุยเลย นี่คือเหตุผลที่เราจัดการเรื่องระดับความยากและความเป็นต้นฉบับเสมือนเป็นปัญหาทางวิศวกรรม (ดูวิธีการได้ที่ ภาพรวมความยาก)
บทส่งท้าย: ตะลุยได้อย่างสบายใจ
กลับมาที่ข้อกล่าวหาแรกเริ่มว่า “การตะลุยโจทย์เป็นเพียงการเตรียมสอบ ไม่ใช่การเรียนรู้” ตอนนี้เราตอบได้ครบถ้วนแล้ว
หากภาษาเป็นเพียงชุดกฎจริง ข้อกล่าวหานี้ก็ถูกต้อง เพราะการวัดไม่ได้ทำให้สิ่งที่ถูกวัดดีขึ้น แต่นักปรัชญาคนหนึ่งใช้ชีวิตครึ่งหลังชี้ให้เห็นว่าภาษาไม่ใช่สิ่งนั้น นักภาษาศาสตร์นับพบว่าธรรมเนียมการใช้กินพื้นที่ครึ่งหนึ่งของภาษาจริง นักจิตวิทยาพิสูจน์ว่าการตอบคำถามทิ้งร่องรอยมากกว่าการอ่านซ้ำ และการตอบผิดสอนได้มากกว่าการเรียนที่ไม่เคยผิด ส่วนวิศวกรก็มอบหลักฐานมีชีวิต ผู้เรียนเพียงรายเดียวที่มนุษย์สอนภาษาธรรมชาติให้สำเร็จ ถูกฝึกด้วยการตะลุยโจทย์ในปริมาณระดับดาราศาสตร์ คำให้การจากทั้งสี่ทางชี้ไปยังข้อสรุปเดียวกันว่า งานหลักของการเรียนภาษาคือการพบเจอวิธีที่ภาษานั้นถูกใช้จริง ในปริมาณมาก ซ้ำแล้วซ้ำเล่า และพร้อมข้อมูลป้อนกลับ ซึ่งการตะลุยโจทย์ทำหน้าที่นี้ได้ทั้งประหยัดและยอดเยี่ยม
ภาษาไม่ยอมฟังเหตุผล ทางเลือกเดียวของคุณจึงมีเพียงไปพบมันบ่อย ๆ การตะลุยโจทย์คือวิธีนัดหมายการพบเจอเหล่านั้น จะบนรถไฟ ระหว่างต่อคิว หรือเมื่อมีมือว่างเพียงข้างเดียวก็ได้
แอป พิชิต 990 ของเรามีชื่อภาษาจีนว่า 單手刷990 ซึ่งแปลได้ประมาณว่า “ตะลุยโจทย์สู่ 990 ด้วยมือเดียว” คำว่า “ตะลุยโจทย์” อยู่ในชื่ออย่างเปิดเผย ไม่ใช่การเยาะตัวเอง แต่คือจุดยืนของเรา