所有文章 · 發布於 2026-08-27

多益成績單不只有分數:ABILITIES MEASURED 能力分析是什麼,怎麼用它校準你的預估分數

多益成績單上除了那兩個大字的分數,還有一排大多數人看一眼就略過的橫條圖——ABILITIES MEASURED,十項能力的答對率。這篇文章要說明:那排橫條其實是整張成績單上資訊密度最高的部分;以及當你把真實成績輸入單手刷990 時,app 如何用它「校準」你的預估分數——保留你幾個月練習累積出來的強弱形狀,只把整體高度對準官方的真相。我們也會坦白交代:第一版我們做錯了。

在〈多益預估分數怎麼算〉的結尾,我們許了一個願:等真實的考試結果進來,估計會愈來愈準。這篇文章就是那個願望的續集——成績單到了,然後呢?

先把場景講具體一點。你用 app 練了三個月,各大題答了幾百題;app 對你的 Part 5 說 85%、對 Part 7 說 55%,還畫了雷達圖。然後你去考了真正的多益,兩三週後成績單寄到。現在你手上有兩份關於「你的英文實力」的資料:一份是幾百題練習累積出來的精細側寫,一份是 ETS 蓋章的官方數字。它們多半不會完全一致。

app 該信哪一份?

兩個直覺的做法,都錯了

做法一:以成績單為準,整個蓋掉。 官方分數當然比我們的估計權威——那就把估計刷掉,從成績單重新開始。問題是,成績單只有兩個數字:聽力一個、閱讀一個。它不知道你的 Part 5 比 Part 7 強三十個百分點,更不知道你單篇閱讀還行、三篇閱讀就崩潰——這些是你三個月、幾百題練出來的資訊,兩個數字裝不下。蓋掉估計,等於把最值錢的東西丟了。

做法二:成績單僅供參考,估計照舊。 反過來,繼續相信自己的模型。但我們在上一篇就承認過:模型的常數是推理得來的,不是擬合出來的;我們題庫的難度和真實考試之間有落差,而且這個落差因人而異。如果 app 說你 750、成績單說 680,繼續顯示 750 不是自信,是裝聾。

兩個做法各丟掉一半的資訊。而正確答案藏在一個觀察裡:這兩份資料擅長的事情不一樣。

成績單知道「海拔」,練習紀錄知道「稜線」

把你的實力想成一段山脈:七大題是七座峰,各有高低。

你的練習紀錄——幾百題、跨越數週、逐題記錄——畫出了這段山脈的稜線:哪座峰高、哪座谷低、彼此差多少。這條稜線非常精細,精細到能分辨 Part 7 的單篇、雙篇、三篇是三種不同的坡度。但它有一個先天的弱點:整條稜線的海拔可能標錯了。我們的題目不是 ETS 出的,難度校準難免有系統性的偏移——你的稜線形狀是對的,整段卻可能畫高或畫低了幾十公尺。

成績單恰好相反。ETS 的分數經過大規模等化,是海拔的真相——但它對稜線幾乎沉默:聽力一個數字、閱讀一個數字,兩座「平均峰」而已。

所以正確的做法只有一種:用成績單校準海拔,用練習紀錄保留稜線。

Happysaur 專心移動整條高低不一的山稜,保留強弱差異,同時對準正式成績的整體高度。

ABILITIES MEASURED 是什麼?

不過成績單對稜線也不是完全沉默——這就輪到那排被略過的橫條上場了。

正式的多益成績單(紙本,依台灣官方時程約在考後第 16 個工作日寄出;線上查分則從第 10 個工作天開放,但只有分數)下半部印著 ABILITIES MEASURED:聽力五項、閱讀五項,每項一個答對率百分比。它們不是按 Part 劃分,而是按「能力」劃分——聽力那五項大致是「短對話抓大意」「長對話抓大意」「短對話聽細節」「長對話聽細節」「聽出言外之意」;閱讀那五項是「推論」「找特定資訊」「跨句跨篇整合」「字彙」「文法」。

這十個數字是 ETS 從你那一份考卷的一百題聽力、一百題閱讀裡算出來的——換句話說,它是官方版的、粗顆粒的稜線資訊。單手刷990 的成績輸入介面現在多了一個展開區塊,讓你把這十個百分比照抄進來。app 裡的十行文字刻意使用成績單上的原文措辭、依成績單的印刷順序排列,你拿著成績單從上抄到下就好。十格都是選填——抄幾格算幾格,一格不抄也行。

校準是怎麼算的?

三步。

第一步:保留稜線。 每個大題的起點是你自己練出來的答對率——不是成績單的平均值。你的 Part 5 強、Part 7 弱?校準之後依然如此。

第二步:把能力分析「摺進去」——當證據,不當真相。 這裡有個容易忽略的細節:十個能力百分比背後的題數差距很大。整份考卷裡 Part 1 只有 6 題,Part 3 卻有 39 題——所以成績單上關於「短對話聽細節」的那條橫條,背後的證據遠比你想的薄。我們把每個能力數字當成「若干題新觀察」摺進對應大題的估計裡,權重正是它在考卷上的題數:Part 3 的證據摺 39 題的份量,Part 1 只摺 6 題的份量。而你自己的練習紀錄站在天平另一端——如果你某大題已累積了幾十題的有效證據,能力分析會把估計推過去一點,而不是整個取代。反之,剛起步的新用戶沒什麼紀錄,能力分析就幾乎說了算。同一條公式,自動涵蓋兩種人,不需要任何「新舊用戶」的分支。

第三步:整段平移,對準海拔。 前兩步算完,把該節所有大題的估計加上同一個位移量,使推算出來的聽力(或閱讀)分數恰好等於你輸入的官方分數。這一步在數學上是精確的——因為各大題的考題數加起來剛好是一百,整段抬高一個百分點,節分數就恰好多一題——所以無論前面的形狀怎麼調,最後推回去的分數一定是成績單上的那個數字。官方分數永遠是最高權威;能力分析只負責分配,不負責總量。

雷達圖也用同樣的邏輯:ETS 那十項能力和 app 六角雷達的六軸幾乎一一對應(「文法」對「文法」、「跨句整合」對「推論」……),所以輸入的能力分析也會把雷達圖往成績單的方向推——推,而不是蓋。

Happysaur 思考後把成績單的新證據加入練習紀錄夾,保留原本累積的資料。

我們的第一版做錯了

坦白說:這個功能剛上線的第一版,用的正是前面說的「做法一」。輸入成績,整個估計蓋掉重來。對從零開始的新用戶這沒有問題——本來就沒有稜線可以保留——但對練了幾個月的老用戶,這等於把幾百題的紀錄換成兩個數字。上線後我們自己推演「練三個月再去考」的情境,發現不對,幾天內改成了現在的校準式做法。留在這裡當個紀錄:權威的資料也會刪掉有價值的資訊,「更權威」不等於「該覆蓋」。

考完兩週後,app 會提醒你

還有一個更根本的問題:多數人根本不知道成績單值得輸入。過去 app 的做法是——考試日期一過,首頁的倒數計時默默消失,然後什麼都沒有。彷彿考完試這件事沒有下文。

現在,考試日期過後兩週起(線上成績已可查詢、紙本也快到了的時間點),如果你還沒輸入這次的成績,首頁會出現一張卡片:「成績單到了嗎?」點下去直接開啟成績輸入——分數、能力分析、然後順勢重新規劃下一次考試的各 Part 目標,一氣呵成。不想理它可以關掉,同一次考試不會再問;下一次報名的考試會重新提醒。提醒只出現到考後三個月為止——三個月後才問「成績單到了嗎」,聽起來就像 app 根本沒在關心你。

誠實的但書

照例,把限制講清楚。

  • 能力對大題的對應是我們的判斷,不是 ETS 的公式。 ETS 不公開哪些題目算進哪項能力,所以「文法 70% 該分給 Part 5 多少、Part 6 多少」是我們推理出來的權重。但第三步的平移保證了:對應表再怎麼不準,也只會影響分配的形狀,動不了推回去的總分。
  • 一次考試就是一次抽樣。 同一個人隔週再考,分數本來就會浮動——當天的狀態、抽到的題本、猜題的運氣。成績單是最好的單一資料點,但它仍是單一資料點;這也是我們把能力分析「摺入」而非「取代」的另一個理由。
  • 成績單會過期。 你輸入的可能是三週前考的成績,而你這三週還在練。校準把它當作「此刻的證據」處理,略有時差——但比忽略它或全盤照抄都好,而且後續的練習會照常持續更新估計。
  • 輸入的成績同時也在給我們打分數。 每次你輸入官方成績,app 會在校準之前,私下記錄「我們當時的估計」與「真實分數」的差距。上一篇承諾過的「常數會隨真實資料精修」,靠的就是這些差距。你校準 app 的同時,也在校準我們。

成績輸入在單手刷990 首頁目標卡的諮詢流程中(這條路徑會立即執行本文的校準;考後兩週起首頁也會主動提醒),「設定 → 輸入正式多益成績」則先記錄下來、待下次諮詢時套用。想了解這套估計背後的模型——衰減式貝氏事後分布、不確定範圍、為何不用 IRT——請讀〈多益預估分數怎麼算〉。

← 所有文章