記事一覧 · 公開日 2026-08-04

Part 3 の難しさは、「誰が何を言ったか」に「答えが言い換えられていること」が重なる――測定でわかったこと、そしてそれに沿って直した二つの点

好奇心のある方に向けた技術解説です。難易度シリーズは Part ごとに一篇ずつ、順に公開しています。今回は第三篇です。Part 5 の難しさは四つの選択肢に集中し、Part 7 の難しさは文章全体に散らばっています。Part 3 の会話問題はその中間です。90 秒にも満たない会話に三問が付き、その難しさは「聞いているときに何が起きるか」と「読んでいるとき、選択肢がどう書き換えられているか」の両方から生まれます。この記事では、私たちの問題バンクと市販模試 6 回分を<strong>項目ごとに測定して比較</strong>しました――会話の長さ、発話の交代回数、話者数、設問タイプの組み合わせです。そのうえで、どこが一致し、どこを意図的に難しくしているかを説明します。測り終えて見つかった穴は二つ――問いが浅すぎること、答えが推測しやすすぎること――でした。現在はどちらも修正済みです。問題バンクでは 575 問と 434 組の選択肢を書き換え、さらに 108 本の会話を新たに作りました。統計の知識は必要ありません。

まず Part 3 がどんな形をしているか

本試験の Part 3 は 13 本の会話、各 3 問、計 39 問です――リスニングセクションで最も問題数が多い部分です(100 問中 39 問)。各会話は一度しか流れず、三問は問題冊子に印刷されています。聞きながら答えなければなりません。

この部分について、私たちの問題バンクには現在 694 本の会話、2,082 問があります(この記事の執筆中に 586 本、1,758 問からここまで増えました。理由は後ほど説明します)。しかし、「いくつあるか」は重要ではありません。大切なのは、形が正しいかです。そこで、市販模試 6 回分の Part 3 の会話原稿をすべて取り出し(参照資料の詳細と限界については、後に一節を割いて説明します)、同じ物差しで両方を測りました。

項目 参照模試(6 回、69 本) 私たちの問題バンク(586 本)
一会話あたりの語数 平均 85(中央値 87、範囲 45–110) 平均 87(中央値 89、範囲 43–148)
一会話あたりの発話数 平均 4.5 回 平均 5.4 回
三者会話 13.0%(各回 13 本中 1–2 本) 25.6%(150 本)

一行目は安心できる結果です。長さはほぼ同じでした。85 語対 87 語、中央値は 87 対 89。Part 3 の会話をどれくらいの長さにするべきかについて、私たちは外していません。(唯一の違いは上限です。私たちの最長は 148 語、参照模試は 110 語。ごく一部の長い会話は、私たちの問題バンク特有の裾の長さであり、出題構成の一部ではありません。)

本当の違いは二行目と三行目にあり、どちらも同じことを示しています。

  • 同じ語数でも、私たちは発話をより細かく区切っています。 平均で一回近く多くなっています。語数が変わらず発話数が増えるということは、一回の発話が短くなり、話者の交代がより頻繁になるということです。
  • 三者会話は参照模試のほぼ二倍です。 本試験の出題構成では各回 13 本中 1–2 本ですが、私たちの問題バンクでは四分の一を占めます。

この二点を合わせたものが「追跡コスト」です。そして三者会話が実際に難しいことは、推測ではなく測定で確認できました。三者会話の問題では 29.1% が難問とされ、二者会話では 19.1% だけです。人が一人増えると、やることも一つ増えます。内容を聞くだけでなく、誰が言ったかを覚えなければなりません。設問が直接「男性は何を提案していますか」「二人目の女性は何を心配していますか」と尋ねるからです。

言い換えると、私たちの Part 3 は追跡が難しく、情報量が多いわけではありません。この結論を覚えておけば、後ほど出てくる「参照模試より 8 ポイント難しい」という数字も謎ではなく、説明のつく結果になります。

抽出方法に関する但し書き:参照模試の会話原稿は解説書に印刷されており、テキストレイヤーがなかったため、画像認識で復元しました(二段組みなので、文字の座標から組み直さなければ二列が同じ行として読み取られてしまいます)。6 回分には計 78 本あり、そのうち 69 本(88%)の復元に成功しました。残りは認識ミスのため、信頼できる形で切り出せませんでした。上表の参照値は、この 69 本を集計したものです。


一つの会話は、どこから難しくできるのか

以下は、Part 3 の各問題について私たちが実際に計算または付与した主な特徴です。このシリーズの他の記事と同様、この一覧は後ほど、そのまま解答戦略として読み替えられます。

1. 話者数と発話数――追跡コスト

二者対三者、そして一つの会話が何回の発話に分かれているかについては、第一節で見たとおりです。三者会話の難しさは情報量ではなく、帰属にあります。同じ一言でも誰が発したかによって、三問のうち少なくとも一問の答えが変わります。発話数はその連続版です。話者が交代するたびに、注意の向け先を付け直さなければなりません。

緊張した Happysaur が3人の話者から伸びる言葉の帯を整理し、誰が何を言ったかを追っている。

2. 設問タイプ――何をするよう求められるか

私たちは設問文から、各問題が実際に何を問うているかを逆算するプログラムを書きました。これを私たちの問題バンク全体にかけ、参照模試 6 回分の Part 3、230 問にも同じようにかけました――同じプログラムを二つの問題群に使ってこそ、比較に意味があります。

設問タイプ 参照模試 書き換え前 書き換え後 やるべきこと
詳細問題 35.7% 52.8% 35.7% 会話で述べられた事実を一つ見つける
依頼/提案 11.7% 4.3% 11.6% 誰が誰に何をするよう求めたかを捉える
図表問題 7.8% 2.4% 7.8% 音声と印刷された図表を照合して答えを出す
理由問題(Why…?) 7.4% 16.4% 7.4% 因果関係を見つける。通常は二回の発話にまたがる
場所問題 6.5% 2.7% 6.4% 場面がどこかを判断する
次の行動(What will… do next?) 6.5% 4.4% 6.5% 会話が終わった後に起こることを捉える
推論問題 6.5% 1.1% 6.5% 二つの事実から、明言されていない結論を導く
発言意図問題 5.7% 0.9% 5.9% 「この発言は何を意味しているか」を考える
問題点(What problem…?) 4.3% 6.3% 4.2% 不満の対象や指摘された障害を捉える
身分問題 3.5% 1.1% 3.5% 話者が誰かを判断する
主題問題 3.0% 1.9% 2.9% 一つの発言ではなく、会話全体を要約する
目的問題 1.3% 1.8% 1.3% この電話/会話がなぜ行われているかを判断する
時間/数量問題 0% 3.8% 0.3% 一点の情報を拾う
推論型問題の合計 30.9% 12.6% 31.9%

この表は前節の表よりずっと重要です。示しているのが目盛りではなく、内容だからです。

書き換え前、参照模試の詳細問題は三分の一にすぎなかったのに、私たちの問題バンクでは半数を超えていました。 逆に、もう一段考える必要がある問題――推論、意図、主題、目的、次の行動、図表――は参照模試では 30.9% を占めるのに、私たちは 12.6% と半分にも届きませんでした。当時の結論はこうでした。本試験の出題構成では「聞き取ったうえで、もう一段考える」ことを求める割合が、私たちの二倍以上ある。

その版の修正はもう終わっています。上表の四列目が現在の問題バンクです。十四種類の設問すべてが参照値から 2 ポイント以内に収まり、推論型の合計は 31.9% 対 30.9% です。

この差を埋めるために、まったく異なる二つの方法を使いました。ここは明確にしておく価値があります。

  • 十一種類の設問は「別のことを尋ねる」ことで補いました。 同じ会話、同じ音声のまま、問題そのものを書き換えます――別のことを問い、まったく新しい選択肢を一組付けます。問題文の音声はそれぞれ独立した音声クリップなので、会話音声は一語も変えていません。こうしてできたものは本当に別の問題であって、「なぜ…?」を別の表現にしただけではありません。後者なら数字は見栄えがよくなっても、問題は難しくなりません。
  • 図表問題と発言意図問題は追加だけでは補えず、会話から書き直す必要がありました。 図表問題には、照合すべき情報の片側だけが会話で述べられている構造が必要です。意図問題には、字面の意味と本当の意味が異なる一言が必要です――既存の 49 万語の会話から、そのような言い回しは 2 か所しか見つかりませんでした。そのため、この二種類は新たに作った 108 本の会話(新録音声を含む)で追加しました。これが工程全体で最も時間のかかった部分です。

ついでに直したことが二つあります。時間/数量問題を 3.8% から 0.3% に減らしました(参照模試 6 回には一問もありません。6 回すべてで使われないのは偶然とは考えにくいでしょう――「彼らは何時に会うか」のような一点聞き取りは、むしろ Part 2 の仕事です)。もう一つは正解位置です。新しい問題では一時、正解の七割が A に偏っていましたが、今では四文字がそれぞれ四分の一です。

最後に、この分類器を真剣に扱う根拠となる、好ましい性質が一つあります。分類器は難易度ラベルを見ていないのに、そのラベルと一致する順序で設問タイプを並べました。発言意図問題は 96.7% が難問、推論問題は 58.6%、理由問題は 33.6% とされる一方、目的問題は 0.8%、数量問題は 0% にすぎません。答えを見ていない分類器がこの順序を再現できるからこそ、「設問タイプ」という特徴には本当に意味があると言えます。

(参照欄も画像認識で取得しました。6 回分で計 234 問、そのうち 230 問(98%)の復元に成功しています。二つの独立した裏付けにより、抽出結果が歪んでいないと考えています――プログラムが数えた図表問題はちょうど各回 3.0 問、意図問題は各回約 2.2 問で、以前まったく別の方法で測った出題構成上の割り当てと一致しました。)

3. 言い換え距離――正解の語句が原文からどれほど離れているか

これは Part 3 で最も厄介な要素であり、後ほど説明する第二の穴の主役です。

会話ではこう言っています。I'll revise the interview guide before tomorrow's sessions. 簡単すぎる選択肢はこうです。Revise the interview guide(そのまま)。 本試験の選択肢はこうなります。Update some materials――「revise」が「update」に、「interview guide」が「materials」に変わっています。意味は同じで、使う語はすべて違います。

違いは、前者ならキーワード照合で正解できる一方、後者は必ず意味を理解しなければならないことです。私たちは各問題について、選択肢と原文の語句の重なりを計算しました。

好奇心を見せる Happysaur が形の違う包みを開き、中の同じ木片を見比べる。言葉が違っても意味が同じ場合を表す。

4. 罠の密度――答えらしく見える誤答選択肢

言い換え距離の鏡像です。誤答選択肢に会話で実際に使われた語を入れ、キーワードを探す人を狙います。現在の問題バンクの平均値は、正解選択肢と原文の語句の重なりが 0.72、誤答選択肢が 0.21 です。この差は大きすぎます――まさにそこが問題です。次節で説明します。

5. 根拠の位置と問題の順序

私たちは各問題に根拠文(会話中のどの一文をもとに答えるか)を付けています。全問題にあり、カバー率は 100% です。アプリで解答した後、トランスクリプトのその一文が直接ハイライトされるのも、このためです。

根拠の位置がわかれば、とても実用的なことを測れます。三問の根拠は 94% が音声と同じ順序で現れます。第一問の答えは前半、第三問の答えは後半にあります。本試験も同じように設計されているので、これは私たちが簡略化した結果ではありません――利用できる規則です。解答戦略の節で使い方を説明します。

6. 図表問題と意図問題――構造上の固定枠

参照模試 6 回の間では、ばらつきがまったくありません。各回の Part 3 には 図表問題が 3 問、発言意図問題が 2 問あります。これは出題構成であって、偶然ではありません。

私たちの問題バンクには以前、どちらも一問もありませんでした。今は両方あり、さらに――問題数以上に重要なことですが――模擬試験ではこの割り当てに従って問題を抽出します。運任せではありません。ある設問タイプが問題バンクに存在していても、模試でまったく出会わないなら、ないのと同じです。


参照模試との比較でわかったこと:私たちのほうが難しい。それでも変えるつもりはない

目盛りは自分たちで発明するのではなく、外部の参照基準に合わせなければなりません。使用したのは『全新!新制多益 TOEIC 題庫解析 狠準 6 回』(Hackers Academia 著、國際學村出版)です――全 6 回分を収録し、すべての問題に出版社独自の難易度評価(高/中/低)が印刷されています。比較に使える専門家の判断が 1,200 件、すでに用意されていたわけです。

Part 3 の結果は次のとおりです。

低(簡単) 高(難しい)
参照模試(205 問) 41% 47% 12%
私たちの問題バンク 23.8% 54.5% 21.7%

私たちが難問とした問題は、参照模試より約 8 ポイント多くなっています。

このような差を見たとき、最初に問うべきなのは「調整するべきか」ではなく、「これは内容の差か、物差しの差か」です。このシリーズの Part 5 の記事でも、すでに同じことがありました。そこではラベル上、参照模試と大きく違って見えましたが、調べてみると問題の構造は少しも簡単ではありませんでした――違ったのは両者の「難しい」の定義であり、問題そのものではありません。まずここを区別し、そのうえで内容を動かすか決める。これはシリーズ全体で得た、最も実用的な教訓です。

Part 3 のこの 8 ポイントは Part 5 と逆方向ですが、私たちの対応はこうです。そのまま残します。

理由は二つあります。第一に、この二つの物差しはそもそも換算できません。一方は編集者の評価、もう一方は作問者の判断です。8 ポイントの差は、ノイズでも実際の差でも説明できる範囲にあります。第二に、こちらのほうが実際的です。練習問題が基準からどちらかに偏るなら、学習者にとって安全なのは難しい側です。本番より難しい問題で練習すれば、試験会場では余裕になります。逆なら不意打ちになります。

ではなぜ私たちのほうが難しいのか。第一節の表がすでに答えを示しており、「私たちの判定が厳しいから」と言うよりはるかに確かです。会話は参照模試より長くありませんが、発話数が多く、三者会話が二倍あります。 三者会話はそれ自体で難問が 10 ポイント多く(29.1% 対 19.1%)、その割合は私たちの問題バンクでは 25.6%、参照模試では 13.0% です。この構成比の差だけで、ラベル上の 8 ポイントの大半を説明できます。

言い換えれば、すべての問題をより意地悪に書いたのではなく、もともと難しい種類の会話を問題バンクに多く入れたということです。差の原因が「構成」であって「手口」ではないとわかって、初めて本当に調査が済んだと言えます――いつか元に戻すなら、変えるべきは三者会話の割合であって、個々の問題ではありません。

ただし、ここには当時きちんと言葉にしておく必要があった矛盾があります。次節への導入でもあります。ラベルでは私たちのほうが難しいのに、設問タイプの構成では私たちのほうが浅い。 同じ問題バンクでも、聞く側面(三者、多発話)は難しめで、問う側面(半数以上が詳細問題)は簡単めでした。どちらも測定結果であり、どちらも事実です。だからこそ、私たちは難易度ラベルを結論にしていません。ラベルが映すのは、作問者が感じた「聞いたときの複雑さ」であって、「どれほど難しい作業を要求する問題か」ではないからです。

正直な但し書き

  • 参照書は出版社の模擬試験で、ETS の公式教材ではありません。 形式面ではきわめて信頼できます(6 回の間でほぼばらつきがなく、公式の構成を忠実に再現した様子そのものです)。難易度については、実際の受験者の正答率ではなく、編集者の判断です。
  • Part 3 の難易度ラベルは作問者が付けたもので、規則から計算したものではありません。 ここが Part 3 と Part 1 の重要な違いです。Part 1 の各ラベルはプログラムが問題そのものから再計算し、問題バンクの 335 問すべてと一致していますが、Part 3 にはまだ同様の仕組みがありません。上の特徴一覧では、いくつか(話者数、長さ、設問タイプ、根拠位置、語句の重なり)をすでに測っていますが、ラベルを上書きする一つの難易度スコアにはまだ統合していません。したがって、Part 3 の難易度分布として語っているのは、作問者集団の判断の分布です。
  • もっと客観的な判定役を探そうとして、失敗したこともあります。 AI モデルを「模擬受験者」として参照模試を解かせ、その正答率が出版社の難易度順を再現できるか試す、という構想でした。できれば、二つの問題群を同時に測れる物差しになります。しかし結果は、能力が一桁違う二つのモデルがともに正答率 89.8%/89.9% で、しかも難易度にまったく反応しませんでした(相関係数はほぼ 0)。理由は難しくありません。学習者がつまずくのは単語や語の組み合わせの習得度ですが、実用に耐えるモデルならすでに備えています。この物差しは捨てましたが、記録しておく価値はあると考えています。
  • 本当の終着点はやはり正答率です。 匿名の解答統計が蓄積するにつれ、各問題には実際の p 値が徐々に得られます。それまでは、これが私たちにできる最も正直な測り方です。

自分たちで測って見つけた二つの穴は、どちらも埋めた

この節は、全体像まで見たい人のために書いています。上の 8 ポイントというラベルの差は、実はこの記事で最も重要でない数字です――物差しの問題だからです。本当の問題は二つあります。どちらも内容の問題であり、私たち自身が測って見つけました。

穴その一:問いが浅すぎた――今は修正済み

先ほどの設問タイプの表のことです。もともと詳細問題は 52.8%、参照模試は 35.7%。推論型問題の合計は 12.6%、参照模試は 30.9% でした。つまり、私たちの Part 3 をすべて解き終えた人が練習できる「聞き取った後に、もう一段考える」量は、本試験で求められる量の約四割しかありませんでした。会話の中から述べられた事実を一つ見つけることには非常に強くなりますが、推論、意図、「男性は女性に何をするよう求めていますか」のような統合が必要な問題の練習量は、ひどく足りませんでした。

現在は十四種類の設問すべてが参照値から 2 ポイント以内で、推論型の合計は 31.9% 対 30.9% です。方法は第 2 節で説明したとおり、575 問の書き換えに、108 本の新規会話と新規音声を加えました。その結果、問題バンクも 1,758 問から 2,082 問に増えました。

正直に明記しておくべきことがあります。この比較は私たち自身の分類器で測っています。同じプログラムを参照模試にもかけているため、両者の定義は一貫しています。しかし、あくまで設問文から逆算した分類であり、「実際にどれほど難しいか」から逆算したものではありません。設問タイプが揃ったからといって、難易度まで揃ったとは限りません――それは利用者の実際の解答データが戻ってくるまでわかりません。

穴その二:答えが推測しやすすぎた――こちらも修正済み

当時、Part 3 では 653 問(37%)の正解選択肢を、キーワード照合だけで当てられました。

これは scripts/option_source_overlap.py というスキャンプログラムの結果です。正解選択肢と音声トランスクリプトの語句の重なりを一問ずつ比較し、正解選択肢の重なりが三つの誤答選択肢より明らかに多ければフラグを付けます。新しい発見ではありません――この問題を最初に指摘したのは一人の利用者で、「意味を聞き取らなくても、キーワードを照合すれば答えられる問題がある」と報告してくれました。それを受けて大規模な書き換えを一度行い、Part 3 の選択肢を 576 個書き換えました(Part 4、Part 7 と合わせて 1,511 個)。

現在は 28 問(1.3%)で、この 28 問はすべて意図的に残したものです(理由は後述します)。本当に直すべき問題は、一問も残っていません。

この数字は二段階で下がりました。

  1. 前節の 575 問の書き換えで、ついでに半分以上を解消しました。 書き換えた各問題は、同じスキャナーの検査に合格しなければデータベースに入れないため、設問タイプを揃えるのと同時に、この問題も問題バンクの五分の一について解決しました。この節の作業を始める時点で、すでに 462 問(22.2%)まで減っていました。
  2. 残りの 434 問は、一問ずつ手で直しました。 方法は二つあり、重要なのは二つ目です。正解選択肢を言い換えます。それだけで足りない場合は、トランスクリプトの語句を誤答選択肢に渡します。本試験の選択肢はまさにこの形です――原文をそのまま写したものが罠であり、答えではありません。

実例を一つ挙げます。ケータリング注文についての会話で、男性が最後に「3 時までに部屋番号を送ってください。そうすれば注文を変更できます」と言います。問題は「女性は何を送るよう求められていますか」です。

書き換え前の四つの選択肢は、部屋番号/招待客リスト/支払いの領収書/メニューの価格表でした。「部屋番号」だけが音声に出てきて、他の三つは一語も出てきません。文の意味を理解する必要はなく、誰と誰が話しているかさえわからなくてもかまいません――聞こえた語を選択肢と照合すれば終わりです。

書き換え後の正解選択肢は「イベントが行われる場所」です。同じことを別の表現にしました。一方、誤答選択肢の一つを「ベジタリアン向け料理の数量」に変えました――これらの語はすべて音声に出ています(女性が少し前に、ベジタリアン向けを五食追加したいと言っています)し、内容もまったく不自然ではありません。今度は語が一致する選択肢が誤りのほうです。正解するには、男性が求めているのは部屋番号であって、料理の数量ではないと聞き取らなければなりません。

では、なぜその 28 問は直さないのか。 答えをそもそも言い換えられないからです。図表問題の四つの選択肢は、図表に印刷された各行のラベル(「六番コーン」「四番荷下ろしエリア」)なので、そのまま使う必要があります。地名、人名、金額も同様です。本試験でも同じ形で出題されます。私たちはそれらを accepted.json に登録し、一問ずつ理由を明記しました。これにより、スキャナーの数字に意味を持たせつつ、プログラムを黙らせるために質の悪い言い換えを強いることもありません。

測定の観点から言えば、正解選択肢と原文の語句の重なりは 0.72 から 0.39 に下がり、誤答選択肢は 0.25 です。二つの数字はすでに近く、冒頭で述べた「理想的な Part 3 の形」になっています。

もう一つ、正直に補足します。スキャナーに合格したことは、「共通語彙が答えを漏らさなくなった」と証明するだけで、問題が難しくなったことまでは意味しません。 本当の検証は、やはり利用者の正答率です。

この二つの穴は、もともと同じ問題の表裏でした。一方では十分に深く問わず、もう一方では答えを簡単に拾えるようにしていました。 二つを合わせると、「聞くと難しそうなのに、解くと簡単」な Part 3 になります――前節の矛盾そのものです。両方を埋めた今、その矛盾もなくなりました。

もう一つ、さらに難しい制約

私たちの問題バンクは、語域が均一すぎます。 会話と独話を合わせた 1,018 本(約 49 万語)のうち、慣用表現は 2 個だけで、「I guess」「to be honest」のような口語マーカーはゼロです。この事実は、発言意図問題を追加しているときに見つかりました。意図問題には「字面の意味と実際の意味が違う」引用可能な一言が必要なのに、見つからず、会話を書き直すしかなかったのです。つまり、欠けていたのは設問タイプそのものではなく、口語らしい緩さでした。

これは、第一の穴を埋めるのに時間がかかった理由も説明します。意図問題や推論問題に必要なのは、尋ね方を変えることだけではありません。会話そのものに、まず推論できる何かが必要です――最後の 108 本は、言い換えたのではなく、最初から書き直しました。この制約は、今後の新しいコンテンツにも引き続き当てはまります。


構造がわかったら:Part 3 をどう聞き、どう答えるか

上の特徴一覧を逆向きに読んでみましょう。

三問はリスニングのアウトライン――必ず先に読む

Part 3 で最も価値のある習慣は一つだけです。音声が始まる前に、三つの設問文を読み終えてください。 問題は冊子に印刷されており、規則上も認められています。そして、これがこのセクションの設計上の前提です。三問を読めば、人名を聞くのか、時間を聞くのか、誰かの提案を聞くのかがわかります。「会話全体を覚えようとする」状態から、「三つの特定の情報が出てくるのを待つ」状態に変わります。

前の問題の解説音声が流れていて、まだ時間があるうちに先を読んでください。これが Part 3 で最も重要なリズムです。

順序を信じる:94% の問題は音声どおりに進む

第一問の答えはほぼ必ず会話の前半にあり、第三問は後半にあります。だから、聞きながら下へ進んでください。第一問の答えを聞いたらすぐ選び、注意を即座に第二問へ移します。会話が終わってから第一問を思い出そうとしてはいけません――そのとき戦う相手は問題ではなく、記憶になります。

これは同時に、損切りの合図にもなります。会話がもう終わりかけているのに第一問の答えが見つからなければ、その一問は手放し、第二問と第三問を守ります。一つの会話で一問を落とすほうが、三問を落とすよりはるかにましです。

「誰が言ったか」も情報として覚える

設問には the man / the woman / the second speaker と書かれます。三者会話では特に重要です。実際には、提案、不満、約束のような発言を聞いたら、誰が言ったかも一緒に覚えてください(男性/女性、または何人目か)。内容が合っていても人を間違えれば、答えはやはり不正解です――これこそ、三者会話で難問が 10 ポイント増える理由です。

「聞こえたとおり」の選択肢を警戒する

これは罠の密度という特徴から学べることです。選択肢の語句が、たった今聞いたものと一字一句同じなら、まず疑ってください。 作問者は、時間に追われる人がキーワードに頼ると知っています。そこで最も手軽な罠は、原文の語を違う人物、違う時間、違う出来事につなぐことです。逆に、原文を徹底的に言い換えた選択肢が正解であることは少なくありません――本試験の正解はたいてい、そのような形をしています。

(だからこそ、前節の 653 問は私たちにとって深刻でした。私たちの問題バンクは現在も、この点で本試験の挙動と完全には揃っていません。)

特別な扱いが必要な三種類の問題

  • 次の行動問題(What will the man do next?)――答えはほぼ必ず最後の一、二文にあります。「I'll…」「Let me…」「I'd better…」が聞こえたら、それです。会話全体では力を抜いても、最後の二文では必ず意識を向けてください。
  • 意図問題(What does the woman mean when she says, "…"?)――引用された発言は字面上、たいてい何でもないものですが、本当の答えはその前後の一文にあります。引用符の中の語句をにらんで考えるのではなく、「彼女は何に応じてこの発言をしたのか」と考えてください。
  • 図表問題――音声が流れる前に図表を見て、その表の列が何を表しているか理解してください(時間と回? 価格とプラン?)。答えは必ず「音声が一方の列を、図表がもう一方の列を与える」形です。あなたの仕事は、それらを結ぶこと。先に表を読めば、始まる前に半分を終えたことになります。

最後に:ここではやり直せない

Part 3 は二度流れず、戻ることもできません。リスニングセクション全体は 45 分間、止まらずに進みます。一つの会話で遅れれば、その会話全体で遅れます。だから上の戦略に共通する目的は、実は一つだけです。常に次の問題にいて、前の問題に残らないこと。


一言でまとめると

Part 3 の難しさは、測定可能な三つの場所から生まれます。何人、何回の発話を追跡するか問題がどれほど難しい作業を求めるか、そして正解がどれだけ言い換えられているかです。

同じプログラムを私たちの問題バンクと市販模試 6 回分の両方にかけると、三つの答えはこうなりました。会話の長さは本試験の出題構成とほぼ同じですが、私たちは発話が細かく、三者会話は二倍です――これが難問が 8 ポイント多い理由を説明し、私たちはそのまま残すことにしました。設問タイプの構成では問いが浅すぎて、推論型問題は本来の割合の四割しかありませんでした。さらに選択肢の 37% は、キーワード照合だけで正解できました。後の二つは内容上の負債です。私たちは、直し終えてからではなく、この場でそれを書き残しました。

そして同じ一覧を逆向きに読めば、そのまま解答戦略になります。三問を先に読む、音声の順序どおりに進む、誰が言ったかを覚える、聞こえたままの選択肢を疑う。

← 記事一覧