記事一覧 · 公開日 2026-08-04
Part 4 の難しさは独白の中ではなく、設問の中にある――測って見えた4種類の設問タイプと、それぞれの答え方
好奇心のあるあなたへの技術的な説明です。難度シリーズは各 Part につき1本ずつで、これは Part 4 の記事です。Part 5 の難しさは4つの選択肢をどう並べるかに集中しますが、Part 4 はちょうど別の状況です。同じ独白でも、組み合わせる設問が違えば、難度は何段階も変わります。この記事では、「何が1問を難しくするのか」をどう測定可能なものにしたのか、私たちがもともと正しいと思っていた答えを測ったら<strong>逆</strong>だったこと、市販の模擬試験セットと照合して何が見えたのか、そして(あなたにとって最も役に立つ)4種類の設問タイプを理解したあと、それぞれをどう聞き、いつ手放すべきかを説明します。統計の知識は一切いりません。
ただ力ずくで聞くしかないように見える設問タイプ
Part 4 はリスニングテストの第 71 から 100 問です。10本の独白があり、それぞれに3問ずつ付いています。内容は案内、留守番電話のメッセージ、放送、広告、ツアー案内の冒頭などです。
Part 3 と違う点は1つだけですが、その1つが重要です。2人目がいないことです。Part 3 では、1文を聞き逃しても、もう一人が別の言い方で確認してくれることがよくあります。Part 4 にはその安全網がありません。
だからこそ、多くの人の Part 4 対策は「たくさん聞く、少し速く聞く」になります。耳だけで耐えるしかない塊のように扱ってしまうのです。
しかし Part 4 には構造があります。そしてその構造は独白の中ではなく、設問の中にあります。同じ独白に付いた2つの設問を見てください。
独白: Welcome to the Fenwick Harbor walking tour. We'll start at the old customs house and finish out at the light station. I hope you all brought your walking shoes. The path out to the point is uneven in places, and there's no shuttle back.
設問 A: Where does the tour end? (A) At the customs house (B) At the light station (C) At a photography studio (D) At the water cart
設問 B: Why does the speaker say, "I hope you all brought your walking shoes"? (A) To warn that the route is long and rough (B) To recommend a nearby shoe shop (C) To explain a change to the dress code (D) To apologize for a cancelled shuttle
設問 A で求められていることは、独白の中から1文を見つけることです。finish out at the light station はそこにあります。聞こえたら終わりです。customs house が何なのかを完全に理解していなくても影響しません。
設問 B で求められていることはまったく違います。その文は見えているし、単語もすべて知っています。問われているのは字面の意味ではありません。その人がなぜその位置でその文を言ったのかです。そして答えは次の文(道がでこぼこしている、シャトルがない)にあり、その文自体にはありません。
同じ音声、同じ 30 秒でも、この2問が要求する作業は同じレベルではありません。ここに Part 4 の難しさがあります。そしてそれは1問ごとに測ることができます。
どう測ったか(1分版)
難度の正式な定義、なぜ ETS 以外はそれを手に入れられないのか、そしてそのため全員が代替指標を使うしかないことは、〈難度総論〉ですでに説明しました。ここでは Part 4 固有の部分だけを扱います。私たちが使った代替指標は何か、そしてなぜそれに根拠があるのかです。
方法は、「この1問があなたにどんな追加作業を求めているか」を、1問ごとに判定できる7つの特徴に分解することです。
| 特徴 | 判定方法 |
|---|---|
| 証拠が後半にある | 答えのある文が独白の最後の3分の1に出てくる |
| 意味の転換 | 答えの文自体に however / actually / instead のような前文を覆す標識がある |
| 統合が必要 | 答えに2文以上の情報が必要で、単独の1文ではない |
| 言い換え距離 | 正解選択肢の内容語の半分以上が、答えの文の中に出てこない――答えが言い換えられていて、丸写しではない |
| ひっかけ密度 | 誤答選択肢が2つ以上あり、その語が独白の中に実際に出てくる |
| 推理型設問 | 設問タイプが引用発話の意味、推論、図表対照、または次の行動である |
| 計算が必要 | 答えが計算で出す数字であり、その数字が最初から最後まで読み上げられない |
1問で3つ以上を数え、かつその中に少なくとも意味の転換、推理型設問、計算が必要の3つのうち1つがある場合だけ、難しいと判定しました。この条件を加えることは必要でした。そうしなければ、この等級は「独白が長い、答えが後ろにある」という単に時間がかかるだけで、本当に難しいわけではない設問で埋まってしまいます。
このルールには、検証可能な最低限のハードルがあります。それが出す順序が、出題者がこのルールをまったく見る前に付けた難度と対応していることです。実際の結果はこうでした。
| 特徴数 | 出題者に困難と標示された割合 |
|---|---|
| 0 個 | 7.9% |
| 1 個 | 14.6% |
| 2 個 | 35.6% |
| 3 個 | 51.3% |
| 4 個 | 100% |
単調増加です。両者は独立しているので、この線そのものが証拠です。
測って見えた4種類の設問タイプ
7つの特徴のうち、難度を最も左右するのは設問タイプ、つまり設問があなたに求める動作です。以下は、すべての Part 4 設問に対して出した分類です。括弧内は問題データベース内での比率で、「困難率」は出題者が独立に付けたものです。
1. gist questions(18.9%、困難率 0%)
この話の目的、主旨、話者は誰か、どこにいるかを問います。
設問: What is the purpose of the message? (A) To advertise a new service (B) To announce a planned power interruption (C) To collect a payment (D) To report a street light fault
答えはほぼ必ず最初の1から2文にあります。独白の冒頭はそもそも「これは何で、何をするためのものか」を示す必要があります。そうでなければ聞き手は話に入れません。
困難率 0%――purpose 0/88、main-idea 0/49、location 0/80。これは偶然ではなく、この設問タイプの性質です。証拠は常に最初にあり、常に1文だけで済み、ほとんど言い換えられません。3つの特徴が1つも成立しません。
2. detail questions(72.9%、困難率 14%)
実際に言われたことを問います。時間、場所、数量、聞き手に何をするよう求めているか、次の手順は何か。これが Part 4 の主力タイプです。
設問: What are listeners asked to do? (A) Wait until Thursday (B) Leave the unit unlocked (C) Telephone the shop today (D) Collect the part in person
答えは音声の中のどこかの1文にあります。難しいのは理解ではなく、正しいタイミングでまだ起きていることです。
このタイプの困難率が 0 ではない理由は、中に難度を本当に引き上げる2つの仕組みが隠れているからです。
仕組み1:意味の転換。 答えの文に however、actually、instead がある。
……originally asked for a plated salmon course. However, they switched to a vegetarian menu yesterday.
転換の前半は誰もが覚えてしまう版で、後半が本当の情報です。誤答選択肢は前半のために用意されています。この種の設問は、ひっかけ密度が構造的に高くなります。
仕組み2:少し計算させる。
独白: …confirming your cleaning appointment for Wednesday at nine fifteen A M. Please arrive ten minutes early… 設問: What time should the listener arrive? (A) At nine oh five (B) At nine fifteen (C) At nine twenty-five (D) At four
nine fifteen は必ず選択肢にあり、しかもあなたは今聞いたばかりです。答えはその読み上げられていない数字です。

3. graphic questions(2.7%、困難率 100%)
問題冊子に表、時刻表、またはリストが印刷されていて、設問文が Look at the graphic. で始まります。
表: North Depot — Morning Departures | 7:20 Via Ash Lane | 7:40 Direct | 8:00 Direct | 8:20 Via Ash Lane 独白: From Monday the seven forty service is withdrawn… 設問: Which departure will replace the withdrawn one? → 8:00
答えは音声の中にも、表の中にもなく、両者の交差部分にだけあります。音声は条件を1つくれます(7時40分が運休)。表は残りの情報をくれます。あなたはそれを自分でつなげる必要があります。困難率 100%、29 問すべてです。
4. intent & inference questions(5.5%、困難率 100% / 50%)
口に出されていないことを問います。形は2種類です。
引用発話の意味(困難率 100%)――設問文が独白中の1文を引用し、話者がどういう意味で言っているのかを問います。この記事の冒頭の設問 B そのものです。
推論(困難率 50%)――「次のうち何がおそらく真か」を問います。
独白: The seat belt sign remains on while we work our way up through this weather… 設問: What is probably true about the flight at the moment? (A) It has not yet reached a smooth altitude (B) It is about to land (C) It is delayed on the ground (D) It has changed its destination
「飛行機はまだ上昇中だ」と言っている文は1つもありません。「シートベルトサインがまだ点灯している、悪天候の中を進んでいる」ことから推論する必要があります。このタイプの言い換え距離は必然的に最大になります。正解選択肢で使われる語は、独白の中に1つも出てこないからです。
私たちは1つの特徴を逆に測っていた
上のリストを得る前に、私たちは一度間違えました。そしてその間違いは、単独で説明する価値があります。
私たちのもともとの仮説は、多くの人と同じでした。Part 4 の難しさは情報量にあり、時間、便名、階数が詰め込まれた案内ほど怖い、というものです。この仮説は私たち自身の設計文書にまで書き込まれ、「Part 4 を最もよく表す」特徴として挙げられていました。
そこで、各独白について 100 字あたりに数字、時間、固有名詞がいくつあるかを数え、難度と照合しました。
| 出題者が付けた難度 | 100 字あたりの数字/時間/固有名 |
|---|---|
| 簡単 | 3.57 |
| 中等 | 3.12 |
| 困難 | 2.82 |
完全に逆でした。 私たちが困難と標示した設問ほど、独白は簡単な設問よりも疎だったのです。
考えてみれば、不思議ではありません。番号が密に並ぶ案内では、話者は聞き手に理解してもらうためにゆっくり話し、区切り、「まず/次に」のような道しるべを使います。そして設問はたいてい、読み上げられた数字の1つを問うだけです。その1つをつかめば、ほかは背景です。逆に、言葉が少なく、文がゆるい独白は、答えが直接言われていないからこそそうなっていることが多いのです。
この特徴は今でも計算され、レポートにも印字されますが、難度には入れません。この逆方向の関係が常に見えるようにし、次に誰かがまた直感どおりに戻してしまわないためです。
ほかにも2つの特徴が、別の理由で除外されました。 設問が設問セット内で何番目か(1問目 4.5% 困難、2問目 18.4%、3問目 26.1%)と、証拠が独白中のどこにあるかは、難度ラベルと強く一致します。一致しすぎて、それだけでかなり正確なモデルを作れるほどです。
しかし、それらは何も説明していません。「3問目は難しい」は、難問がどこに置かれるかという出題上の慣例を述べているだけで、何が1問を難しくするのかではありません。証拠位置はさらに微妙です。3問目だけを見ると、簡単・中等・困難の3群の証拠位置の差は完全に消えます(0.719 / 0.727 / 0.757)。それは独立したものだったことは一度もなく、「3問目の証拠はもともと後ろにある」ということの別の言い方にすぎません。
予測はできるが説明はできない指標は、成果に最も似て見えますが、実際には最も役に立ちません。
ものさしを市販の模擬試験セットで校準する
分類そのものだけでは足りません。その比率が妥当かどうかも知る必要があります。重要な一歩は、同じプログラムで、私たちの問題データベースも、参照書の問題も走らせることです。1つの測定器、2つのコーパスであって初めて比較に意味があります。(参照書がどのセットか、なぜそれを選んだのか、どんな制限があるのかは、〈難度総論〉を参照してください。)
私たちは参照コーパス6回分すべての 180 問の Part 4 を抽出し、同じ分類器にかけました。
まずこのものさしが壊れていないことを確認する
抽出そのものは自己検証できます。参照書の6回分の試験には、数がまったく変動しない2種類の設問タイプがあります。
| 各回の試験 | graphic questions | 引用発話の意味 |
|---|---|---|
| 第 1–6 回、各回 | 2 | 3 |
6回すべて同じです。そして私たちが数か月前にまったく別の方法、つまり解説本に各問ごとに印刷された難度評価の丸印を数える方法で測った出題構造でも、同じ2つの数字が得られていました。2回の独立した測定が小数点まで一致したことは、抽出に誤りがなかったこと、またこの2つの数量が偶然ではなく、出題構造の一部であることを意味します。
設問タイプ構成の対照
| 設問タイプ | 私たち | 参照 |
|---|---|---|
| gist questions | 18.9% | 22.2% |
| detail questions | 70.8% | 52.8% |
| graphic questions | 2.1% | 6.7% |
| intent & inference questions | 1.6% | 13.3% |
2行目と4行目に注目してください。
私たちは「言われた1文を見つける」問題を約2割多く出し、「口に出されていないもの」を問う頻度は参照書の8分の1です。
最も極端なのは引用発話の意味の設問です。参照試験では各回に3問ありますが、私たちの問題データベース全体 1,350 問の中には 14 問しかありません。
背後に隠れていた理由
引用発話の意味の設問には、字面の意味と実際の意味が違う文が必要です。私たちは全 1,018 本の会話と独白の本文、つまり491,912 文字をすべて走査し、この種の言語が何回出てくるかを数えました。
結果は、2つの慣用表現でした。I guess、I suppose、to be honest の出現回数はゼロです。
私たちの話者は最初から最後まで字義どおりで、取引的でした。物事を告知し、指示を出し、時間を伝えますが、ほのめかさず、含みを持たせず、口に出していないことを口調で伝えません。欠けていたのは1つの設問タイプではなく、1つの話し方でした。設問タイプは、その露出した一角にすぎません。
難度ラベルの対照と、それが見た目より役に立たない理由
参照書には各問に出版社独自の難度評価が印刷されています。それを私たちのラベルと並べると、こうなります。
| 低 | 中 | 高 | |
|---|---|---|---|
| 参照書 Part 4(n=157) | 36% | 46% | 18% |
| 私たちが「難」と標示 | — | — | 16.3% |
差は 1.7 パーセントポイントで、ほぼ一致しているように見えます。しかしこの数字を結論として扱うべきではありません。理由は2つあります。
第一に、両者は互いに一度も校準されていない2本のものさしです。参照書の高/中/低は出版社編集者の判断であり、私たちのものは出題者の判断です。たまたま同じ数字に落ちていても、まったく別のものを測っている可能性があります。
第二に、そしてより重要なこととして、私たち自身の7特徴ルールで再計算すると、旧設問のうち困難といえるものは 2.2% しかありません。一方で出題者は 16.3% と標示していました。最もゆるい計算方法(認知的に本当に難しい作業を1つでもしていれば数える)まで広げても、9.1%にすぎません。
つまり、あの「ほぼ一致」している 16.3% は、甘めのラベルの上に成り立っています。本当に対照できるのは設問タイプ構成です。それは同じプログラムが2つのコーパスを走らせて測ったものだからです。難度ラベルの対照は参考にしかならず、結論にはできません。
正直な但し書き
- ここには「難度」についての対外的な主張は一切ありません。 設問タイプ構成は測定でき、再現できます。難度はそうではありません。この2つを意図的に混ぜて語らないようにしています。
- 参照は市販の模擬試験であり、ETS 公式問題ではありません。 設問タイプ構造は出版社が最も忠実に複製しやすい部分です(6回の間で変動がゼロなのが証拠です)。そのため設問タイプの比較は信頼できます。難度評価が背負っているのは編集者の判断であり、実際の受験者の正答率ではありません。
- 私たちの音声は実際の試験よりきれいです。 合成音声には現場録音の音の省略、発話の重なり、背景雑音がないので、私たちのリスニングは、私たち自身では測れない軸において、実際の試験より少し易しくなっています。
- 設問タイプは設問文から推導したものです。 そのため再現可能で、今後書く内容にも引き続き正しく適用できますが、捉えているのは問われ方です。問われ方は平凡でも実際には非常にひねった問題は、このものさしでは見えません。
- 本当の終点は正答率です。 匿名の解答統計が蓄積されるにつれて、各問は少しずつ実際の p 値を得ます。そのとき、このものさしは実データで再校準されます。それまでは、これが私たちにできる最も正直な測り方です。
設問タイプを知ったあと:それぞれをどう聞くか
ここからは、上の分類を逆向きに読みます。Part 4 で最も重要な習慣は、音声が鳴る前に、3問の設問文を先にざっと見ることです。
Part 4 にはそのための空白時間があります。各セットの間に8秒あり、3つの設問文は5秒あればざっと見られます。見ておけば、このセットがあなたに何を求めているのかがわかり、それが注意の配分を直接決めます。
もう1つ、この作業を可能にするルールがあります。3問の答えは、ほぼ必ず独白の順番どおりに出てきます。 「流れについていく」ことができます。1問目の答えを聞いたら、注意を2問目に移します。
「目的/主旨/話者は誰か」を見たら → 最初の2文で解決し、その後は手放す
答えは冒頭にあります。あなたの動作は、最初の2文が終わった時点で、この問題には答えが出ているべきというものです。その後に戻って考えてはいけません。
もし独白の後半でまだ1問目に迷っているなら、2問目と3問目は基本的にもう落としています。これは Part 4 で最もよくある失点の仕方で、しかも本来最も取りやすい点を落としています。
目標時間:最初の2文以内。
「when / where / how much / what are listeners asked to do」を見たら → キーワードを固定し、それが出るのを待つ
これは detail questions です。あなたの動作は次のとおりです。
- 設問文からキーワードを1つ取る――場所、時間、動作。
- 音声の中で、その語の近くにある文を待つ。
however、actually、insteadを聞いたらすぐ警戒を上げる。前の文はすでに無効になっている可能性が高く、答えは転換の後にあります。- 選択肢の中に、今聞いたばかりの数字がある場合、それはたいてい答えではありません。少し計算させるほうが答えです。
目標時間:答えが出たその瞬間。逃したら手放し、3問目の時間を使って2問目を追わないでください。
「Look at the graphic.」を見たら → 先に表を読み、それから音声を聞く
これは graphic questions であり、唯一、問題冊子上に答えの半分がある設問タイプです。あなたの動作は次のとおりです。
- 音声が始まる前に表を理解する――何列あるか、単位は何か、どの列が選択肢に出ていないか。
- 選択肢にはたいてい表のどこか1列(たとえば時間)が並んでいます。その場合、音声は別の1列(たとえば路線、部屋番号)を与えます。
- 聞くときはその条件1つだけをつかみ、聞こえたら表に戻って照合します。
音声が流れているときに表を読み始めてはいけません。 これは Part 4 で唯一、事前に半分の作業を終えられる設問タイプです。そこを無駄にするのはもったいないです。
目標時間:音声開始前の 8 秒で表を読み、聞いているときは条件1つだけを待つ。
設問文に引用符があったら → この問題は語気を問う。答えはその文の前後にある
引用符そのものが印です。ざっと見ればすぐわかります。あなたの動作は次のとおりです。
- その文を字面で理解しようとしない。それは問題に印刷されていて、あなたは読めます。問われているのはそこではありません。
- 音声の中でその文が出てくるのを待ち、その前の文と後の文を覚える。答えはほぼ必ずそこにあります。
- 自分に問いかけます。なぜこの位置でこの文を言ったのか。警告しているのか、不満を言っているのか、やんわり断っているのか、それとも反語なのか。
同じ動作は What is probably true… のような推論問題にも使えます。答えは言われていません。探すべきなのはそれを支える1文です。そしてこのタイプの設問では言い換え距離が必然的に最大になるため、選択肢に音声そのままの語が出ているものは、たいてい罠です。
目標時間:これは唯一、力を多めに使う価値がある設問タイプであり、選択肢を1つずつ照合する必要が最も高いタイプでもあります。
ペース配分:Part 4 の本当の規律は手放すこと
Part 4 のリズムは固定されていて、戻ることはできません。各セットの間に8秒、3問の間にもそれぞれ8秒あります。この空白時間の正しい使い方は1つだけです。次のセットの設問文を先に見ることであり、前の問題を振り返ることではありません。
1本の独白は、再生が終わったら永遠に過ぎ去ります。2問目にさらに10秒考える代償は、3問目を丸ごと聞き逃すことです。そして聞けなかった問題は、採点上は勘と同じです。
だから Part 4 の規律は Part 5 と同じで、正解することではなく、いつ手放すかを知ることです。答えをつかめなかったら、選択肢の中から最も罠らしくないものを選び(特に、今聞いたばかりの数字は選ばない)、すぐに注意を次の問題へ渡します。

一文でまとめる
Part 4 の難しさは、独白がどれだけ密か、数字がどれだけ多いかにはありません。その直感は測ってみると逆であり、今でも私たちのレポートに印字されて自分たちへの警告になっています。難しさは、1問ごとに判定できる7つの特徴に分解できます。そしてその中で結果を最も左右するのは、設問があなたに何をさせるかです。冒頭で1文を見つけるのか、中盤で1つの事実を待つのか、表と音声をつなげるのか、それとも話者が口に出していない意味を判断するのか。同じものさしで市販の模擬試験セットを測ると、私たちに見えたのは設問タイプ構成の差でした。そして同じ分類を逆向きに読めば、それがあなたの解答順序になります。音声が鳴る前に3つの設問文を先に見る。最初の2文で1問目を解決する。転換を聞いたら、その前の文はすでに無効だと仮定する。引用符を見たら、その前後1文を聞く。そして各問が終わったその瞬間に、すぐ手放す。