記事一覧 · 公開日 2026-08-02
Part 1 の難易度:難しさは動詞の一瞬にある——写真描写問題を難化させる5つの手法と、それぞれの聞き取り対策
好奇心を抱くあなたへの技術的説明。難度シリーズは各 Part 1 記事ずつ展開されており、本記事は Part 1 を扱います。写真描写問題はわずか6題であり、試験全体の中で最も短いセクションです。また、多くの人が「写真を見て文を聞くだけ」と思い込みがちなセクションでもあります。本記事では、その難易度が実際どこに隠されているのか——単語ではなく、動詞が完了した状態を描写しているのか進行中の動作を描写しているのか——を解説します。続いて、市販の模試 36 題との対照結果(予期せぬ実証結果が得られました)を示し、最後に最も実用的な内容として、これらを踏まえて音声再生前にどこを見るべきか、再生時にどの単語を真っ先に聞くべきかを解説します。統計に関する専門知識は一切不要です。
6題、90秒、一度きりの音声再生
Part 1 はリスニングセクションの最初の6題です。画面上に1枚の写真が掲載され、イヤホンから4つの英文が流れ、写真に最も適した1文を選びます。4つの選択肢は印刷されておらず、一度しか読まれず、読み終わるとすぐに次の問題へ進みます。
この形式には、見落とされやすい重大な影響があります。聞き直したり見返したりする余地がないということです。Part 5 であれば4つの選択肢を3回読み返すことができ、Part 7 であれば本文に戻って答えを探すことができます。しかし Part 1 の4つの文は、耳元を通り過ぎてしまえばそれまでです。
問題文が短く写真も直感的であるため、多くの人は Part 1 をリスニングのウォームアップ程度に捉え、「名詞をたくさん覚える」という対策を取りがちです——机、脚立、台車、足場など。名詞を覚えること自体は当然必要ですが、Part 1 で実際に受験者を悩ませる要因は、名詞ではほとんどありません。
以下の2つの問題の差を見てみましょう。
1問目の写真は、倉庫内で2人の従業員が台車に箱を積み上げている場面です:
(A) A customer is trying on a jacket. (B) Two employees are stacking boxes on a cart. (C) The boxes are being loaded into a car. (D) A worker is sweeping an empty hallway.
4つの文の主語はそれぞれ、顧客、2人の従業員、箱、1人の作業員——4つの異なる対象です。「写真の中に箱を運んでいる人が2人いる」ということさえ聞き取れれば、残りの3文は自動的に除外されます。名詞さえ知っていれば正解できるため、この問題はおよそ3秒で解き終わります。
2問目の写真は、誰もいない従業員用ロッカールームで、一列に並んだロッカーのうち1つの扉が大きく開いている場面です:
(A) One of the lockers is being opened by a staff member. (B) One of the lockers is open. (C) The lockers are being repainted along the wall. (D) The lockers are being emptied of their contents.
この問題では、4つの文の主語がすべてロッカーです。主語は何のヒントにもならず、動詞を聞き取り、さらに (A) と (B) の違いを聞き分ける必要があります:
is being opened— 誰かがそれを開けている最中であるis open— それが開いている
写真には誰も写っていません。したがって、「誰かが開けている最中である」は誤りであり、「開いている」が正解となります。2つの選択肢は同じ語根 open を使用しており、違いはその1つの文法形式(アスペクト)だけです。 locker という単語をいくら完璧に暗記していたとしても、それだけでは正解できません。
これこそが、Part 1 における難易度の正体です。
Part 1 を難化させる5つの要因
以下の5項目は、私たちの問題バンク全 335 題に対して実際に自動分類を実行して得られた結果です。それぞれが具体的かつ識別可能な手法であり、右側の2列はその手法が簡単な問題と困難な問題において出現する割合を示しています——差が大きいほど、その手法が問題を難化させる効果が高いことになります。
| 手法 | 簡単な問題 | 困難な問題 |
|---|---|---|
| 1. 写真に人物が写っていない | 0% | 65.0% |
| 2. 4つの文で主語が共通 | 0% | 100% |
| 3. 状態 vs 進行中の動作のミニマルペア | 0% | 70.0% |
| 4. 音の似た語による罠 | 0% | 32.5% |
| 5. 文の長大化 | 0% | 52.5% |
1. 写真に人物が写っていない
物品や風景だけが写っている写真——誰もいない会議室、積み上げられたパレット、停車中のライトバンなどです。この問題が難しいのは、追うべき「主役」が存在しないことにあります。
人物が写っている写真であれば、その人物が何をしているかに自然と目が向き、4つの文の中で無関係な動作が言及されればすぐに除外できます。しかし人物がいない写真では、それぞれの文を個別に画像と照合しなければならず、さらに物体を描写する英文では自然と受動態や状態動詞が多用されるため、難易度はそのまま第3項の要因へと加算されます。
2. 4つの文で主語が共通
先ほどのロッカーの問題がこれに当たります。主語が重複した時点で、主語による絞り込み機能は失われ、問題全体の判断は動詞およびそれ以降の詳細な表現にすべて委ねられます。
私たちの「困難」な問題において、この項目の出現率は 100% です——例外はありません。これは最も基礎的な土台と言えます。4つの文の主語がそれぞれ異なっていれば、その問題が極端に難しくなることはありません。
3. 状態 vs 進行中の動作のミニマルペア(Part 1 の中核)
2つの文が同じ主語を扱い、違っているのは動詞のアスペクト(相)のみというケースです。一方は完了した状態を描写し、他方は進行中の動作を描写します。
| 状態(完了) | 進行中の動作 |
|---|---|
| The gate is open. | The gate is being opened. |
| A van is parked. | A van is being parked. |
| The crates are stacked. | The crates are being stacked. |
| The man is wearing a helmet. | The man is putting on a helmet. |
| A boat is moored. | A boat is being moored. |
| The trays have been arranged. | The trays are being arranged. |
これは Part 1 において唯一絶対に回避できない難易度の要因です。単語を知っているかどうかを問うものではなく、2つの選択肢で使われている単語はしばしば完全に同一です。問われているのは、わずか1秒の間に文法形式(アスペクト)の違いを聞き取り、それを即座に写真と照合する能力です。
私たちの「困難」な問題のうち、70% にこのような対立(ミニマルペア)が含まれています。

4. 音の似た語による罠
ある選択肢の中に、写真に実際に写っているものと発音が非常に似ている単語を配置する手法です。よく見られるペアの例:
writing / riding、cart / card、walking / working、copy / coffee、glasses / classes、sweeping / sleeping、pouring / pointing、mail / male、parked / packed
実際の例として、女性が自転車の横に立ち、バインダーに文字を書いている写真の問題を見てみましょう:
(A) A woman is riding a bicycle. (B) A woman is writing on a clipboard. (C) A woman is repairing a bicycle wheel. (D) A woman is loading a box onto a bicycle.
写真には確かに自転車が写っており、riding と writing の音の差はわずかです。聞き取りが早すぎたり、画面内に自転車が見えたりすると、(A) が非常に魅力的な選択肢に見えてしまいます。
5. 文の長大化
文が長くなればなるほど、脳内に保持しなければならない情報量が増加します。しかも音声は一度しか流れません。この項目単独で問題を劇的に難しくすることはできませんが、前述の4つの要因を増幅させる役割を果たします——状態 vs 進行中の動作の対立が11語の文に隠されている場合、6語の文に隠されている場合よりもはるかに難易度が高くなります。
先払拭しておくべき誤解:「is being + 過去分詞」は難度を示すシグナルではない
多くの人は is being handed や are being stacked といった受動進行形を聞くと、直感的に「これはトラップだ」と考えがちです。
しかし私たちの問題バンクでは、76.7% の問題において少なくとも1つの文でこの構造が使用されています——簡単な問題、中等の問題、困難な問題のいずれにおいても同様です。これは難易度を示すマークではなく、写真を描写する際の極めて自然な英語表現の1つに過ぎません。
したがって、「どの文が受動進行形か」によって答えを推測することは避けてください。双方の方向において成り立ちません:その文がトラップであることを意味するわけでもなければ、正解であることを意味するわけでもありません。 実際に聞き取るべきなのは「being があるかどうか」ではなく、次節で述べる疑問です。
市販の模擬試験セット(36題)との対照検証
上記の分類は私たち自身が計算したものであるため、1つの問いに対する答えがまだ不足しています:この難易度の構成比率は妥当なのか?
私たちが参照として使用したのは、全6回分の市販模擬試験セットであり、各問題の横には出版社独自の難易度(低●○○/中●●○/高●●●)が明記されています。Part 1 は1回につき6題あり、6回分で合計 36 題となります——他の Part に比べるとサンプル数はかなり少ないですが、大まかな対照を行うには十分です。
| 難易度 | 参照書籍(36 題) | 私たち(335 題) |
|---|---|---|
| 低/簡単 | 50.0% | 29.0% |
| 中/中等 | 36.1% | 59.1% |
| 高/困難 | 13.9% | 11.9% |
最も注目すべきは最終行です:最も難易度が高い区分において、参照書籍は 13.9%、私達は 11.9% であり、その差は 2 パーセンテージポイント未満です。 36 題というサンプルサイズを考慮すると、この差は完全に誤差範囲内に収まります(参照書籍の 13.9% に対する 95% 信頼区間は 6.1%–28.7% と非常に広くなっています)。
本当の差は上の2行にあります:参照書籍は「低」(50%)に偏っており、私達は「中」(59%)に偏っている点です。私達は参照書籍が「低」に分類するであろう問題の多くを「中」に配置していますが、困難な問題の比率は両者で完全に一致しています。
予期せぬ実証結果
比率以上に説得力があるのは、参照書籍がどの問題を高難度と評価しているかという点です。
全6回の中で、各回の Part 1 にはちょうど1題ずつ「人物の写っていない写真(風景・物品)」が含まれています——6回で計6題、割合にして 16.7% であり、私たちの問題バンクの 20.6% と極めて近い数値です。そしてこの6題のうち、3題が最高難度(高●●●)と評価されていました。参照書籍全体の高難度問題は 13.9% に過ぎないのに対し、人物のいない写真に限るとその割合は 50.0% に達します。
さらにそれらの問題の選択肢の構成を見ると、高難度と評価された問題の4つの選択肢は、ほぼすべて状態 vs 進行中の動作の対立形式——「すでに〜されている」vs「今まさに〜されつつある」——になっていました。つまり、出版社編集者は私たちのこの分類ルールをまったく知らない状態で、人物の写っていない写真と状態 vs 進行中の動作の対立という2つの要素に対して最高難度を付与していたのです。
これらはまさに前述の第1項と第3項に合致しています。2つの異なる定規が、まったく同じ場所を指し示していたのです。
ただし、36題はあくまで36題に過ぎない
- サンプルサイズが非常に小さい。 1題あたり 2.8 パーセンテージポイントに相当するため、上記の比率は「大まかな方向性が合っているか」を確認するためのものであり、詳細な比較には使用できません。
- 回ごとのばらつきが大きい。 全6回における高難度問題の数量はそれぞれ 2、0、0、1、1、1 であり——高難度問題が1題も含まれない回が2回存在します。単一の回だけを見ると、まったく異なる印象を受けることになります。
- 参照書籍は出版社による模試であり、ETS の公式教材ではありません。 難易度表記は編集者の判断によるものであり、実際の受験者の正答率ではありません。この点については《難易度総論》にて詳しく解説しています。
逆引きの対策:Part 1 をどのように聞き取るべきか
前述の5つの要因は、いずれも正解がどこに隠されているかをあらかじめ予告しています。これらを逆算することで、具体的かつ実践的な解法プロセスへと落とし込むことができます。
音声再生前:写真を先に見ながら、自分に3つの質問を投げかける
Part 1 の各問題の間には数秒の空き時間があり、写真は事前に視界に入ります。この数秒間を無駄にせず、以下の質問を自分に問いかけてください:
- 写真に人物は写っているか? 人物が写っていなければ、その後流れる「誰かが〜している」という文はすべて即座に除外できます——これは Part 1 全体の中で最も投資対効果の高い判断です。
- 人物が写っている場合、その手は何に触れているか? これは後述するルールの準備動作となります。
- この写真は英語でどのように描写される可能性が高いか? 心の中で英文を1文作ってみるだけで十分です。一度事前に思い浮かべておくことで、似た表現を聞き取る速度が格段に上がります。
音声再生時:主語 → アスペクト(相) → 詳細表現
以下の順序で聞き取りを行い、不整合を感知した時点でその文の聞き取りを打ち切ります(最後まで聞く必要はありません):
- 主語 — 人物か物体か?単数か複数か?4つの文で主語が異なっていれば、この段階で決着がつくことがほとんどです。
- 動詞のアスペクト(相) — 完了した状態か、それとも進行中の動作か?これが難問を見分ける分水嶺となります。
- 詳細表現 — 場所、数量、位置関係。前の2段階をクリアして初めて、ここまで聞き取る必要が生じます。
最も実践的なルール:手に注目する
状態 vs 進行中の動作の対立は、写真上においてほぼ例外なく手によって判別できます:
人物の手がその物体に触れていない → それは「状態」であり、「進行中の動作」ではない。
ドアが開いているが手が触れていない → is open であり、is being opened ではない。
箱が積み上げられているが手が触れていない → are stacked であり、are being stacked ではない。
車が停車しており運転席に誰もいない → is parked であり、is being parked ではない。
逆もまた同様です:人物の手に動作が残っておらず、上着を着て両手を体側に垂らしている → is wearing であり、is putting on ではない。
このルールが強力なのは、抽象的な文法判断を、写真を見れば一目でわかる視覚的情報へと変換できるからです。
音の似た語による罠に遭遇した場合:「聞こえたこと」ではなく「写真」を基準にする
画面内の物体と一致する単語が聞こえたら、一瞬手を止めて問いかけてください:「写真の中で、実際に誰かがその動作を行っているか?」
先ほどの自転車の問題では、画面内に確かに自転車が写っていますが、誰もそれに乗っていません。riding という音が聞こえても、対応する動作が存在しないのです。Part 1 の罠はほぼすべてこのパターンです:物体は画面内に存在するが、動作は存在しない。

ペース配分:解答したら即座に気持ちを切り替える
Part 1 はわずか6題であり時間的余裕は十分にあります。本当のリスクは時間が足りなくなることではなく、思考が停止してしまうことです。
4文が読み終わっても2つの選択肢で迷っているなら、思い切ってどちらかを選び次へ進んでください。次の問題写真はすでに目に入っています。1秒迷うごとに、次の問題の「再生前の3つの質問」に使える時間が削られていきます——そしてその3つの質問の価値は、前の問題で5秒悩むことよりもはるかに高いのです。
誠実な但し書き
- Part 1 の外部参照データは 36 題にとどまります。 他の Part の参照サンプルが数百題規模であるのに対し、Part 1 は 36 題しかありません。したがって上記の対照表は「困難な問題の比率が概ね同等である」という大まかな結論を支持するものであり、細かな差を論じるには不十分です。
- 5つの分類は問題自体の構造から算出されたものです。 他者の評価ラベルをそのまま流用したものではありません。参照書籍の評価は、この定規が正しい方向を指しているかを検証するために用いられており、難易度そのものを定義するものではありません。
- 上記の比率は私たちの問題バンクの構成を示すものであり、本番の試験を示すものではありません。 私たちがどのように難問を構築しているかを説明するものであり、実際の ETS の試験問題がこの比率で構成されていると主張するものではありません。
- 私たちのリスニング音声は本番の試験よりもクリアです。 この点については総論にて詳しく説明していますが、音声合成には実際の録音に見られるリダクション(音の脱落)や環境ノイズが存在しないため、私たちが独自に測定できない軸において、本番の試験よりもわずかに容易になっています。
一言で言えば
Part 1 の難しさは名詞ではなく、動詞の一瞬にあります:その事象が完了しているのか、それとも今まさに起こっているのか。人物が写っていない、4文で主語が共通している、文が長大化しているといった要素は、すべてあなたの注意力をその一瞬に集中させるための仕掛けです。これらを理解した上で、解答プロセスは2ステップに簡略化できます:音声が流れる前に「人物の有無」と「手が何に触れているか」を確認し、音声が流れた後はまず主語を聞き、次に動詞のアスペクト(相)を聞き取ること。