記事一覧 · 公開日 2026-08-04
Part 7 の難しさは、測って決める——そして構造を知れば、解き方が見えてくる
好奇心旺盛なあなたに贈る技術解説です。難易度シリーズは各 Part につき1本ずつ、順番に公開しています。これはその第7回、締めくくりの1本です。今回は TOEIC 全体で最も「何が難しいのか」を説明しにくいパート——Part 7 読解問題——を取り上げ、その難易度をどうやって測定可能なものに変えたのか、市販の模擬試験集を参照基準にどうやってこの物差しを校正したのか、そして(あなたに最も役立つこととして)一つの問題が「どう難しく作られているか」が見えれば、時間をどこに使うべきかも見えてくる、という話をします。統計の予備知識は不要です。
なぜ Part 7 の難易度は説明が最も難しいのか
Part 5 の問題が難しいとき、たいていは一つの文法項目を指して「これだ」と言えます。Part 1 が難しいときは、一つの構文を指させます。しかし Part 7 にはそうした単一のポイントがありません。一つの文書に3〜4問。難易度は文書の長さの中に、選択肢の言い回しの中に、根拠が隠れている場所の中に、散らばっています。10人の受験者に「この文書はなぜ難しかったのか」と尋ねれば、10通りの、どれも正しく、しかしどれも一部しか言い当てていない答えが返ってくるでしょう。
学習アプリにとって、これは解決しなければならない問題です。理由はこのシリーズで一貫して述べてきたとおりです。難易度ラベルは、あなたが実際に練習する問題の組み合わせを決めます。 そして、言葉にできないものは、検証することも校正することもできません。「難しい」が出題者のその時の感覚にすぎないなら、いわゆる難易度分布はただの「感覚の分布」です。
だから私たちは、Part 7 の難易度を分解して測ることにしました。
難易度の定義と、その代役
計量心理学は難易度をあいまいさなく定義しています。一つの問題の難易度とは、実際の受験者がそれに正解した割合(専門用語で p値)のことです。正答率 85% の問題は易しい問題、正答率 40% の問題は難しい問題。それだけのことです。
しかしこの定義には過酷な前提があります。まず大量の受験者にその問題を解いてもらわなければならないのです。ETS はそのデータを持っています。第三者は——私たちも、どの出版社も——持っていません。つまり「本問の難易度:高」と印刷している者は皆、実際には何らかの代役を使っています。違いはただ一つ。その代役が一人の人間の判断なのか、それとも再実行でき、検証できるルールの集合なのかです。
私たちは後者を選びました。やり方はこうです。構造的に問題を難しくする特徴の集合を定め、1問ずつ測ります。特徴は問題のテキストから計算されるので、同じ物差しで私たちの問題バンクも、紙に印刷されたどんな試験問題も測れます——この点が、この後とても重要になります。
Part 7 の問題は、どの方向から難しく作れるのか
以下が、私たちが Part 7 の各問題について実際に計算している主な特徴です。このリストは同時に、この記事の後半の予告でもあります。問題を難しくする方向の一つひとつが、時間を正しい場所に使う方法の一つひとつに対応しています。
1. 設問タイプ——どんな作業を求められているか
Part 7 の設問は一種類ではなく、一つのスペクトラムです。「答えにどれだけの加工が必要か」で浅いものから深いものへ並べると:
| 設問タイプ | やるべきこと |
|---|---|
| 詳細問題(What is indicated about…?) | 本文中の一つの事実を特定する |
| 主旨・目的問題(What is the purpose of…?) | 単一の文ではなく文書全体を要約する |
| 語彙問題(The word "…" is closest in meaning to) | 辞書ではなく文脈から語義を選ぶ |
| 挿入文問題([1]–[4] から位置を選ぶ) | 一つの文と前後のつながりを判断する |
| NOT問題(What is NOT mentioned…?) | 三つが本文にあると確認し、残った一つが答え |
| 推論問題(What is suggested/implied…?) | 本文中の二つの事実を、書かれていない結論へ組み合わせる |
| 複数文書参照問題(ダブル/トリプルパッセージ) | 一方の文書のルールを、他方の文書の事例に当てはめる |
下に行くほど、1問が食う秒数は増えます。この順序は私たちの発明ではありません——「答えがテキストの表面からどれだけ離れているか」そのものです。
2. 言い換えの距離——Part 7 の本当の核心
Part 7 全体で最も重要な特徴がこれです。正解の選択肢は、本文の用語をほぼ決して繰り返しません。
本文にはこうあります:Refunds are issued within five business days of our receiving the returned item. 易しい問題なら、正解はこうなります:Within five business days(そのまま書き写し)。 実際の試験の正解はこうなります:About a week after the store gets the product back——「5営業日」は「約1週間」に、「当社が返品を受け取る」は「店が商品を回収する」に変わっています。キーワードは一つ残らず入れ替えられ、意味は一つも変わっていません。
私たちは各問題について、選択肢と本文の文との語の重なり度を計算します。重なりが低いほど——正解が徹底的に「翻訳」されているほど——問題は難しくなります。キーワードをスキャンする読み方では見つけられないからです。
3. ひっかけの密度——答えに見える誤答選択肢
言い換え距離の鏡像です。誤答の選択肢の中に、本文に本当にある語がどれだけ現れているか。「five business days」をそっくり持ち込みながら、誤った出来事につないでいる選択肢(たとえば返金までの日数ではなく出荷までの日数につなぐ)は、スキャン読みの人にとって致命的です。本文の語が多くの誤答に現れるほど、その問題は危険です。
4. 根拠の位置——答えはどこに埋まっているか
根拠が第1段落にあるのと最終段落にあるのとではコストが違います。一つの文に集中しているのと二つの段落に散っているのとでは、さらに違います。私たちは各問題の根拠がある段落位置を記録しています。ちなみにこのデータはアプリの中で見られます。解答すると、本文中の根拠の文がそのままハイライトされます。
5. セットの形——1問あたり何語読むのか
シングル、ダブル、トリプル、そして本文の総語数。実際の試験フォームの分量から、覚えやすい基準が測れます。Part 7 では、1問の背後に平均およそ84語の読解量があります。 300語の文書に3問なら標準的な負荷。同じ3問が500語につくと、読むコストだけで難易度は押し上がります。
「長い」を具体的に言うとこうです。実際の試験では、シングルパッセージの長さは設問数に連動します。2問つきの文書(テキストメッセージの連なりや領収書)はおよそ110〜200語、3問つきは約180〜300語、4問つきの記事やフォーマルな手紙は250〜400語。私たちの問題バンクも同じレンジで管理しており、語数がレンジを外れた新しいセットはバンクに入れません。
ついでに、アプリの中で気づいた方もいるかもしれないことを、はっきり書いておきます。バンクには意図的に短めの Part 7 セットも一部あり、これは日常の練習専用です——通勤のすき間時間で解きたい人や、読解の体力をまだ作っている段階の学習者に優しい形です。模擬試験は本試験と同じ長さのセットだけを抽出します。だから模試の体験もスコア推定も、短い文章に薄められることはありません。将来的には、まだ低いスコア帯で苦労している学習者向けに「baby TOEIC」といった入門問題の提供も検討しています——まず読み切れるようになり、それから速く読む練習へ。
6. 文書の種類——これはどんな文書か
お知らせ、メール、広告、記事、オンラインチャット。これらは等価ではありません。論説的な article は text-message のやり取りより自然に難しく、一方でチャット体はその見返りに専用の難問を積んでいます(意図問題:「彼女はこの発言で何を言おうとしているか」)。
これらの特徴を合わせると、各問題に難易度スコアがつき、それを easy / medium / hard の3段階に切り分けます。残る問題はただ一つ。目盛りをどこで切れば正しいのか。
市販の模擬試験集で物差しを校正する
目盛りは自分で発明できません。外部の参照基準に合わせる必要があります。私たちが使ったのは『全新!新制多益 TOEIC 題庫解析 狠準 6 回』(Hackers Academia 著、台湾・國際學村出版)——全6回からなる、市場で完成度が高いと広く評価されている模擬試験集です。これを選んだのには非常に実際的な理由があります。この本は全問題に出版社自身の難易度評価(高/中/低)を印刷しているのです。これで、プロの編集者による1,200個の問題別判断が、照合用に手に入りました。
そして鍵になる一歩です。同じ特徴抽出プログラムを、私たちの問題バンクにも、参照本の問題にも走らせます。 一つの計器で二つのコーパスを測ってはじめて、比較に意味が生まれます。目盛り(3段階の切断点)は、参照本自身が印刷している割合に合わせて校正します——まず物差しが本物の模試問題の上で出版社自身の答えを読み出すようにし、それからその物差しで私たちのバンクを読むのです。新しいコンテンツがバンクに入る前には、自動ゲートを通らなければなりません。分量は実際の試験の1問あたり読解量に収まっていること、難易度プロファイルは参照プロファイルの許容範囲に収まっていることが求められます。
この参照基準は、受験者に役立つ事実も一つ教えてくれます。出版社自身が、リーディングはリスニングよりはるかに難しいと考えているのです。リスニングの各パートでは「低」(易しい)と評価された問題が 34〜45% を占めるのに対し、リーディングでは 10〜12% しかありません。そして Part 7 では 29% の問題が「高」と評価されています。リーディングのほうがずっとしんどいと感じてきたなら、それはあなたのせいではありません。この試験の形なのです。
正直な但し書き
- 参照本は出版社の模擬試験であり、ETS の公式教材ではありません。 形式面での信頼性は極めて高い(6回の間の揺らぎがほぼゼロ——公式の出題構造を忠実に写し取るとちょうどこうなります)一方、難易度面が載せているのは編集者の判断であって、実際の受験者の正答率ではありません。
- 私たちは分布のレベルでのみ主張し、1問のレベルでは主張しません。 かつて Part 5 で問題ごとの検証を行ったところ、構造的特徴が「個々の1問」の難しさを説明する力はごく小さいことがわかりました。だからこの道具の正しい使い方は、二つの問題バンクの難易度構成を比較し揃えることであって、ある1問のスコアが正確だと請け合うことではありません。問題ごとのスコアは誤差の幅を伴い、1問を判断する唯一の根拠には決してなりません。
- 本当の終着点は正答率です。 匿名の解答統計が蓄積されるにつれ、各問題は少しずつ本当の p値 を獲得していきます。そのときこの構造の物差しは、実データで校正し直されます。それまでは、これが私たちにできる最も正直な測り方です。
構造を知ったあと:効率よく解くには
さきほどの特徴リストを、今度は逆から読みます。問題を難しくする方向の一つひとつが、時間をどこに使うべきかを教える指示です。
まず設問文を読み、先に分類し、それから本文の読み方を決める
問題セットを開いたら、まず5秒かけて各問を上の設問タイプ表に振り分けます。この一歩が読み方を決めます。
- 主旨・目的問題——根拠はほぼ必ず第1段落(手紙なら冒頭の1〜2文)と最終段落にあります。中間を精読しなくても答えられるので、第1段落を読み終えた時点でついでに片づけるべき問題です。
- 詳細問題——設問文からアンカーになる語を拾い(日付・金額・人名が最も信頼できます。言い換えようがないからです)、そのあたりまでスキャンしたら速度を落として精読します。言い換えの距離を思い出してください。探すのは設問文の意味が現れる場所であって、設問文の語ではありません。
- 語彙問題——四つの選択肢を一つずつ元の文に代入します。正解は「この文の中で」成り立つものであり、その語の最も一般的な意味でないことがよくあります。このタイプは全文を理解する必要がなく、Part 7 全体で時間あたりの得点効率が最も高い設問タイプです。
- 推論問題——答えは二つの事実の組み合わせで、その二つはしばしば段落を隔てて置かれています。同時に逆方向の罠にも警戒を。本文が「顧客は参加するよう招かれている」と言うのに、選択肢が「顧客は参加する」と言う——本文が支える範囲を超えた選択肢は、どれほどもっともらしくても誤りです。

NOT問題は3問分の値段で数える
「次のうち本文で述べられていないものはどれか」は、コスト計算上は1問ではなく3問です——三つの選択肢それぞれの根拠を本文に見つけ、残った一つが答えなのですから。解く価値はありますが、最後に解いてください。同じセットの他の問題のためにすでに本文を読み込んでいれば、三つの「述べられている」の確認はずっと速く済みます。順番を間違えると、同じ文書を二度むだに読むことになります。
「本文そのまま」の選択肢を警戒する
これはひっかけ密度の特徴が教えてくれることで、独立した一項目にする価値があります。本文と一字一句同じ選択肢を見たら、まず疑ってください。 出題者は、時間に追われる人がキーワードスキャンに頼ることを知っています。だから最も安上がりな罠は、原文の語を誤った対象・時間・条件につなぐことです。逆に、原文を徹底的に言い換えた選択肢こそ真剣に検討する価値があります——正解はたいていそういう姿をしています。
挿入文問題:代名詞と接続語に働いてもらう
与えられる文には、ほぼ必ずフックが潜んでいます。These changes(直前に複数の変更が出ていなければならない)、However(直前の文が逆方向でなければならない)、He then(その人物と先行する動作がすでに出ていなければならない)。まず文の中のフックを見つけ、それから本文に戻って掛けられる場所を探す。四つの候補のうち二つは、その場で消えることがよくあります。
複数文書参照問題:ルールは一方に、事例は他方に
ダブルとトリプルのパッセージには、どの一つの文書だけでも答えられない問題が必ずあります。その構造は驚くほど決まっています。一方の文書がルールを示し(NT$800 以上で送料無料、会員は10%引き、3月以降は価格改定)、他方が具体的な事例を示す(NT$740 の請求書、ある会員の注文、4月に送られた問い合わせ)。あなたの動きはこうです。最初の文書を読みながら、数字・日付・しきい値を見たら印をつける——複数文書参照問題の答えは、ほぼ毎回この点にぶら下がっています。「この顧客は実際にいくら払うか」と問われ、その金額がどの文書にも明記されていなければ、それは二つの文書をつなげという合図です。

最後は時間の話——Part 7 は何よりまずスピードテストだから
リーディングセクションは75分で100問、Part 7 はそのうち54問です。よくある配分の助言は、Part 5 を10分以内、Part 6 を8分以内に抑え、Part 7 に約55分を残すというもの——読む時間を含めて、平均1問1分です。1問あたり約84語の読解量と合わせると、これは安定した読解スピードと、上で述べた「二度読みしない」規律の両方を要求しています。
スコア推定の記事で、アプリがあなたの実際の1問あたり秒数を使って試験の時計をシミュレーションしているのも、これが理由です。たどり着けなかった問題は、採点上は当て推量と同じになります。 Part 7 では、4問セットを丸ごと飛ばす代償のほうが、一つの難問に30秒余計にかける代償より大きい——捨てるなら単問を(特に NOT問題を)捨て、セットは決して捨てないでください。
一言でまとめると
Part 7 の難易度は、霧の塊ではありません。それは問題ごとに測定できる特徴——設問タイプ、言い換えの距離、ひっかけの密度、根拠の位置、読解量、文書の種類——の合計です。私たちはこの測定を、出版社の問題別評価が印刷された全6回の市販模擬試験集で校正し、問題バンクの難易度構成を、自分たちの感覚ではなく、外部の検証可能な参照基準に揃えています。そして同じ特徴リストを逆から読めば、それがそのままあなたの解答戦略になります。問題を難しくするどの手法も、答えがどこに隠れているか、次の1分をどこに使うべきかを、あらかじめ予告しているのです。