はじめに
私たちが普段使っている自然な日本語を、コンピュータで検索・分析できるように集めたデータベースを**「コーパス」**と呼びます。
書き言葉と話し言葉のそれぞれの特徴を反映しており、現代の日本語研究や教材作成に欠かせないツールです。
💡 コーパスを使った具体的な分析例
コーパスを使うと、人間の直感だけでは分かりにくい「実際の言葉の使われ方」がデータとして客観的に見えてきます。
例1:共起しやすい語の組合せ(コロケーション)を調べる
「傘」という単語と一緒に使われやすい動詞をコーパスで検索し、「傘をさす」「傘を忘れる」など、実際の母語話者がどのような組み合わせで言葉を使っているかを頻度順に調べることが可能です。
例2:類義表現の用法の違いを確認する
「とても」と「たいへん」のように意味が似ている表現を検索し、「『とても』は話し言葉でよく使われ、『たいへん』はフォーマルな書き言葉で使われやすい」といった傾向をデータから明確にします。
⚠️ 試験で狙われる引っかけポイント
試験では、コーパスの万能性を過信させるような「誤った選択肢」に注意が必要です。
- 【不適当な記述の例】 「使用頻度は文法項目の教育的な重要度と一致している」
- 【解説】 「言葉の使用頻度が高い」からといって、それがそのまま「初級で最初に教えるべき重要な文法である」とは限りません。教育的な導入の順番は、頻度だけでなく、文法の難易度や学習者のニーズを総合的に判断して決める必要があります。
