本文へスキップ

ジップの法則とは?

じっぷのほうそく

「法則」の用語まとめを見る

ジップの法則とは、自然言語のテキストで最も頻繁に使われる単語はその頻度が2番目の約2倍、3番目の約3倍になるという統計的経験則です。

ジップの法則(Zipf's law)は、アメリカ言語学者ジョージ・キングズリー・ジップが20世紀中頃に体系化した、単語の出現頻度に関する統計的法則です。単語をその使用頻度の高い順に並べたとき、n番目の単語の頻度はおよそ1/nに比例するという「べき乗則」の一種です。

英語の例では次のような傾向が見られます。

  • 最も多い単語「the」の頻度を1とすると、2位「of」はその約1/2。
  • 3位は約1/3、10位は約1/10という比率になる。
  • 少数の単語が全体の使用のほとんどを占め、大多数の単語は稀にしか使われない。
この法則は英語だけでなく、日本語をはじめとするほぼすべての自然言語に観察されます。

驚くべきことにジップの法則は言語の外でも成立します。都市の人口順位と規模の関係、企業の売上高の分布、ウェブサイトへのアクセス頻度、楽曲の再生回数など、さまざまな社会現象に同様のパターンが現れます。これは情報圧縮・効率化という人間や自然システムの普遍的な原理を反映しているとも考えられており、自然言語処理・情報検索・社会物理学などの分野で重要な基礎概念として扱われます。

使い方・例文

「ジップの法則」は検索エンジンのキーワード頻度分析や、テキストを自動要約するアルゴリズムの設計に活用されます。また「少数の語彙を習得するだけで多くの文章を理解できる」という語学学習の効率性の理論的根拠にもなります。

この用語をシェア

𝕏 でポスト LINE

最終更新:

関連用語