本稿は,現代日本語を対象に,名詞の比率によって他の品詞の比率が説明でき,またそれが文章ジャンルと対応関係にあるとする「樺島の法則」の妥当性について実証的に検討することを通して,現代日本語の語彙の量的構造を明らかにするものである.そのために大規模コーパスを用いて多様な文章ジャンルから収集したデータを基に,「樺島の法則」を参考に品詞構成率を算出し,単回帰分析を実施した.分析の結果,名詞の比率によって他の品詞の比率が予測できる点についてはグラフの概形が類似するものの,残差を比較すると名詞の比率が低い場合の予測が正確ではなく,従前の予測式は係数の改訂が必要であることが明らかになり,本稿ではコーパスのデータに基づき新たな回帰式を提示した.また品詞構成率と文章ジャンルとが対応する点については,散布図上では区別できないが統計的には有意な差があることが明らかになった.
すでにアカウントをお持ちの場合 サインインはこちら