科学の箱

科学・IT・登山の話題

R 統計

サンプルサイズによる有意の違い

投稿日:

こちらでサンプル数について指摘をいただいたのでサンプル数によりp値がどのように変わるかをみてみる。

 1996 2012
15~19歳 9 9
20~24歳 12 17
25~29歳 10 18
30~34歳 9 18
合計 40 63

このデータを x 10, x 100, x1000, x10000で検定してみる。

neet_1 <- matrix(c(9,9,12,17,10,18,9,18),ncol=2, byrow=T)
weight <- c(1, 10, 100, 1000, 10000)
weight
for ( i in weight){
  print(paste("======= weight: ", i, "======="))
  print(chisq.test(neet_1 * i))
}

結果は以下のようになった。

1 0.689
10 0.002081
100 2.20E-16
1000 2.20E-16
10000 2.20E-16

下記のページにもあるように、サンプルサイズが大きくなると有意になることがわかる。

http://blog.minitab.com/blog/statistics-and-quality-data-analysis/large-samples-too-much-of-a-good-thing

Χ二乗分布についてはこの論文を読んでおくとよいらしい。

http://www.jstor.org/discover/10.2307/3001616?uid=3738328&uid=2129&uid=2&uid=70&uid=4&sid=21103827319951

メタ情報

inarticle



メタ情報

inarticle



-R, 統計
-

執筆者:


  1. foo-bar-baz より:

    同じことであるが,p値ではなく,χ二乗値を示すとわかりやすい。
    chisq.test では,χ二乗値がサンプルサイズに比例することがわかる。表の全セルをk倍にすれば,χ二乗値もk倍になる。

comment

メールアドレスが公開されることはありません。 * が付いている欄は必須項目です

関連記事

no image

Rオブジェクト指向のメモ

whichではwhich.minとwhich.maxが用意されているという指摘を受けたので調べ見てた。 which.minとwhich.maxはRでいうところのオブジェクト指向を利用した構造にみえる。 …

no image

一対比較法によるリーグ戦の分析

一対比較法を利用すると2者の比較から全体の重要度や実力を数字で表現できる。 一対比較法を使った分析の手順は以下のようにすすめる。 データを取得する。 一対比較法のデータは複数の項目から2者を選び比較し …

no image

回帰分析

回帰分析の手順 データを取得する。 回帰分析をする意味があるかを検討する 回帰分析のモデルを検討する 回帰分析をする 回帰分析の結果について考察する 回帰分析のメモ 回帰分析では目的変数を説明できる変 …

no image

カーネル密度関数

ようするにサンプルデータから、サンプルが存在しない領域についても値を計算し、全体の分布を推定する。 ヒストグラムはX軸は不連続な値であり、厳密にはX軸においては中間におけるY値は存在しない。 これを計 …

no image

データフレームで層別に操作をする

Rでデータベースに似たデータを取り扱う際には、データフレームを使うことがおおい。JavaはPHPなどのプログラミング言語では、層別に集計作業をする際にはデータベース上のSQLか、データを読み込んでから …

2014年6月
« 5月   7月 »
 1
2345678
9101112131415
16171819202122
23242526272829
30  

side bar top



アーカイブ

カテゴリー