科学・IＴ・登山の話題

サンプルサイズによる有意の違い

投稿日：2014年6月5日

こちらでサンプル数について指摘をいただいたのでサンプル数によりp値がどのように変わるかをみてみる。

	1996	2012
15～19歳	9	9
20～24歳	12	17
25～29歳	10	18
30～34歳	9	18
合計	40	63

このデータを x 10, x 100, x1000, x10000で検定してみる。

neet_1 <- matrix(c(9,9,12,17,10,18,9,18),ncol=2, byrow=T)
weight <- c(1, 10, 100, 1000, 10000)
weight
for ( i in weight){
  print(paste("======= weight: ", i, "======="))
  print(chisq.test(neet_1 * i))
}

結果は以下のようになった。

1	0.689
10	0.002081
100	2.20E-16
1000	2.20E-16
10000	2.20E-16

下記のページにもあるように、サンプルサイズが大きくなると有意になることがわかる。

http://blog.minitab.com/blog/statistics-and-quality-data-analysis/large-samples-too-much-of-a-good-thing

Χ二乗分布についてはこの論文を読んでおくとよいらしい。

http://www.jstor.org/discover/10.2307/3001616?uid=3738328&uid=2129&uid=2&uid=70&uid=4&sid=21103827319951

Related posts:

Rによるやさしい統計学/5-統計的検定-1

Rでグラフを作成するときに参考にするサイト

執筆者：admin

foo-bar-baz より:

2014年6月6日 4:50 AM

同じことであるが，p値ではなく，χ二乗値を示すとわかりやすい。
chisq.test では，χ二乗値がサンプルサイズに比例することがわかる。表の全セルをk倍にすれば，χ二乗値もk倍になる。

返信

comment コメントをキャンセル

関連記事

: vcovHAC

SandwitchパッケージのvcovHACパッケージについて調べる。vcovHACのディスクリプションは下記のようになっている。 Heteroskedasticity and Autocorrela …

: oneway.test, aov, anovaの違い-2

さてoneway.test, aov, anovaの違いをもとにしてそれぞれの関数について調べてみる。機能 advantage disadvantage oneway.test 分散分析等分散を仮 …

: ジニ係数(再掲)

ジニ係数について修正した。とりあえずコード。 revenue<-read.csv(file=”data.csv”, head=TRUE) revenue$TotalRevenues_n < …

: findFn{sos}

findFn{sos} findFn(string, maxPages = 20, sortby = NULL, verbose = 1, …) 文字列から関数を探すことができる。パッケー …

: 仕事で使える統計解析

説明変数と目的変数の関係を求める変数の関係を定量的に明らかにするとき説明変数と目的変数が定量・定性かによって選択できる統計手法が異なる。統計手法 – 目的変数 – 説明変数重回帰分析 – 定量 …

PREV: Lyncでメニューをカスタマイズする
NEXT: 行動経済学

GIMPでForeground color pickerが正しくない色をピックアップするときの対応方法 2021年9月7日
lerpとslerpの違い 2021年8月5日
シェーダーとは 2021年8月3日
Unityの座標系についてメモ 2021年7月1日
ALLとREMOVEFILTERSの違い 2021年6月28日