科学の箱

科学・IT・登山の話題

機械学習 統計

dataanalysis-002-week5

投稿日:2014年1月21日 更新日:

ANOVA – quantitative

  • 分散分析、数学的に分散分析と重回帰分析は同じ
  • 分散分析では3群以上の平均の差異を検定する
  • ただし非線形では異なる
  • http://oshiete.goo.ne.jp/qa/2859018.html

Binary outcome from regression.

  • 勝ち負け、dead/alive, buy / not buy
  • 線形回帰
  • 線形 vs ロジスティック回帰 <- これでバイナリ出力ができる

カウント数が出力結果出るある場合

  • 補正後の回帰分析は一つのオプション
  • ポワソン分布を使う
  • これを利用すれば確率的に発生する件数、人数がわかるので例えばリソースの割り当てが可能になる。
  • 線形回帰もしくはポワソン・ログ回帰が使える
  • agnostic model
  • 信頼空間

モデルチェック

  • overfitting
  • overtesting
  • biased inference

vcovHC

モデルの選択

  • ドメインの知識
  • Exploratory
  • 統計的選択

統計的選択

  • Step-wise
  • AIC
  • BIC
  • LASSo, Ridge-Regression

mean variance relationship

  • mean variance relationshipがある場合にはロバスト標準誤差を利用する。

メタ情報

inarticle



メタ情報

inarticle



-機械学習, 統計
-,

執筆者:


comment

メールアドレスが公開されることはありません。 * が付いている欄は必須項目です

関連記事

no image

SVMでグリッドサーチ

IrisデータについてSVMで分類をしてみた。さて、今回はSVMモデルのパラメータをいじってみてより精度が高いモデルを作ってみる。 すべての学習モデルはハイパーパラメータと呼ばれる学習モデルに影響を与 …

no image

pythonでEDAを実施する – 記述統計

データを取り込む data frameに変換する desdribe()メソッドで要約統計量を出力 各項目について残差分析(ここでは各データが平均値からどの程度離れているか、要するに分散の傾向を把握する …

no image

スパムメールの判別に使うベイズ定理についてまとめる

分類問題 スパムメールを判別するような問題は一般的に「分類問題」として機械学習では取り扱う。分類問題とはいまある「物」や「発生した事柄」を確率的に分類する。この「確率的」という言葉がみそであり、固定さ …

no image

実践ワークショップExcel徹底活用ビジネスデータ分析

メモ 相関係数の行列で傾向が似ている変数を探すことができる。例えば過去データとして商品A,B,C,D,E,Fがあるとする。今商品Xを開発し、マーケティング方法を決めたい。この時A~Fについてはすでに売 …

no image

一対比較法

一対比較法では複数の対象の順位を、個別の比較結果から明らかにすることができる。例えば今5種類の携帯電話があり、好ましさの順位を知りたいとする。一対比較法を利用しなければ、回答者は5について順番をつけて …

2014年1月
« 12月   2月 »
 12345
6789101112
13141516171819
20212223242526
2728293031  

side bar top



アーカイブ

カテゴリー