科学の箱

科学・IT・登山の話題

機械学習

Core Concept in Data Analysis – Week 1

投稿日:

パート

  • Data Mining
  • Core Analysis
  • Visualization
  • Illustrate

Data Mining

  • data mining = patterns in data + data base + knowledge discovery
  • core data analysis = patterns in data + knowledge discovery

Pattern found

  • success if compatible with existing knowledge
  • failure if not compatible with existing knowledge

Data analysis: find pattern -> interpret with knowledge -> care not if patterns is compatible with current knowledge.

Core Analysis の4つのパターン

  • 要約 – 定量データ – PCA
  • 要約 – 質的データ – クラスタ
  • 相関 – 定量データ – 回帰
  • 相関 – 質的データ – 分類

他のデータ分析アプローチとの比較

  • 古典的統計: データは数学的にモデルに適合するかを検証するテストにのみ使われる。
  • ML : データから予測するためのルールを作る
  • Data Mining: データベースからパターンを見つけ、新しい知識をふやす。

Visualization

  • Highlight
  • 統合
  • データの操作

 

メタ情報

inarticle



メタ情報

inarticle



-機械学習
-

執筆者:


comment

メールアドレスが公開されることはありません。 * が付いている欄は必須項目です

関連記事

no image

SIGNATE お弁当の需要予測-1

SIGNATEのコンペであるお弁当の需要予測をpythonで分析 データは下記から取得できる https://signate.jp/competitions/24 ライブラリ読み込み importnu …

no image

irisをナイーブベイズで分類

ナイーブベイズの概要 ナイーブベイズは教師ありの分類アルゴリズムの一つである。 計算アルゴリズムとしてはベイズ定理を用いている。 機械学習における特徴としてはいかがある 実装が簡単であり、複雑なハイパ …

no image

データ分析のメモ

一変量解析 各変数についてsummaryをとり、平均値、分散を確認する。変数について尺度を確認してどのように分析を進めるかを考える。 度数分布を作成して値の分布をみてみる。正規分布の値であればいろいろ …

no image

仕事で始める機械学習 – 1. 機械学習プロジェクトの始め方

機械学習プロジェクトの流れ 問題の定式化 機械学習を利用しない方法 システム設計 アルゴリズム選定 特徴量・教師データ・ログの設計 前処理 学習・パラメータチューニング システム統合 問題の定式化 目 …

no image

Pythonではじめる機械学習 – Chap04

4.4 Binning, Discretization, Linear Models, and Trees ビン化のメリット 決定木でビン化するメリットはあまりない 決定木はモデルの中で一つの特徴につ …

2014年6月
« 5月   7月 »
 1
2345678
9101112131415
16171819202122
23242526272829
30  

side bar top



アーカイブ

カテゴリー