科学の箱

科学・IT・登山の話題

Python

連続データのビジュアル

投稿日:2018年6月5日 更新日:

Kaggle TitanicのFareを使っていくつかビジュアル

金額別ヒストグラム-1
  • titanic_df['Fare'].plot(kind='hist', figsize=(15,3),bins=100, xlim=(0,50))

xlimが簡単に設定できる

 

金額別ヒストグラム-2
  • sns.distplot(d_train[“Fare”], kde=False, rug=False, bins=100)
 
xlimは軸で設定するのでひと手間かかる
生存別金額-1
  • avgerage_fare = pd.DataFrame([fare_not_survived.mean(), fare_survived.mean()])
  • std_fare = pd.DataFrame([fare_not_survived.std(), fare_survived.std()])
  • avgerage_fare.plot(yerr=std_fare,kind=’bar’,legend=False)

みやすい。

 

生存別金額-2
  • sns.boxplot(x=’Survived’, y=”Fare”, data=d_train, palette=”PRGn”)

外れ値に左右される→外れ値を削除する。

 

生存別金額-3

  • sns.violinplot(x=’Survived’, y=”Fare”, data=d_train)

概要をつかむにはboxplotよりよい。

メタ情報

inarticle



メタ情報

inarticle



-Python
-

執筆者:


comment

メールアドレスが公開されることはありません。 * が付いている欄は必須項目です

関連記事

no image

SIGNATE お弁当の需要予測-5

相関の概要を見てみる。これによりどの変数を利用して回帰するかを考える。 sns.heatmap(d_train_w.corr(),cmap=’coolwarm’) Related posts:sele …

no image

配列を利用した四則演算とuniversal関数

四則演算 import numpy as np arr = np.arange(1,11) arr arr + arr arr * arr arr – 100 arr – arr [/cde] np. …

no image

automated the boring

まずは肩慣らし print(‘Hello world!’) print(‘What is your name?’) # ask for their na …

no image

pythonでpostgresqlを使うときに必要なモジュール

pip install psycopg2-binary Related posts:pythonで地理情報を取り扱うPython + Slack Bot – 1空の配列を生成

no image

カテゴリデータのビジュアル

カテゴリ別データのビジュアル 参考)https://www.kaggle.com/omarelgabry/a-journey-through-titanic?scriptVersionId=44779 …

2018年6月
« 5月   9月 »
 123
45678910
11121314151617
18192021222324
252627282930  

side bar top



アーカイブ

カテゴリー