> ## Content Index
> Fetch the complete content index at: https://hub.ku2t-lab.com/llms.txt
> Use this file to discover other available public pages before exploring further.

# 主成分を使った散布図
- URL: https://hub.ku2t-lab.com/gallery-pca1/
- Published: 2024-03-21T15:00:00.000Z
- Updated: 2026-04-03T02:07:31.000Z
- Author: 武田 邦敬
- Tags: ピープルアナリティクス, ギャラリー, Python, タレントマネジメント

主成分分析によって次元削減された人事データに対する散布図の可視化例です。コンピテンシーなどの複数の量的変数から構成されるデータを要約する目的で、主成分分析がよく使われています。その結果を散布図を利用して可視化し、特徴をつかむことができます。 

## 人事データ可視化の例

![散布図](https://storage.googleapis.com/studio-cms-assets/projects/G3qbJAGLqJ/s-626x552_v-fs_webp_82d3a4db-d71d-4301-9b56-dfc49a456a16.png)

## 人事データ可視化の狙い

- 多くの変数で構成されているコンピテンシーを主成分で要約し、人事属性との関連を探る。

## 人事データ可視化アプローチ

### 利用するグラフ

- **散布図**： 量的変数と量的変数の関係を可視化。

### アプローチ

- データからコンピテンシーに関する項目を抽出し、主成分分析を適用する。
- 第1主成分と第2主成分を使って、データの分布を可視化する。主成分の寄与率などを確認しながら他の主成分の状況も確認する。
- グレードなどのカテゴリカル変数で色分けし、コンピテンシーとの関連を探る。

## グラフの作り方

- Pythonのseaborn.scatterplotによる可視化例。

```python
import pandas as pd
import matplotlib.pyplot as plt
import matplotlib.ticker as ticker
import japanize_matplotlib
import seaborn as sns
from sklearn.decomposition import PCA

sns.set_theme(style='ticks')
plt.rcParams["figure.figsize"] = (6, 6)
japanize_matplotlib.japanize()

# データの読み込みと加工
df_hr = pd.read_csv('./hr-toydata-basic-600.csv')
df_hr['グレード'] = pd.Categorical(df_hr['グレード'], categories = ['M','L','S','E'])
comp = df_hr[['コンピテンシー_マネジメント',
 'コンピテンシー_戦略構想力',
 'コンピテンシー_対人',
 'コンピテンシー_創意工夫',
 'コンピテンシー_専門力',
 'コンピテンシー_チームワーク',
 'コンピテンシー_ストレス耐性']].copy()

# 主成分分析
pca = PCA()
ft = pca.fit_transform(comp)
res_pca = pd.DataFrame(ft,
 columns=['PC{}'.format(x + 1) for x in range(len(comp.columns))])

# グラフ
fig, ax = plt.subplots()
sns.scatterplot(data=pd.concat([df_hr, res_pca], axis=1), x='PC1', y='PC2', hue='グレード', alpha=.7, ax=ax)
ax.set_title('コンピテンシーの主成分とグレードの関係')
ax.legend(loc='upper left', bbox_to_anchor=(1, 1), title='グレード')
```

## この記事で使ったデータ

以下のページでデータを配布しています。

[人事トイデータの公開こちらのページでは、クニラボで作成した人事トイデータを公開しています。 トイデータとは？ トイデータ(Toy Data)とは、演習用に使えるリアルでないデータのことをいいます。データ分析や機械学習のライブラリに附属する場合もあり、手元にデータがなくてもそのライブラリをすぐに試せるのが利点です。 人事データ分析の演習にご活用ください ピープルアナリティクスを学んでみたいが手元に良いデータがない、という方も多いのではないでしょうか。人事データは個人情報を含むため、ピープルアナリティクスプロジェクトの正式なメンバーでないと触ることができません。 そこで、演習用にデータを自作しGoogleドライブより公開しています。これまでも代表のnote記事の中でリンクを張っていたのですが、複数の記事で利用するためこのページを作りました。 \* 2023/11/29追記 「HRトイデータ\_人事情報\_拡張版.csv 」を追加しました。 \* 2024/3/23追記 「HRトイデータ\_月別時間外.csv 」を追加しました。 \* 2024/11/18追記 「HRトイデータ\_エンゲージメントスコア![](https://storage.ghost.io/c/54/85/548553f8-0bec-43c7-af9d-5c0a5fe9f73b/content/images/icon/----------------5.png)People Analytics Idea HUB武田 邦敬![](https://storage.ghost.io/c/54/85/548553f8-0bec-43c7-af9d-5c0a5fe9f73b/content/images/thumbnail/23-1-1.png)](https://hub.ku2t-lab.com/toydata-for-people-analytics/)