【総まとめ】Phase 2: 機械学習の手法

Phase 2 全17記事の要点を1ページに凝縮。教師あり/なし/強化学習の代表アルゴリズム、正則化、アンサンブル、評価指標、バイアス-バリアンスを総復習。

このフェーズで学んだ「機械学習の手法」全17記事の要点を1ページに凝縮します。試験直前の復習用にご活用ください。

雷門 あかり(笑い) 雷門 あかり

Phase 2 で学んだこと、振り返りたい!

六角 いずみ 先生(笑顔) 六角 いずみ 先生

機械学習の3大カテゴリは教師あり学習教師なし学習強化学習。
それぞれの代表アルゴリズムと用途を区別できるようにしましょう。

白銀 エマ(普段) 白銀 エマ

教師あり学習の柱: 線形回帰ロジスティック回帰決定木ランダムフォレストSVMブースティングナイーブベイズk-NN。
リッジ(L2) とラッソ(L1) の正則化、アンサンブル学習(バギング/ブースティング/スタッキング) も頻出。

紫藤 ゆら(笑顔) 紫藤 ゆら

教師なし学習はクラスタリングと次元削減だったよねぇ

六角 いずみ 先生(普段) 六角 いずみ 先生

そう。
k-means(セントロイドベース)・階層クラスタリング・DBSCAN(密度ベース)・PCAt-SNE(次元削減)。
教師なし=ラベルなしというキーポイントを忘れないで。

白銀 エマ(普段) 白銀 エマ

強化学習: エージェント・環境・報酬の3要素。
Q学習(価値ベース)・DQN(Q学習×DL)・方策勾配法(方策ベース)・Actor-Critic(両者の組合せ)。
AlphaGoは強化学習の代表的成果。

紫藤 ゆら(普段) 紫藤 ゆら

モデル評価では混同行列とF値が大事だったよねぇ

六角 いずみ 先生(笑顔) 六角 いずみ 先生

その通り。
混同行列(TP/TN/FP/FN)、適合率=TP/(TP+FP) (誤検知少なさ)、再現率=TP/(TP+FN) (見逃し少なさ)、F値(両者の調和平均)、AUC(ROC曲線下面積)。

白銀 エマ(普段) 白銀 エマ

そしてバイアス-バリアンストレードオフ: 単純すぎは未学習(高バイアス)、複雑すぎは過学習(高バリアンス)。
交差検証(k-fold CV) で汎化性能を評価。

雷門 あかり(笑い) 雷門 あかり

覚えること多いけど、こうやって整理されると頭に入るね!

六角 いずみ 先生(普段) 六角 いずみ 先生

次のPhase 3 はディープラーニングね。
Phase 2の機械学習が土台になるから、混同しがちな概念は再復習しておいてね。

確認クイズ

次のうち『教師なし学習』に該当するアルゴリズムはどれか。

  1. 線形回帰
  2. ロジスティック回帰
  3. k-means クラスタリング
  4. ランダムフォレスト
こたえを見る

正解: 3. k-means クラスタリング

k-means クラスタリングは教師なし学習 (ラベルなしデータをグループ化)。線形回帰は教師あり学習 (回帰)、ロジスティック回帰とランダムフォレストは教師あり学習 (分類)。同じ『k-』でも k-NN は教師あり学習なので混同注意。

六角いずみ先生、白銀エマ、紫藤ゆら、雷門あかりが校庭のガーデニングを楽しむ様子

🔖 この記事の関連書籍

Amazonアソシエイトリンクを含みます。他分野は おすすめ書籍ページ へ。