【総まとめ】Phase 4: 生成AIと応用

Phase 4 全16記事の要点を1ページに凝縮。LLM・スケーリング則・RLHF・プロンプト技法・RAG・AIエージェント・拡散モデル・マルチモーダルを総復習。

このフェーズで学んだ「生成AIと応用」全15記事の要点を1ページに凝縮します。試験直前の復習用にご活用ください。

雷門 あかり(笑い) 雷門 あかり

Phase 4 で生成AI、全部やりきったね!

六角 いずみ 先生(笑顔) 六角 いずみ 先生

そう。
柱は3つ: ①LLM (大規模言語モデル) の仕組み、②プロンプトとRAG・エージェント、③拡散モデル/マルチモーダルの応用。

白銀 エマ(普段) 白銀 エマ

LLM基礎: GPTClaudeGeminiLLaMA の代表モデル、スケーリング則(モデルサイズ・データ・計算量で性能が予測可能)、RLHF(人間フィードバック強化学習: PPO使用) によるアライメント、創発的能力・インストラクションチューニング。

紫藤 ゆら(普段) 紫藤 ゆら

プロンプトエンジニアリング、奥が深かったですぅ〜

六角 いずみ 先生(普段) 六角 いずみ 先生

うん。
Zero-shotFew-shotChain-of-Thought(CoT) ・Tree-of-Thought・ReAct・Self-Consistency。
プロンプトインジェクション対策も重要。

白銀 エマ(普段) 白銀 エマ

応用技術: RAG(Retrieval-Augmented Generation: 外部知識ベース+LLM)、AIエージェント+Function Calling、ハルシネーション対策、ファインチューニング(LoRAQLoRA)。

雷門 あかり(笑い) 雷門 あかり

拡散モデルとマルチモーダルは画像生成のやつだね!

六角 いずみ 先生(笑顔) 六角 いずみ 先生

拡散モデル(Diffusion Model: ノイズ除去過程で生成、Stable Diffusion・DALL-E・Midjourney)、マルチモーダル(GPT-4V・Gemini)、動画生成(Sora)、音声生成(WaveNet・VALL-E)。

白銀 エマ(普段) 白銀 エマ

応用タスクとして、画像認識(YOLO/U-Net等は復習として)、自然言語処理(機械翻訳/要約/感情分析)、強化学習応用(AlphaGo/AlphaFold/自動運転) も重要。

紫藤 ゆら(びっくり) 紫藤 ゆら

新しいモデル、どんどん出てきますねぇ〜

六角 いずみ 先生(普段) 六角 いずみ 先生

そう。
G検定では2024年シラバス改訂で生成AI関連が大幅増加。
RLHF・RAG・プロンプトインジェクション・ハルシネーション・AI事業者ガイドラインなどは要チェック。

白銀 エマ(普段) 白銀 エマ

重要なのは『各技術がなぜ生まれたか』『何を解決したか』。
例: RAGは『LLMの知識更新が遅い・ハルシネーションが発生する』という問題への対処、RLHFは『LLMの応答が不適切』という問題への対処。

雷門 あかり(笑い) 雷門 あかり

よっしゃ、次は倫理・法律のフェーズだね!

六角 いずみ 先生(普段) 六角 いずみ 先生

Phase 5 では、Phase 4 で学んだ生成AIの社会的影響と規制を扱うのよ。
技術と社会をつなぐ大事なフェーズね。

確認クイズ

ChatGPT が人間の好みに沿った応答を返すために用いられている代表的な技術はどれか。

  1. RLHF (人間フィードバックによる強化学習)
  2. PCA (主成分分析)
  3. k-means クラスタリング
  4. ナイーブベイズ
こたえを見る

正解: 1. RLHF (人間フィードバックによる強化学習)

RLHF (Reinforcement Learning from Human Feedback) は人間が複数の応答を比較・ランキングし、その嗜好を報酬モデルとして学習させ、PPO 等で LLM をアライメントする手法。ChatGPT・Claude・Gemini などの対話型 LLM の核心技術です。

六角いずみ先生、白銀エマ、紫藤ゆら、雷門あかりがテニスのダブルスを楽しむ様子

🔖 この記事の関連書籍

Amazonアソシエイトリンクを含みます。他分野は おすすめ書籍ページ へ。