RAG (検索拡張生成) - LLMの知識を最新化する技術

RAGの仕組みを、ベクトルDB・埋め込みベクトル・近似最近傍探索から解説。ハイブリッド検索・HyDE・GraphRAGまで押さえます。

『RAG』は企業のLLM活用で必須の技術。ハルシネーション対策と最新情報対応の要です。

雷門 あかり(普段) 雷門 あかり

ChatGPTに最新のこと聞くと『知らない』って返ってくるのなんで?

六角 いずみ 先生(普段) 六角 いずみ 先生

LLMには知識カットオフ(Knowledge Cutoff) があって、学習データの時点までしか知らないのよ。
最新情報や社内データは持っていないの。

白銀 エマ(普段) 白銀 エマ

これを解決するのがRAG(検索拡張生成, Retrieval-Augmented Generation)。
外部データベースから関連情報を検索して、それをLLMのプロンプトに含めてから応答させる手法よ。
2020年にFacebookのLewis等が提案したわ。

紫藤 ゆら(普段) 紫藤 ゆら

AIに先に資料を渡してから質問するってことですかぁ?

六角 いずみ 先生(笑顔) 六角 いずみ 先生

まさにそう。
仕組みは3ステップ: 1) ユーザの質問を埋め込みベクトル化、2) ベクトルDBで類似文書を検索、3) 検索結果とユーザ質問をLLMに渡して応答生成。

白銀 エマ(普段) 白銀 エマ

埋め込みモデルはOpenAI Embeddingやsentence-transformersが定番。
ベクトルDBにはPinecone、Weaviate、Chroma、Qdrantなどがあるわ。

雷門 あかり(笑い) 雷門 あかり

ベクトルDBって普通のDBとどう違うの?

六角 いずみ 先生(普段) 六角 いずみ 先生

ベクトルDBは類似度検索(コサイン類似度やユークリッド距離) に特化したDB。
近似最近傍探索(ANN) のアルゴリズム (HNSW、IVF) で高速に類似文書を見つけられるの。

白銀 エマ(普段) 白銀 エマ

RAGの利点は3つ: 1) 最新情報に対応できる、2) 社内データを使える、3) ハルシネーションを大幅に減らせる。
出典付き回答ができるのも強みね。

紫藤 ゆら(笑顔) 紫藤 ゆら

会社で使うのにぴったりですぅ♪

六角 いずみ 先生(普段) 六角 いずみ 先生

ただし課題もあって、検索品質次第で回答の質が決まる。
適切なチャンク分割(文書を小片化) と再ランキングが重要よ。

白銀 エマ(普段) 白銀 エマ

近年はハイブリッド検索(ベクトル検索+BM25キーワード検索)、HyDE(仮想文書検索)、GraphRAG(知識グラフ連携) など改善手法が多数登場しているわ。

雷門 あかり(笑い) 雷門 あかり

RAGって今のLLM活用の要なんだね!

六角 いずみ 先生(普段) 六角 いずみ 先生

G検定では『RAG (Lewis 2020)』『ベクトルDB』『埋め込みベクトル』『知識カットオフ対応』『ハルシネーション削減』を押さえておいてね!

確認クイズ

LLMに外部データベースから関連情報を検索して与え、知識カットオフ問題を解決する手法はどれか。

  1. ファインチューニング
  2. RAG (検索拡張生成)
  3. プロンプトチューニング
  4. 蒸留
こたえを見る

正解: 2. RAG (検索拡張生成)

RAG (Retrieval-Augmented Generation)は、ユーザの質問をベクトル化してDB検索し、関連文書をLLMに渡して応答生成する手法です。知識カットオフ対応、社内データ活用、ハルシネーション削減に有効です。

六角いずみ先生、白銀エマ、紫藤ゆら、雷門あかりがキャンプでカレー作りを楽しむ様子

🔖 この記事の関連書籍

Amazonアソシエイトリンクを含みます。他分野は おすすめ書籍ページ へ。