#RAG
「RAG」に関する記事一覧。Kuu株式会社のブログでは、AIエージェントガバナンスとDXの観点から RAG に関連するノウハウを 3 件発信しています。
RAGエージェント向けベクトルDB選定——pgvector・Weaviate・Qdrant・Pineconeの使い分け
AIエージェントRAG基盤のベクトルDB選定を解説。pgvectorは50M以下でコスト優位、Weaviateはハイブリッド検索特化、Qdrantは高速フィルタ、Pineconeは100M+自動スケールが強みです。
長文脈モデルの活用設計——200K/1Mトークンの使いどころ
長文脈モデルのコンテキストウィンドウ活用設計を解説。Context Rot現象、200K/1Mモデルの選択、RAGとのトレードオフ、Context Awareness、コンパクションを実装パターンで示します。
RAGとツール使用の使い分け——エージェント設計の情報取得戦略
AIエージェントの情報取得設計でRAGとツール使用のどちらを選ぶかは、予測可能性・コスト・タスク複雑性の3軸で決まります。Anthropicが示す設計判断の基準とAgentic RAGの実装パターンを解説します。