ロングコンテキストで RAG を省く (long-context-over-rag)
中程度の文書量なら、ベクトルデータベースや埋め込み(RAG)を用意せず、コーディングエージェントの検索とロングコンテキストだけで Q&A できる、という考え方。INLlUqYJ4vA で にゃんたが 知識ベースの文脈で紹介する。
文章を AI に参照させる一般的な仕組みは RAG だが、ベクトル DB や埋め込みの前処理・管理が要る。動画では、100記事・約40万トークン程度なら、Claude Codeがエージェントとして勝手に検索し、約100万トークンのコンテキストにも収まるので普通に使える、とされる。
トークン消費は大きく、Pro や 5x プランでは上限に当たりやすい。Max 20x、または Sonnet など軽量モデルや他のコーディングエージェントの利用が代替案として挙げられる。