arXiv論文:RAGは資料が約1000万トークンを超えると古典的BM25が優位——AIエージェント検索を逆転
資料量を約450倍まで段階的に増やしてRAG方式を比較。小規模ではファイル探索AIが先行したが、約1000万トークンからBM25が逆転した。
RAGを高価なエージェントだけで組まず、BM25を入口にする実用的な根拠です。自社文書で費用と精度を測る設計判断に使えます。
ニュースをやさしく解説
結論から言うと、たくさんの社内文書から答えを探すRAGでは、AIエージェントに最初から全てを探させるより、まず古典的なキーワード検索BM25で候補を絞る方が強い場合がある。
2026年7月29日にarXivへ提出されたプレプリントは、同じ質問、読解モデル、採点方法を固定し、文書量だけを28段階、約450倍まで増やして、BM25、ベクトルを使う密検索、グラフ型RAG、ファイルシステムを探索するAIエージェントを比較した。
最小規模ではFile-System Agentが最も正確だったが、探索を順番に進めるため、基準となる小規模条件でも問い合わせ時のトークンを39倍使った。資料全体が約1000万トークンになるとBM25が逆転し、それより大きい共通条件では全て首位、最大規模では差が約20ポイントに近づいた。密検索は軽いが正確さで劣り、グラフ型は大規模化前の構築コストが壁になった。
社内FAQや文書検索を作る人には、まずBM25で広く候補を並べ、その後だけAIに読ませる設計が、費用と精度の現実的な出発点になる。注意点は、これはarXivの未査読プレプリントで、結果は使った文書、質問、モデルに依存すること。自社データで速度、費用、正答率を測ってから選びたい。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon本評価順で探す ↗Amazon|AI論文・機械学習の入門書を評価順で探すAIニュースや論文ニュースを背景から理解したい人向け機械学習、深層学習、論文読みの入門書をレビュー評価順で探せます。数式レベルと対象読者を確認してください。
- Amazon本評価順で探す ↗Amazon|LLM・生成AIの仕組みを学ぶ本を評価順で探す個別AIの違いを、LLMの基本から理解したい人向けLLM、生成AI、深層学習の入門書を評価順で探せます。数式多めか実務寄りかを確認して選んでください。
- Amazon評価順で探す ↗Amazon|NotebookLM・Perplexityなど調査AIの本を評価順で探す資料調査・要約・比較をAIで速くしたい人向けNotebookLM、Perplexity、AIリサーチ、情報整理に近い本をレビュー評価順で確認できます。仕事・学習の目的に合わせて確認してください。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。