AI研究検索・リサーチ確認済み

arXiv論文:RAGは資料が約1000万トークンを超えると古典的BM25が優位——AIエージェント検索を逆転

資料量を約450倍まで段階的に増やしてRAG方式を比較。小規模ではファイル探索AIが先行したが、約1000万トークンからBM25が逆転した。

  • 2026-07-31
  • 最終確認日 2026-07-31
自分にどう関係する?

RAGを高価なエージェントだけで組まず、BM25を入口にする実用的な根拠です。自社文書で費用と精度を測る設計判断に使えます。

ニュースをやさしく解説

結論から言うと、たくさんの社内文書から答えを探すRAGでは、AIエージェントに最初から全てを探させるより、まず古典的なキーワード検索BM25で候補を絞る方が強い場合がある。

2026年7月29日にarXivへ提出されたプレプリントは、同じ質問、読解モデル、採点方法を固定し、文書量だけを28段階、約450倍まで増やして、BM25、ベクトルを使う密検索、グラフ型RAG、ファイルシステムを探索するAIエージェントを比較した。

最小規模ではFile-System Agentが最も正確だったが、探索を順番に進めるため、基準となる小規模条件でも問い合わせ時のトークンを39倍使った。資料全体が約1000万トークンになるとBM25が逆転し、それより大きい共通条件では全て首位、最大規模では差が約20ポイントに近づいた。密検索は軽いが正確さで劣り、グラフ型は大規模化前の構築コストが壁になった。

社内FAQや文書検索を作る人には、まずBM25で広く候補を並べ、その後だけAIに読ませる設計が、費用と精度の現実的な出発点になる。注意点は、これはarXivの未査読プレプリントで、結果は使った文書、質問、モデルに依存すること。自社データで速度、費用、正答率を測ってから選びたい。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(未査読プレプリント)を開く