長く考えるAIのメモリを一定にする「Prefix Sliding」、学習なしで最大3倍高速化
最初の指示と直近の思考だけを残し、中間過程を捨てることで長い推論の負担を抑える研究です。
長時間の推論を、メモリ不足や高い計算費用で止めずに動かすためのシンプルな方法を示しています。
ニュースをやさしく解説
結論から言うと、AIが長く考えるとき、最初の指示と直近の思考だけを残し、古い途中経過を捨てても、性能を保ちながら計算を軽くできる可能性があります。2026年8月26日にarXivへ提出されたプレプリントで、研究チームはPrefix Slidingという方法を発表しました。
現在の多くの言語モデルは、推論を続けるほど過去の思考トークンをすべてメモリに保持するため、難しい問題ほど処理時間と必要メモリが増えます。Prefix Slidingは、課題の指示や利用可能な道具を書いた冒頭部分と、直近数千トークンの作業部分だけを注意機構から見える状態にし、その間にある古い推論を順次外します。これにより、どれだけ長く考えても保持する文脈量に上限を設けられます。
著者らは、追加学習なしでも既存モデルを最大3倍高速にしながら性能を維持できたと報告しています。さらに、この方式を使って強化学習すると、10万トークンを超える推論まで伸ばせて、途中内容を要約する方式や通常のスライディングウィンドウより良い結果になりました。利用者にとっては、数学、調査、コード修正など、長い試行錯誤が必要なAIを安く動かす設計につながります。
ただし、すべての途中経過が不要とは限らず、古い重要情報を捨てる課題では失敗する可能性があります。また、これは査読済み会議論文ではなくarXiv上のプレプリントであり、最大3倍という数字は著者らの実験条件に基づきます。実サービスでの速度、料金、品質は別途検証が必要です。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon本評価順で探す ↗Amazon|AI論文・機械学習の入門書を評価順で探すAIニュースや論文ニュースを背景から理解したい人向け機械学習、深層学習、論文読みの入門書をレビュー評価順で探せます。数式レベルと対象読者を確認してください。
- Amazon本評価順で探す ↗Amazon|LLM・生成AIの仕組みを学ぶ本を評価順で探す個別AIの違いを、LLMの基本から理解したい人向けLLM、生成AI、深層学習の入門書を評価順で探せます。数式多めか実務寄りかを確認して選んでください。
- Amazon評価順で探す ↗Amazon|NotebookLM・Perplexityなど調査AIの本を評価順で探す資料調査・要約・比較をAIで速くしたい人向けNotebookLM、Perplexity、AIリサーチ、情報整理に近い本をレビュー評価順で確認できます。仕事・学習の目的に合わせて確認してください。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。