研究・論文検索・リサーチ確認済み

arXiv論文:研究者の指示と実行結果からAI自身を二重に改善する「ScienceBuddy」

研究作業で得た依頼、評価基準、実行証拠を次の学習へ戻し、道具の構成とモデルの両方を改善します。

  • 2026-09-16
  • 最終確認日 2026-09-16
自分にどう関係する?

研究AIを毎回初期状態で使うのではなく、人の修正と実行結果を蓄積して継続的に改善する考え方です。

ニュースをやさしく解説

結論から言うと、研究者がAIへ頼んだ仕事と、その成否を次の改善材料に変え、研究支援AIを使いながら育てる仕組み「ScienceBuddy」が公開されました。

研究チームは2026年9月15日、arXivに論文「ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents」を公開し、Webサイトとコードも案内しました。

ScienceBuddyは研究者の日常作業を支援する作業空間で、依頼内容、研究者からの修正、実行時の証拠を、次回の課題と採点基準へ変換します。中心となる考えは二重の自己改善です。内側の循環ではAIモデルを変えず、プロンプトや道具、作業手順からなる実行基盤を改善します。外側の循環では、改善された基盤で得た経験を使ってモデルを強化学習します。

論文は4種類の科学課題について、研究者との対話、実行基盤の修正、モデル学習の事例を示しました。研究者には、単発の質問回答ではなく、自分の修正を蓄積して補助AIを育てる方向性が見えます。ただしarXivのプレプリントで、要約には大規模な比較数値や長期運用の安全性は示されていません。機密研究データの扱い、誤った評価基準を学ぶ危険、査読結果を確認して使う必要があります。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXivを開く