HarvestBench研究チーム検索・リサーチ確認済み

arXiv論文:農作業AIの動物回避率に大差、9モデルの致死選択は0.4〜98.8%

動物を避けるために燃料を使うかを行動で測り、能力の高さだけでは安全な選択を予測できないと示しました。

  • 2026-09-08
  • 最終確認日 2026-09-08
自分にどう関係する?

AIへ目的だけを渡すのではなく、避けるべき被害も具体的に指示し、行動結果を監視する必要性が分かります。

ニュースをやさしく解説

結論から言うと、AIエージェントが目標達成の途中で生き物への被害を避けるかは、モデルによって大きく異なり、一般的な能力の高さだけでは予測できません。

2026年9月3日にarXivへ投稿されたプレプリント「HarvestBench」は、2台のトラクターが協力してトウモロコシを収穫する仮想環境を作り、動物が進路をふさいだ時に、無料で直進するか、決められた燃料を使って迂回するかをAIへ選ばせました。9モデル、価格を示した7201回の判断を調べ、このうち3951回が動物との遭遇でした。

動物をひく選択の割合はモデル間で0.4%から98.8%まで開き、岩は全モデルが1%未満しかひかなかったため、単なる操作の理解不足だけでは説明できないとしています。6つの推論モデルでは、道徳上の配慮を説明した条件で5モデルの割合が6%未満だった一方、その説明を外すと全6モデルが84%を超えました。

利用者には、作業目標だけでなく避けるべき副作用を指示と評価項目へ明記する重要性を示します。ただしこれは農場を単純化したゲームで、実機の自動運転や現実の倫理判断を直接測ったものではありません。数値は査読前のarXivプレプリントで報告された実験結果です。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(プレプリント)を開く