研究論文検索・リサーチ確認済み

arXiv論文:言葉の指示をロボット学習まで一貫させるSUN、9課題で成功率82.03%

制御・強化学習・診断で同じ意味定義を再利用し、手作業の報酬設計や実演なしでロボットを学習させます。

  • 2026-08-31
  • 最終確認日 2026-09-01
自分にどう関係する?

ロボットへ作業を教えるための人間の実演と細かな報酬設計を減らせる可能性があります。

ニュースをやさしく解説

結論から言うと、ロボットへ言葉で頼んだ目的が、制御や学習の途中でずれてしまう問題を、同じ意味の設計図を使い続ける方法で減らせる可能性が示されました。2026年8月31日にarXivへ投稿されたプレプリントは、SUN(Semantically UNified)Programsと、これを使うKuafuという仕組みを提案しています。

物の位置関係や接触条件を一度だけ型付きプログラムとして定義し、モデル予測制御の費用、成功判定、強化学習の報酬、段階の切り替え、診断へ共通に変換します。大規模な画像・言語モデルが、言葉と場面からプログラムを自動生成し、まずシミュレーションで実行可能か確かめます。9課題での平均成功率は82.03%で、報酬が成功時だけの方法は35.67%、模倣学習の比較法は24.75%でした。

8,192並列では、人が遠隔操作する場合の10.57倍の成功軌跡時間を1時間に生成したと報告しています。各課題500軌跡で学んだ方策は、シミュレーション46.0%、実機のFrankaとKinovaで34.7%成功しました。将来、家庭や工場のロボットへ複雑な手順を教える費用を下げる研究です。ただしarXiv段階で査読済みとは限らず、対象は9課題です。

実環境の安全性や未知の物体への対応を確定する結果ではなく、数値は論文内の条件で読む必要があります。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXivを開く