AI研究検索・リサーチ確認済み

arXiv論文:手術動画でロボットを事前学習——4課題の平均成功率63.5%から77.8%へ

操作ラベルのない内視鏡動画を先に学ぶSurgical WAMが、少ない実演データで手術ロボットの成功率を高めました。

  • 2026-08-12
  • 最終確認日 2026-08-12
自分にどう関係する?

高価なロボット操作データを増やさず、比較的集めやすい動画で手術支援AIを改善できる可能性があります。

ニュースをやさしく解説

結論から言うと、手術ロボットは「人が操作した記録」を大量に集めなくても、内視鏡動画から先に手術場面の動きを学ぶことで、操作の成功率を高められる可能性があります。2026年8月11日にarXivへ投稿された論文で、研究チームはSurgical World-Action Model(Surgical WAM)を提案しました。

これはNVIDIAのCosmos Policyを土台に、次の内視鏡画像とロボットが実行する短い動作列を一緒に予測する生成モデルです。まず操作ラベルのない動画で、器具や組織がどう動くかを学び、その後、同じ量に固定した操作付き実演データで調整します。実行時は予測した動作の一部だけを行い、新しい画像を見て計画し直します。

4種類のシミュレーション手術課題では、動画による事前学習なしの平均成功率63.5%に対し、Surgical WAMは77.8%でした。物を移すPegTransferでは20ポイント改善し、接触が多い作業や両手を使う作業ほど効果が大きかったと報告しています。利用者にとっては、医療ロボットの学習データ作りを軽くし、限られた実演を生かす研究として重要です。

ただし結果はシミュレーション上の4課題であり、実際の患者への安全性や臨床性能を示したものではありません。掲載先は査読前論文を公開するarXivで、数値は論文要旨に基づきます。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(cs.RO)を開く