AI研究検索・リサーチ確認済み

arXiv論文:AIを30体に増やしても多数決の効果は限定的——13モデルで役割別に検証

複数AIの効果は人数より課題の種類と答えのまとめ方で決まり、多数決や平均では潜在力を引き出せない場合があると報告されました。

  • 2026-09-29
  • 最終確認日 2026-09-29
自分にどう関係する?

複数AIに同じ質問を投げるだけでは費用に見合わない場合があり、役割分担と回答の選び方が重要だと分かります。

ニュースをやさしく解説

結論から言うと、同じAIをたくさん集めても、単純な多数決や平均だけでは成績がほとんど伸びない課題があると分かりました。2026年9月25日にarXivへ投稿されたプレプリントです。研究チームは、集団課題を「誰か1人が正解すればよい型」と「複数の見積もりを平均する型」に分け、13種類の公開モデルを最大30体まで組み合わせました。

前者では、少なくとも1体が正解を出す確率は人数とともに5〜20ポイント上がりましたが、各AIの直接回答を多数決しても、その潜在的な伸びをほぼ回収できませんでした。理論モデルとの差は平均0.5ポイント以内でした。回答後に互いの意見を見て修正する方式は精度を上げましたが、仲間が1体の場合と29体の場合で改善量はほぼ同じでした。

数値を概算する課題では、同じモデルが共有する問題ごとの偏りが二乗誤差の約87%を占め、平均しても誤差は約6%しか減りませんでした。利用者にとっては、AIを増やす前に、異なるモデルや役割を使うか、候補から良い答えを選ぶ仕組みを設計する方が重要だという示唆です。ただし結果は選ばれた評価課題と公開モデルに限られ、企業の実務へそのまま当てはまるとは限りません。

査読前のarXivプレプリントであり、出典は論文要約です。2026年9月29日に確認しました。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(プレプリント)を開く