arXiv論文:AIを30体に増やしても多数決の効果は限定的——13モデルで役割別に検証
複数AIの効果は人数より課題の種類と答えのまとめ方で決まり、多数決や平均では潜在力を引き出せない場合があると報告されました。
複数AIに同じ質問を投げるだけでは費用に見合わない場合があり、役割分担と回答の選び方が重要だと分かります。
ニュースをやさしく解説
結論から言うと、同じAIをたくさん集めても、単純な多数決や平均だけでは成績がほとんど伸びない課題があると分かりました。2026年9月25日にarXivへ投稿されたプレプリントです。研究チームは、集団課題を「誰か1人が正解すればよい型」と「複数の見積もりを平均する型」に分け、13種類の公開モデルを最大30体まで組み合わせました。
前者では、少なくとも1体が正解を出す確率は人数とともに5〜20ポイント上がりましたが、各AIの直接回答を多数決しても、その潜在的な伸びをほぼ回収できませんでした。理論モデルとの差は平均0.5ポイント以内でした。回答後に互いの意見を見て修正する方式は精度を上げましたが、仲間が1体の場合と29体の場合で改善量はほぼ同じでした。
数値を概算する課題では、同じモデルが共有する問題ごとの偏りが二乗誤差の約87%を占め、平均しても誤差は約6%しか減りませんでした。利用者にとっては、AIを増やす前に、異なるモデルや役割を使うか、候補から良い答えを選ぶ仕組みを設計する方が重要だという示唆です。ただし結果は選ばれた評価課題と公開モデルに限られ、企業の実務へそのまま当てはまるとは限りません。
査読前のarXivプレプリントであり、出典は論文要約です。2026年9月29日に確認しました。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon本評価順で探す ↗Amazon|AI論文・機械学習の入門書を評価順で探すAIニュースや論文ニュースを背景から理解したい人向け機械学習、深層学習、論文読みの入門書をレビュー評価順で探せます。数式レベルと対象読者を確認してください。
- Amazon本評価順で探す ↗Amazon|LLM・生成AIの仕組みを学ぶ本を評価順で探す個別AIの違いを、LLMの基本から理解したい人向けLLM、生成AI、深層学習の入門書を評価順で探せます。数式多めか実務寄りかを確認して選んでください。
- Amazon評価順で探す ↗Amazon|NotebookLM・Perplexityなど調査AIの本を評価順で探す資料調査・要約・比較をAIで速くしたい人向けNotebookLM、Perplexity、AIリサーチ、情報整理に近い本をレビュー評価順で確認できます。仕事・学習の目的に合わせて確認してください。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。