AI研究検索・リサーチ確認済み

arXiv論文:競技プログラミングAIがIOI 2026で535.4点、最高人間得点498.27を上回る

2万2千問の追加学習と、複数解答をテストして直すGenCorrectで、金メダル基準を超えました。

  • 2026-09-03
  • 最終確認日 2026-09-03
自分にどう関係する?

コードAIの性能を引き出すには、モデルの大きさだけでなく、良質な問題データと実行結果を使う反復修正が重要だと示します。

ニュースをやさしく解説

結論から言うと、競技プログラミング向けに追加学習したAIが、国際情報オリンピック(IOI)2026の同じ問題と制約で、人間の最高得点を上回ったとする研究が公開されました。

2026年9月2日のarXiv査読前論文「Post-Training Language Models for Gold-Medal Performance in Coding Competitions」は、2万2千問の厳選問題、AIが作った推論過程、教師あり微調整、強化学習を組み合わせています。

30B-A3BのNemotron-3-Nano-CCは、IOI 2025で元の130点から追加学習後291点、複数の解答を生成・実行・修正するGenCorrectを使うと468点となり、金メダル基準438.3点を超えました。550B-A55BのUltra-CCは502点でした。

その知見を基に作った大会専用Ultra-CCをIOI 2026で、人間と同じ時間、インターネット利用、提出回数の条件で評価したところ、600点中535.4点を獲得しました。金メダル基準361.12点と、人間最高の498.27点を上回ったと報告しています。難しいコード作成では、最初の答えだけでなく、テスト結果を使って複数案を直す流れが重要だと分かります。

ただし大会問題に特化した仕組みで、一般の業務開発、安全性、保守性を直接示す結果ではありません。得点と「初めて」という主張は著者によるもので、arXiv掲載の査読前研究として読む必要があります。

PR

AIをもっと深く学べる本

ニュースに出てきたAIやカテゴリに近い教材を優先しています。

広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。

広告

source

出典

提供状況や価格は変わるため、最終判断は公式情報で確認します。

arXiv(査読前論文)を開く