arXiv論文:競技プログラミングAIがIOI 2026で535.4点、最高人間得点498.27を上回る
2万2千問の追加学習と、複数解答をテストして直すGenCorrectで、金メダル基準を超えました。
コードAIの性能を引き出すには、モデルの大きさだけでなく、良質な問題データと実行結果を使う反復修正が重要だと示します。
ニュースをやさしく解説
結論から言うと、競技プログラミング向けに追加学習したAIが、国際情報オリンピック(IOI)2026の同じ問題と制約で、人間の最高得点を上回ったとする研究が公開されました。
2026年9月2日のarXiv査読前論文「Post-Training Language Models for Gold-Medal Performance in Coding Competitions」は、2万2千問の厳選問題、AIが作った推論過程、教師あり微調整、強化学習を組み合わせています。
30B-A3BのNemotron-3-Nano-CCは、IOI 2025で元の130点から追加学習後291点、複数の解答を生成・実行・修正するGenCorrectを使うと468点となり、金メダル基準438.3点を超えました。550B-A55BのUltra-CCは502点でした。
その知見を基に作った大会専用Ultra-CCをIOI 2026で、人間と同じ時間、インターネット利用、提出回数の条件で評価したところ、600点中535.4点を獲得しました。金メダル基準361.12点と、人間最高の498.27点を上回ったと報告しています。難しいコード作成では、最初の答えだけでなく、テスト結果を使って複数案を直す流れが重要だと分かります。
ただし大会問題に特化した仕組みで、一般の業務開発、安全性、保守性を直接示す結果ではありません。得点と「初めて」という主張は著者によるもので、arXiv掲載の査読前研究として読む必要があります。
AIをもっと深く学べる本
ニュースに出てきたAIやカテゴリに近い教材を優先しています。
- Amazon本評価順で探す ↗Amazon|AI論文・機械学習の入門書を評価順で探すAIニュースや論文ニュースを背景から理解したい人向け機械学習、深層学習、論文読みの入門書をレビュー評価順で探せます。数式レベルと対象読者を確認してください。
- Amazon本評価順で探す ↗Amazon|LLM・生成AIの仕組みを学ぶ本を評価順で探す個別AIの違いを、LLMの基本から理解したい人向けLLM、生成AI、深層学習の入門書を評価順で探せます。数式多めか実務寄りかを確認して選んでください。
- Amazon評価順で探す ↗Amazon|NotebookLM・Perplexityなど調査AIの本を評価順で探す資料調査・要約・比較をAIで速くしたい人向けNotebookLM、Perplexity、AIリサーチ、情報整理に近い本をレビュー評価順で確認できます。仕事・学習の目的に合わせて確認してください。
広告(アフィリエイト)リンクを含みます。最新の内容・料金・在庫・条件は、リンク先の公式ページ・販売ページでご確認ください。