# Nemotron 모델, IOI·IMO서 금메달 기준 넘어서

> Nemotron-3를 미세 조정한 모델들이 2026년 국제정보올림피아드와 국제수학올림피아드에서 금메달 기준을 웃도는 점수를 받았다.

Oossa · 2026-10-07 · https://oossa.com/ko/nemotron-models-hit-gold-level-in-ioi-and-imo-contests

Hugging Face에 따르면 Nemotron-3 기반의 특화 모델 2종이 2026년 국제정보올림피아드(IOI)와 국제수학올림피아드(IMO)에서 금메달에 해당하는 점수를 기록했다. Nemotron-3-Ultra-CC라는 이름의 IOI 시스템은 600점 만점에 535.4점을 받아 금메달 기준인 361.12점을 크게 웃돌았으며, 인간 참가자 최고 점수인 498.27점도 넘어섰다. Nemotron-3-Ultra를 바탕으로 지도 미세 조정(SFT)과 강화 학습(RL)을 모두 적용한 IMO 시스템은 42점 만점에 30점을 받아 공식 금메달 기준인 29점을 근소하게 넘겼다.

## 연구진은 어떤 작업을 했나?

두 프로젝트 모두 대규모 Nemotron-3 기반 모델에서 출발해 분야별 문제를 모으고 일반적인 사후 학습 기법을 적용했다. IOI 연구진은 프로그래밍 문제 22,000개를 선별하고 합성 추론 과정을 추가한 뒤 SFT를 적용했으며, 더 작은 Nano 모델에는 RL도 적용했다. 답을 생성하고 평가한 뒤 다듬는 추론 루프인 GenCorrect도 활용했다. IMO 연구진은 증명 생성·비평·검증을 다루는 필터링된 증명 예시 414,890개로 구성된 데이터셋을 만들고, 체크포인트 하나에는 SFT를, 다른 하나에는 RL을 적용했다. 최종 IMO 시스템은 두 체크포인트를 범용 모델과 결합하고, 증명을 생성·검증·개선하는 파이프라인을 실행했다.

## 연구 결과는 어디서 볼 수 있나?

모델과 데이터셋, 코드는 모두 Hugging Face에 공개돼 있다. Nemotron-3-Ultra-CC 체크포인트를 내려받을 수 있으며, IOI 논문에는 GenCorrect 방법론이 설명돼 있다. IMO 프로젝트에는 SFT 및 RL 체크포인트, 올림피아드 수준 문제 200개로 구성된 Nemotron-IMO-Bench 벤치마크, 추론 파이프라인과 프롬프트가 담긴 NeMo-Skills 저장소가 포함된다. 연구진은 커뮤니티가 ‘네 단계 레시피’, 즉 성능이 뛰어난 기반 모델에서 시작해 데이터를 선별하고 SFT/RL을 적용한 뒤 피드백 기반 추론 루프와 결합하는 방법을 재사용하길 바란다.

## 팩트

- Nemotron-3-Ultra-CC는 2026년 IOI에서 600점 만점에 535.4점을 받아 금메달 기준인 361.12점과 인간 참가자 최고 점수인 498.27점을 모두 넘어섰다.
- IMO 시스템은 2026년 IMO에서 42점 만점에 30점을 받아 공식 금메달 기준인 29점을 근소하게 웃돌았다.
- IOI 미세 조정에는 프로그래밍 문제 22,000개와 합성 추론 과정이 사용됐고, IMO 미세 조정에는 고유 문제 15,818개를 다루는 증명 예시 414,890개가 사용됐다.
- Nemotron-3-Nano-CC는 총 매개변수 300억 개, 활성 매개변수 30억 개이며, Nemotron-3-Ultra-CC는 총 매개변수 5,500억 개, 활성 매개변수 550억 개다.

## 왜 중요한가

개발자들에게 이번 결과는 재현 가능한 미세 조정 레시피를 통해 대형 모델 하나를 최고 수준의 인간 참가자와 겨룰 수 있는 전문 모델로 바꿀 수 있음을 보여준다. 취미 개발자와 연구팀도 기반 모델을 처음부터 새로 학습시키지 않고 고성능 코드 생성 도구나 증명 작성 도구를 만들 수 있다는 뜻이다.

## 출처 및 참고 자료

1. [One Model Family, Two Gold-Level Results: Fine-Tuning Nemotron for IOI and IMO](https://huggingface.co/blog/nvidia/nemotron-ioi-and-imo-2026) – Hugging Face, 2026-10-07

최종 업데이트: 2026-10-07
