Oossa

InternLM, 수학 증명 채점을 위한 AutoVerifier 모델 Hugging Face에 공개

새 모델은 자연어로 작성된 증명을 검토하고 오류를 지적하며 최초로 잘못된 단계를 표시해 AdvancedMathBench 제출물을 평가하는 데 도움을 준다.

짧은 소식Oossa1 분 읽기

Hugging Face에 Qwen3_5Moe 아키텍처를 기반으로 한 InternLM의 AutoVerifier 모델이 공개됐다. 이 모델은 문제와 선택 사항인 참조 풀이, 단계별로 작성된 후보 증명을 입력받아 증명이 맞는지, 오류가 있는지, 가장 먼저 틀린 단계가 몇 번째인지 알려준다. 모델은 총 용량 약 68GiB에 달하는 safetensor 파일 40개로 구성돼 있으며, InternS1Tokenizer를 사용한다. AdvancedMathBench의 ProverBench 제품군을 자동 채점하는 용도로 설계됐지만, 제공업체는 여전히 오류가 발생할 수 있다고 밝혔다.

가중치를 불러오지 않고 모델을 실행하려면 제공된 proof_verifier.md 템플릿으로 프롬프트를 만든 뒤 토크나이저의 채팅 형식에 맞춰 입력하면 된다.

왜 중요한가

연구자들이 복잡한 수학 증명을 수작업으로 채점하지 않고도 빠르게 자동 평가할 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

#출처매체날짜핵심 내용
1New model on Hugging Face: internlm/AdvancedMathBench-AutoVerifier (image-text-to-text) ↗InternLM2026. 9. 29.Organisation internlm published internlm/AdvancedMathBench-AutoVerifier.

1 개 출처

최종 업데이트: ·Markdown·llms.txt