Oossa

Mistral Large 4, 미·중 외 모델 중 최고 순위

Mistral의 신규 1조 매개변수 모델은 독립 지수에서 38점을 기록했지만, 경쟁 오픈 모델보다 작업당 비용이 높다.

작성: Oossa 게시일: 1 분 읽기

ThisisEngineering · Unsplash

Mistral AI는 이번 주 Large 4 모델의 연구용 공개 프리뷰를 출시했다. 이 모델은 매개변수가 약 1조 개이며, 한 번에 활성화되는 매개변수는 490억 개다. 독립 벤치마크 업체 Artificial Analysis(AA)는 Intelligence Index에서 38점을 부여했다. 미국과 중국 이외 지역에서 나온 모델 중 가장 높은 점수다.

테스트 성적

AA의 Cyber Index에서 Large 4는 50점을 받아 중국 모델 GLM-5.3-Flash와 동점을 기록했으며, 더 높은 점수를 받은 MiMo-V2.6-Pro(56점)에만 뒤졌다. 가장 좋은 성적은 사이버 보안 과제인 CyberGym-E2E-AA에서 나왔다. 82%를 기록해 MiMo-V2.6-Pro(79%)와 최고 점수를 받은 GPT-6 Luna(78%)를 앞섰다. 문서와 이미지 추론 성능도 개선돼 GDP.pdf 테스트에서 MiMo-V2.6-Pro와 같은 19%를 기록했다.

가격과 이용 가능 여부

Mistral은 입력 토큰 100만 개당 $1.36, 출력 토큰 100만 개당 $4.18을 부과하며, 캐시된 입력에는 $0.14의 요금이 붙는다. Intelligence Index 작업당 비용으로 환산하면 $1.13이다. 프리뷰 출시 후 첫 2주 동안은 50% 할인돼 작업당 비용이 $0.57로 낮아진다. 회사는 전체 모델 가중치를 2026년 10월 말 공개할 예정이라고 밝혔다.

왜 중요한가

대규모 언어 모델이 필요한 개발자에게 Mistral Large 4는 높은 용량을 갖춘 선택지로, 여러 벤치마크에서 미국·중국 이외 지역의 다른 오픈 모델보다 우수한 성적을 보인다. 다만 가격이 더 높아, 요금이 낮아지거나 경쟁이 개선되기 전까지는 비용에 민감한 프로젝트에 덜 매력적일 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.