벤치마크 · 추론·지식

HMMT February 2026

수학 문제를 단계적으로 추론해 정확한 최종 답을 내는 능력을 평가합니다.

측정 모델 19개 · 프로필 1개 · 데이터 기준 2026년 10월 9일

HF 리더보드

원문 출처 ↗

같은 Hugging Face 리더보드 데이터셋·과제의 결과만 표시합니다. 높을수록 좋습니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Darwin-180B-RSIFINAL-Bench · 오픈 웨이트오픈100%1002026-09-28확인됨 ↗
2Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈92.7%942026-04-14확인됨 ↗
3Inkling-SmallThinking Machines · 오픈 웨이트오픈90.2%892026-07-27확인됨 ↗
4Qwen3.5-397B-A17BAlibaba (Qwen) · 오픈 웨이트오픈87.9%832026-02-16인용 ↗
5Intern-S2-PreviewShanghai AI Lab (InternLM) · 오픈 웨이트오픈87.3%782026-05-15확인됨 ↗
6Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈87.1%722026-01-01인용 ↗
7Ling-3.0-flashinclusionAI (Ant) · 오픈 웨이트오픈87%672026-08-02확인됨 ↗
8GLM-5Z.ai (GLM) · 오픈 웨이트오픈86.4%582026-02-11인용 ↗
9Step-3.5-FlashStepFun · 오픈 웨이트오픈86.4%582026-02-01인용 ↗
10NVIDIA-Nemotron-3-Super-120B-A12B-BF16NVIDIA · 오픈 웨이트오픈84.9%502026-03-10인용 ↗
11Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈84.3%442026-04-21확인됨 ↗
12Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈83.6%392026-04-15확인됨 ↗
13GLM-5.1Z.ai (GLM) · 오픈 웨이트오픈82.6%312026-04-03확인됨 ↗
14GLM-5.1-MXFP4-Mixed-CT-AutoRoundINCModel3 · 오픈 웨이트오픈82.6%312026-08-31인용 ↗
15Nemotron-Cascade-2-30B-A3BNVIDIA · 오픈 웨이트오픈81.1%192026-03-18확인됨 ↗
16Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈81.1%192026-02-24인용 ↗
17Qwen3-30B-A3B-Thinking-2507Alibaba (Qwen) · 오픈 웨이트오픈78.8%112025-07-29인용 ↗
18Qwen3-4B-Thinking-2507Alibaba (Qwen) · 오픈 웨이트오픈53.0%62025-08-05인용 ↗
19Ling-2.6-flashinclusionAI (Ant) · 오픈 웨이트오픈49.3%02026-04-28확인됨 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.