벤치마크 · 추론·지식

HMMT25

수학 문제를 단계적으로 추론해 정확한 최종 답을 내는 능력을 평가합니다.

측정 모델 20개 · 프로필 1개 · 데이터 기준 2026년 10월 9일

LLM Stats 집계

원문 출처 ↗

LLM Stats 공개 리더보드의 독립 프로필입니다. 검증·자기보고 여부를 보존합니다. 높을수록 좋습니다.

현재 최고점: 상용 Qwen3.6 Plus 94.6% · 오픈 Qwen3.5-397B-A17B 92.7% → 상용이 1.9%p 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Qwen3.6 PlusAlibaba (Qwen) · 상용 APIAPI94.6%1002026-04-02자기보고 ↗
2Qwen3.5-397B-A17BAlibaba (Qwen) · 오픈 웨이트오픈92.7%952026-02-16자기보고 ↗
3Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈90.7%892026-04-21자기보고 ↗
4Qwen3.5-122B-A10BAlibaba (Qwen) · 오픈 웨이트오픈90.3%842026-02-24자기보고 ↗
5Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈89.8%792026-02-24자기보고 ↗
6Qwen3.5-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈89.2%742026-02-24자기보고 ↗
7IBM Granite 4.2 30BIBM · 오픈 웨이트오픈89.2%682026-08-25자기보고 ↗
8Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈89.1%632026-04-15자기보고 ↗
9Qwen3.5-9BAlibaba (Qwen) · 오픈 웨이트오픈82.9%582026-02-27자기보고 ↗
10IBM Granite 4.2 8BIBM · 오픈 웨이트오픈78.3%532026-08-25자기보고 ↗
11Qwen3 VL 235B A22B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈77.4%472025-09-22자기보고 ↗
12Qwen3.5-4BAlibaba (Qwen) · 오픈 웨이트오픈76.8%422026-03-02자기보고 ↗
13Qwen3 VL 30B A3B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈67.6%372025-09-22자기보고 ↗
14IBM Granite 4.2 3BIBM · 오픈 웨이트오픈66.7%322026-08-25자기보고 ↗
15Qwen3 VL 8B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈60.6%262025-09-22자기보고 ↗
16Qwen3 VL 235B A22B InstructAlibaba (Qwen) · 오픈 웨이트오픈57.4%212025-09-22자기보고 ↗
17Qwen3 VL 4B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈53.1%162025-09-22자기보고 ↗
18Qwen3 VL 30B A3B InstructAlibaba (Qwen) · 오픈 웨이트오픈50.6%112025-09-22자기보고 ↗
19Qwen3-VL-8B-InstructAlibaba (Qwen) · 오픈 웨이트오픈32.5%52025-10-11자기보고 ↗
20Qwen3 VL 4B InstructAlibaba (Qwen) · 오픈 웨이트오픈30.7%02025-09-22자기보고 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.