벤치마크 · 추론·지식

MathVista-Mini

MathVista-Mini 과제로 모델의 상대적인 문제 해결 성능을 비교합니다. 점수 하나로 전체 능력을 단정하지 말고 평가 조건을 함께 확인하세요.

측정 모델 22개 · 프로필 1개 · 데이터 기준 2026년 10월 9일

LLM Stats 집계

원문 출처 ↗

LLM Stats 공개 리더보드의 독립 프로필입니다. 검증·자기보고 여부를 보존합니다. 높을수록 좋습니다.

현재 최고점: 상용 Seed 2.0 Mini 85.5% · 오픈 Kimi-K2.5 90.1% → 오픈 모델이 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈90.1%1002026-01-01자기보고 ↗
2Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈87.8%952026-02-24자기보고 ↗
3Qwen3.5-122B-A10BAlibaba (Qwen) · 오픈 웨이트오픈87.4%882026-02-24자기보고 ↗
4Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈87.4%882026-04-21자기보고 ↗
5Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈86.4%812026-04-15자기보고 ↗
6Qwen3.5-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈86.2%762026-02-24자기보고 ↗
7Qwen3 VL 32B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈85.9%712025-09-22자기보고 ↗
8Qwen3 VL 235B A22B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈85.8%672025-09-22자기보고 ↗
9Seed 2.0 MiniByteDance (Seed) · 상용 APIAPI85.5%622026-02-17자기보고 ↗
10EXAONE-4.5-33BLG AI Research (EXAONE) · 오픈 웨이트오픈85%572026-04-04자기보고 ↗
11Qwen3 VL 235B A22B InstructAlibaba (Qwen) · 오픈 웨이트오픈84.9%522025-09-22자기보고 ↗
12Qwen3 VL 32B InstructAlibaba (Qwen) · 오픈 웨이트오픈83.8%482025-09-22자기보고 ↗
13Qwen3 VL 30B A3B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈81.9%432025-09-22자기보고 ↗
14Qwen3 VL 8B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈81.4%382025-09-22자기보고 ↗
15Qwen3 VL 30B A3B InstructAlibaba (Qwen) · 오픈 웨이트오픈80.1%332025-09-22자기보고 ↗
16Qwen3 VL 4B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈79.5%292025-09-22자기보고 ↗
17Qwen3-VL-8B-InstructAlibaba (Qwen) · 오픈 웨이트오픈77.2%242025-10-11자기보고 ↗
18Qwen2.5-VL-72B-InstructAlibaba (Qwen) · 오픈 웨이트오픈74.8%192025-01-27자기보고 ↗
19Qwen2.5 VL 32B InstructAlibaba (Qwen) · 오픈 웨이트오픈74.7%142025-02-28자기보고 ↗
20Qwen3 VL 4B InstructAlibaba (Qwen) · 오픈 웨이트오픈73.7%102025-09-22자기보고 ↗
21LFM2.5-VL-3BLiquid AI · 상용 APIAPI68.5%52026-08-12자기보고 ↗
22Qwen2.5-VL-7B-InstructAlibaba (Qwen) · 오픈 웨이트오픈68.2%02025-01-26자기보고 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.