Alibaba (Qwen) · 모델

Qwen3 VL 32B Instruct

오픈출시 2025년 9월 22일LLMStats/qwen3-vl-32b-instructHugging Face ↗
종합 레이팅709 · 189위레이팅 벤치 55개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터33.0B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수57개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용
분야레이팅분야 순위벤치 수
코딩8711542
에이전트979—1
추론·지식77017941
멀티모달926579
과학·보안8431312
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

57개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench HardArtificial Analysis8.3%74 / 9321확인됨 ↗
LiveCodeBench v6LLM Stats 집계43.8%48 / 516자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
OSWorldLLM Stats 집계32.6%12 / 1835자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis6.8%118 / 14116확인됨 ↗
Intelligence IndexArtificial Analysis8.4124 / 14112확인됨 ↗
CritPTArtificial Analysis0%129 / 13912확인됨 ↗
GPQA DiamondArtificial Analysis67.1%107 / 13018확인됨 ↗
IFBenchArtificial Analysis39.2%77 / 9721확인됨 ↗
τ²-Bench TelecomArtificial Analysis29.2%79 / 9617확인됨 ↗
GPQA DiamondLLM Stats 집계68.9%80 / 9011자기보고 ↗
MMLU-ProLLM Stats 집계78.6%42 / 6031자기보고 ↗
AIME 2025LLM Stats 집계66.2%37 / 408자기보고 ↗
LVBenchLLM Stats 집계63.8%17 / 2841자기보고 ↗
SuperGPQALLM Stats 집계54.6%20 / 2830자기보고 ↗
ERQALLM Stats 집계48.8%19 / 2525자기보고 ↗
MMLU-ReduxLLM Stats 집계89.8%17 / 2533자기보고 ↗
IFEvalLLM Stats 집계84.7%16 / 2435자기보고 ↗
MMLU-ProXLLM Stats 집계73.4%15 / 2439자기보고 ↗
IncludeLLM Stats 집계74%14 / 2238자기보고 ↗
MathVista-MiniLLM Stats 집계83.8%12 / 2248자기보고 ↗
MMStarLLM Stats 집계77.7%11 / 2252자기보고 ↗
Hallusion BenchLLM Stats 집계63.8%12 / 1939자기보고 ↗
PolyMATHLLM Stats 집계40.5%15 / 1922자기보고 ↗
AI2DLLM Stats 집계89.5%7 / 1865자기보고 ↗
CC-OCRLLM Stats 집계80.3%10 / 1847자기보고 ↗
OCRBenchLLM Stats 집계89.5%7 / 1865자기보고 ↗
MVBenchLLM Stats 집계72.8%8 / 1653자기보고 ↗
BLINKLLM Stats 집계67.3%10 / 1536자기보고 ↗
ODinWLLM Stats 집계46.6%7 / 1557자기보고 ↗
BFCL-v3LLM Stats 집계70.2%6 / 1358자기보고 ↗
MMLULLM Stats 집계86.4%6 / 1358자기보고 ↗
MuirBenchLLM Stats 집계72.8%9 / 1338자기보고 ↗
OCRBench-V2 (en)LLM Stats 집계67.4%2 / 1392자기보고 ↗
Arena-Hard v2LLM Stats 집계64.7%6 / 1255자기보고 ↗
CharadesSTALLM Stats 집계61.2%6 / 1255자기보고 ↗
Multi-IFLLM Stats 집계72%10 / 1218자기보고 ↗
InfoVQAtestLLM Stats 집계87%5 / 1160자기보고 ↗
OCRBench-V2 (zh)LLM Stats 집계59.2%6 / 1145자기보고 ↗
WritingBenchLLM Stats 집계82.9%8 / 1130자기보고 ↗
DocVQAtestLLM Stats 집계96.9%2 / 1089자기보고 ↗
LiveBench 20241125LLM Stats 집계72.2%4 / 1067자기보고 ↗
MM-MT-BenchLLM Stats 집계8.43 / 1078자기보고 ↗
Creative Writing v3LLM Stats 집계85.6%3 / 871자기보고 ↗
MLVU-MLLM Stats 집계82.1%1 / 8100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis64.3%58 / 6916확인됨 ↗
MMMU-ProLLM Stats 집계65.3%43 / 6130자기보고 ↗
CharXiv-RLLM Stats 집계62.8%40 / 4817자기보고 ↗
MathVisionLLM Stats 집계63.4%24 / 3430자기보고 ↗
ScreenSpot-ProLLM Stats 집계57.9%18 / 2632자기보고 ↗
RealWorldQALLM Stats 집계79%17 / 2533자기보고 ↗
ScreenSpotLLM Stats 집계95.8%1 / 16100자기보고 ↗
CharXiv-DLLM Stats 집계90.5%4 / 1273자기보고 ↗
MMMU (val)LLM Stats 집계76%3 / 981자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis14.8%122 / 13912확인됨 ↗
AA-Omniscience IndexArtificial Analysis-63.4130 / 1397확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis68 tok/s72 / 10834확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis2.58초49 / 10855확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →