Alibaba (Qwen) · 모델

Qwen3 VL 235B A22B Thinking

오픈출시 2025년 9월 22일LLMStats/qwen3-vl-235b-a22b-thinkingHugging Face ↗
종합 레이팅854 · 149위레이팅 벤치 56개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터236B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수67개코딩·에이전트·추론·지식·멀티모달
분야레이팅분야 순위벤치 수
코딩967—1
에이전트1004—1
추론·지식91113846
멀티모달943538
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

67개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
LiveCodeBench v6LLM Stats 집계70.1%33 / 5136자기보고 ↗
Design2CodeLLM Stats 집계0.91 / 150자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
OSWorldLLM Stats 집계38.1%9 / 1853자기보고 ↗
OSWorld-GLLM Stats 집계0.71 / 150자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamLLM Stats 집계13.6%59 / 648자기보고 ↗
MMLU-ProLLM Stats 집계83.8%25 / 6060자기보고 ↗
AIME 2025LLM Stats 집계89.7%21 / 4049자기보고 ↗
LVBenchLLM Stats 집계63.6%18 / 2837자기보고 ↗
SuperGPQALLM Stats 집계64.3%13 / 2856자기보고 ↗
ERQALLM Stats 집계52.5%16 / 2538자기보고 ↗
MMLU-ReduxLLM Stats 집계93.7%7 / 2575자기보고 ↗
IFEvalLLM Stats 집계88.2%12 / 2452자기보고 ↗
MMLU-ProXLLM Stats 집계80.6%9 / 2465자기보고 ↗
IncludeLLM Stats 집계80%9 / 2264자기보고 ↗
MathVista-MiniLLM Stats 집계85.8%8 / 2267자기보고 ↗
MMStarLLM Stats 집계78.7%9 / 2262자기보고 ↗
HMMT25LLM Stats 집계77.4%11 / 2047자기보고 ↗
Hallusion BenchLLM Stats 집계66.7%6 / 1972자기보고 ↗
AI2DLLM Stats 집계89.2%8 / 1859자기보고 ↗
CC-OCRLLM Stats 집계81.5%5 / 1876자기보고 ↗
OCRBenchLLM Stats 집계87.5%12 / 1835자기보고 ↗
BLINKLLM Stats 집계67.1%11 / 1529자기보고 ↗
MMBench-V1.1LLM Stats 집계90.6%7 / 1557자기보고 ↗
ODinWLLM Stats 집계43.2%10 / 1536자기보고 ↗
SimpleVQALLM Stats 집계0.610 / 1536자기보고 ↗
BFCL-v3LLM Stats 집계71.9%4 / 1375자기보고 ↗
MMLULLM Stats 집계90.6%2 / 1392자기보고 ↗
MuirBenchLLM Stats 집계80.1%2 / 1392자기보고 ↗
OCRBench-V2 (en)LLM Stats 집계66.8%4 / 1375자기보고 ↗
ZEROBenchLLM Stats 집계0.013 / 130자기보고 ↗
CharadesSTALLM Stats 집계63.5%2 / 1286자기보고 ↗
Multi-IFLLM Stats 집계79.1%3 / 1282자기보고 ↗
SimpleQALLM Stats 집계44.4%8 / 1236자기보고 ↗
InfoVQAtestLLM Stats 집계89.5%2 / 1190자기보고 ↗
OCRBench-V2 (zh)LLM Stats 집계63.5%1 / 11100자기보고 ↗
WritingBenchLLM Stats 집계86.7%1 / 11100자기보고 ↗
DocVQAtestLLM Stats 집계96.5%3 / 1078자기보고 ↗
LiveBench 20241125LLM Stats 집계79.6%1 / 10100자기보고 ↗
MLVULLM Stats 집계83.8%9 / 1011자기보고 ↗
MM-MT-BenchLLM Stats 집계8.52 / 1094자기보고 ↗
CountBenchLLM Stats 집계0.98 / 80자기보고 ↗
Creative Writing v3LLM Stats 집계85.7%2 / 886자기보고 ↗
EmbSpatialBenchLLM Stats 집계0.83 / 864자기보고 ↗
RefCOCO-avgLLM Stats 집계0.93 / 871자기보고 ↗
RefSpatialBenchLLM Stats 집계0.73 / 871자기보고 ↗
MMLongBench-DocLLM Stats 집계0.65 / 620자기보고 ↗
ZEROBench-SubLLM Stats 집계0.36 / 60자기보고 ↗
HypersimLLM Stats 집계0.14 / 40자기보고 ↗
SUNRGBDLLM Stats 집계0.33 / 433자기보고 ↗
VisuLogicLLM Stats 집계0.34 / 40자기보고 ↗
ARKitScenesLLM Stats 집계0.51 / 150자기보고 ↗
MathVerse-MiniLLM Stats 집계0.91 / 150자기보고 ↗
MIABenchLLM Stats 집계0.91 / 150자기보고 ↗
ObjectronLLM Stats 집계0.71 / 150자기보고 ↗
RoboSpatialHomeLLM Stats 집계0.71 / 150자기보고 ↗
SIFOLLM Stats 집계0.81 / 150자기보고 ↗
SIFO-MultiturnLLM Stats 집계0.71 / 150자기보고 ↗
ZebraLogicLLM Stats 집계97.3%1 / 150자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계69.3%37 / 6140자기보고 ↗
CharXiv-RLLM Stats 집계66.1%38 / 4821자기보고 ↗
MathVisionLLM Stats 집계74.6%19 / 3445자기보고 ↗
ScreenSpot-ProLLM Stats 집계61.8%15 / 2644자기보고 ↗
RealWorldQALLM Stats 집계81.3%15 / 2542자기보고 ↗
VideoMMMULLM Stats 집계80%15 / 2336자기보고 ↗
ScreenSpotLLM Stats 집계95.4%4 / 1683자기보고 ↗
VideoMME w/o sub.LLM Stats 집계79%6 / 1044자기보고 ↗
MMMUvalLLM Stats 집계80.6%1 / 2100자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →