Alibaba (Qwen) · 모델

Qwen3 VL 235B A22B Instruct

오픈출시 2025년 9월 22일LLMStats/qwen3-vl-235b-a22b-instructHugging Face ↗
종합 레이팅811 · 168위레이팅 벤치 58개
컨텍스트 창262K
가격 (입력 / 출력, 1M 토큰)$0.200 / $0.880혼합 $0.370
파라미터236B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수63개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용
분야레이팅분야 순위벤치 수
코딩8731532
에이전트1036—1
추론·지식87515344
멀티모달915619
과학·보안9051132
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

63개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench HardArtificial Analysis6.8%76 / 9318확인됨 ↗
LiveCodeBench v6LLM Stats 집계54.3%44 / 5114자기보고 ↗
LiveCodeBench v5LLM Stats 집계61.4%1 / 150자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
OSWorldLLM Stats 집계66.7%5 / 1876자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis6.6%119 / 14116확인됨 ↗
Intelligence IndexArtificial Analysis9.9116 / 14118확인됨 ↗
AA-LCRArtificial Analysis32.7%118 / 13915확인됨 ↗
CritPTArtificial Analysis0%127 / 13912확인됨 ↗
GPQA DiamondArtificial Analysis71.2%102 / 13022확인됨 ↗
IFBenchArtificial Analysis42.7%73 / 9725확인됨 ↗
τ²-Bench TelecomArtificial Analysis35.1%76 / 9621확인됨 ↗
MMLU-ProLLM Stats 집계81.8%34 / 6044자기보고 ↗
AIME 2025LLM Stats 집계74.7%34 / 4015자기보고 ↗
LVBenchLLM Stats 집계67.7%15 / 2848자기보고 ↗
SuperGPQALLM Stats 집계60.4%16 / 2844자기보고 ↗
ERQALLM Stats 집계51.3%18 / 2529자기보고 ↗
MMLU-ReduxLLM Stats 집계92.2%13 / 2550자기보고 ↗
IFEvalLLM Stats 집계87.8%13 / 2446자기보고 ↗
MMLU-ProXLLM Stats 집계77.8%11 / 2457자기보고 ↗
IncludeLLM Stats 집계80%8 / 2264자기보고 ↗
MathVista-MiniLLM Stats 집계84.9%11 / 2252자기보고 ↗
MMStarLLM Stats 집계78.4%10 / 2257자기보고 ↗
HMMT25LLM Stats 집계57.4%16 / 2021자기보고 ↗
Hallusion BenchLLM Stats 집계63.2%13 / 1933자기보고 ↗
AI2DLLM Stats 집계89.7%6 / 1871자기보고 ↗
CC-OCRLLM Stats 집계82.2%2 / 1894자기보고 ↗
OCRBenchLLM Stats 집계92%3 / 1888자기보고 ↗
BLINKLLM Stats 집계70.7%5 / 1571자기보고 ↗
MMBench-V1.1LLM Stats 집계89.9%8 / 1550자기보고 ↗
ODinWLLM Stats 집계48.6%4 / 1579자기보고 ↗
BFCL-v3LLM Stats 집계67.7%8 / 1342자기보고 ↗
MMLULLM Stats 집계88.8%3 / 1383자기보고 ↗
MuirBenchLLM Stats 집계72.8%8 / 1338자기보고 ↗
OCRBench-V2 (en)LLM Stats 집계67.1%3 / 1383자기보고 ↗
Arena-Hard v2LLM Stats 집계77.4%1 / 12100자기보고 ↗
CharadesSTALLM Stats 집계64.8%1 / 12100자기보고 ↗
Multi-IFLLM Stats 집계76.3%5 / 1264자기보고 ↗
SimpleQALLM Stats 집계51.9%5 / 1264자기보고 ↗
InfoVQAtestLLM Stats 집계89.2%3 / 1175자기보고 ↗
OCRBench-V2 (zh)LLM Stats 집계61.8%3 / 1180자기보고 ↗
WritingBenchLLM Stats 집계85.5%3 / 1175자기보고 ↗
DocVQAtestLLM Stats 집계97.1%1 / 10100자기보고 ↗
LiveBench 20241125LLM Stats 집계74.8%2 / 1089자기보고 ↗
MLVULLM Stats 집계84.3%8 / 1022자기보고 ↗
MM-MT-BenchLLM Stats 집계8.51 / 1094자기보고 ↗
AndroidWorld_SRLLM Stats 집계63.7%4 / 850자기보고 ↗
Creative Writing v3LLM Stats 집계86.5%1 / 8100자기보고 ↗
CSimpleQALLM Stats 집계83.4%2 / 467자기보고 ↗
MultiPL-ELLM Stats 집계86.1%1 / 150자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis67.6%51 / 6926확인됨 ↗
MMMU-ProLLM Stats 집계68.1%40 / 6134자기보고 ↗
CharXiv-RLLM Stats 집계62.1%41 / 4815자기보고 ↗
MathVisionLLM Stats 집계66.5%22 / 3436자기보고 ↗
ScreenSpot-ProLLM Stats 집계62%14 / 2648자기보고 ↗
RealWorldQALLM Stats 집계79.3%16 / 2538자기보고 ↗
VideoMMMULLM Stats 집계74.7%18 / 2323자기보고 ↗
ScreenSpotLLM Stats 집계95.4%3 / 1683자기보고 ↗
VideoMME w/o sub.LLM Stats 집계79.2%5 / 1056자기보고 ↗
MMMUvalLLM Stats 집계78.7%2 / 20자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis20.3%93 / 13933확인됨 ↗
AA-Omniscience IndexArtificial Analysis-52.7117 / 13916확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis52 tok/s87 / 10820확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis2.71초51 / 10853확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →