Alibaba (Qwen) · 모델

Qwen3 VL 4B Instruct

오픈출시 2025년 9월 22일LLMStats/qwen3-vl-4b-instructHugging Face ↗
종합 레이팅427 · 216위레이팅 벤치 56개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터4.0B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수56개코딩·에이전트·추론·지식·멀티모달·과학·보안
분야레이팅분야 순위벤치 수
코딩8191772
에이전트947—1
추론·지식51120741
멀티모달7297910
과학·보안8231412
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

56개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench HardArtificial Analysis0%91 / 932확인됨 ↗
LiveCodeBench v6LLM Stats 집계37.9%51 / 510자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
OSWorldLLM Stats 집계26.2%16 / 1812자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis3.6%135 / 1414확인됨 ↗
Intelligence IndexArtificial Analysis5.7139 / 1411확인됨 ↗
AA-LCRArtificial Analysis14%129 / 1397확인됨 ↗
CritPTArtificial Analysis0%130 / 13912확인됨 ↗
GPQA DiamondArtificial Analysis37.1%124 / 1305확인됨 ↗
IFBenchArtificial Analysis31.8%90 / 977확인됨 ↗
τ²-Bench TelecomArtificial Analysis23.4%84 / 9613확인됨 ↗
MMLU-ProLLM Stats 집계67.1%56 / 607자기보고 ↗
AIME 2025LLM Stats 집계46.6%39 / 403자기보고 ↗
LVBenchLLM Stats 집계56.2%23 / 2819자기보고 ↗
SuperGPQALLM Stats 집계40.3%26 / 287자기보고 ↗
ERQALLM Stats 집계41.3%25 / 250자기보고 ↗
MMLU-ReduxLLM Stats 집계81.5%23 / 258자기보고 ↗
IFEvalLLM Stats 집계82.3%21 / 2415자기보고 ↗
MMLU-ProXLLM Stats 집계59.4%22 / 249자기보고 ↗
IncludeLLM Stats 집계61.4%20 / 2210자기보고 ↗
MathVista-MiniLLM Stats 집계73.7%20 / 2210자기보고 ↗
MMStarLLM Stats 집계69.8%19 / 2214자기보고 ↗
HMMT25LLM Stats 집계30.7%20 / 200자기보고 ↗
Hallusion BenchLLM Stats 집계57.6%16 / 1917자기보고 ↗
PolyMATHLLM Stats 집계28.8%17 / 1911자기보고 ↗
AI2DLLM Stats 집계84.1%18 / 180자기보고 ↗
CC-OCRLLM Stats 집계76.2%17 / 186자기보고 ↗
OCRBenchLLM Stats 집계88.1%11 / 1841자기보고 ↗
MVBenchLLM Stats 집계68.9%15 / 167자기보고 ↗
BLINKLLM Stats 집계65.8%12 / 1521자기보고 ↗
MMBench-V1.1LLM Stats 집계85.1%13 / 1514자기보고 ↗
ODinWLLM Stats 집계48.2%5 / 1571자기보고 ↗
BFCL-v3LLM Stats 집계63.3%12 / 138자기보고 ↗
MMLULLM Stats 집계77.2%13 / 130자기보고 ↗
MuirBenchLLM Stats 집계63.8%11 / 1317자기보고 ↗
OCRBench-V2 (en)LLM Stats 집계63.7%7 / 1350자기보고 ↗
CharadesSTALLM Stats 집계55.5%10 / 1218자기보고 ↗
SimpleQALLM Stats 집계48%7 / 1245자기보고 ↗
InfoVQAtestLLM Stats 집계80.3%11 / 110자기보고 ↗
OCRBench-V2 (zh)LLM Stats 집계57.6%10 / 1110자기보고 ↗
WritingBenchLLM Stats 집계82.5%10 / 1110자기보고 ↗
DocVQAtestLLM Stats 집계95.3%6 / 1039자기보고 ↗
LiveBench 20241125LLM Stats 집계60.9%10 / 100자기보고 ↗
MM-MT-BenchLLM Stats 집계7.510 / 100자기보고 ↗
MLVU-MLLM Stats 집계75.3%6 / 829자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis43.9%67 / 693확인됨 ↗
MMMU-ProLLM Stats 집계53.2%55 / 6110자기보고 ↗
CharXiv-RLLM Stats 집계39.7%48 / 480자기보고 ↗
MathVisionLLM Stats 집계51.6%31 / 349자기보고 ↗
ScreenSpot-ProLLM Stats 집계59.5%17 / 2636자기보고 ↗
RealWorldQALLM Stats 집계70.9%25 / 250자기보고 ↗
VideoMMMULLM Stats 집계56.2%23 / 230자기보고 ↗
ScreenSpotLLM Stats 집계94%8 / 1653자기보고 ↗
CharXiv-DLLM Stats 집계76.2%12 / 120자기보고 ↗
MMMU (val)LLM Stats 집계67.4%8 / 913자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis10.9%128 / 1398확인됨 ↗
AA-Omniscience IndexArtificial Analysis-76.0137 / 1391확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →