Alibaba (Qwen) · 모델

Qwen3-VL-8B-Instruct

오픈이미지 입력출시 2025년 10월 11일Qwen/Qwen3-VL-8B-InstructHugging Face ↗
종합 레이팅550 · 209위레이팅 벤치 57개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터8.8BQwen3VLForConditionalGeneration
라이선스apache-2.0
최근 30일 다운로드9.7M좋아요 1.2K · 7일 -6.4M
벤치 점수59개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용
분야레이팅분야 순위벤치 수
코딩8361692
에이전트992—1
추론·지식62419941
멀티모달7427811
과학·보안9091102
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

59개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench HardArtificial Analysis2.3%87 / 938확인됨 ↗
LiveCodeBench v6LLM Stats 집계39.3%50 / 512자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
OSWorldLLM Stats 집계33.9%11 / 1844자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis2.7%139 / 1411확인됨 ↗
Intelligence IndexArtificial Analysis7.3130 / 1418확인됨 ↗
AA-LCRArtificial Analysis16.7%126 / 1399확인됨 ↗
CritPTArtificial Analysis0%135 / 13912확인됨 ↗
GPQA DiamondArtificial Analysis42.7%123 / 1305확인됨 ↗
IFBenchArtificial Analysis32.3%89 / 978확인됨 ↗
τ²-Bench TelecomArtificial Analysis29.2%80 / 9617확인됨 ↗
MMLU-ProLLM Stats 집계71.6%52 / 6014자기보고 ↗
AIME 2025LLM Stats 집계45.9%40 / 400자기보고 ↗
LVBenchLLM Stats 집계58%22 / 2822자기보고 ↗
SuperGPQALLM Stats 집계44.5%25 / 2811자기보고 ↗
ERQALLM Stats 집계45.8%22 / 2513자기보고 ↗
MMLU-ReduxLLM Stats 집계84.9%22 / 2513자기보고 ↗
IFEvalLLM Stats 집계83.7%17 / 2430자기보고 ↗
MMLU-ProXLLM Stats 집계65.4%19 / 2422자기보고 ↗
IncludeLLM Stats 집계67%18 / 2219자기보고 ↗
MathVista-MiniLLM Stats 집계77.2%17 / 2224자기보고 ↗
MMStarLLM Stats 집계70.9%17 / 2224자기보고 ↗
HMMT25LLM Stats 집계32.5%19 / 205자기보고 ↗
Hallusion BenchLLM Stats 집계61.1%15 / 1922자기보고 ↗
PolyMATHLLM Stats 집계30.4%16 / 1917자기보고 ↗
AI2DLLM Stats 집계85.7%14 / 1824자기보고 ↗
CC-OCRLLM Stats 집계79.9%11 / 1841자기보고 ↗
OCRBenchLLM Stats 집계89.6%6 / 1871자기보고 ↗
MVBenchLLM Stats 집계68.7%16 / 160자기보고 ↗
BLINKLLM Stats 집계69.1%6 / 1564자기보고 ↗
MMBench-V1.1LLM Stats 집계85%14 / 157자기보고 ↗
ODinWLLM Stats 집계44.7%8 / 1550자기보고 ↗
BFCL-v3LLM Stats 집계66.3%11 / 1321자기보고 ↗
MMLULLM Stats 집계80.7%10 / 1325자기보고 ↗
MuirBenchLLM Stats 집계64.4%10 / 1325자기보고 ↗
OCRBench-V2 (en)LLM Stats 집계65.4%5 / 1367자기보고 ↗
CharadesSTALLM Stats 집계56%9 / 1227자기보고 ↗
Multi-IFLLM Stats 집계75.1%7 / 1250자기보고 ↗
InfoVQAtestLLM Stats 집계83.1%8 / 1130자기보고 ↗
OCRBench-V2 (zh)LLM Stats 집계61.2%4 / 1170자기보고 ↗
WritingBenchLLM Stats 집계83.1%7 / 1140자기보고 ↗
DocVQAtestLLM Stats 집계96.1%5 / 1061자기보고 ↗
LiveBench 20241125LLM Stats 집계62%9 / 1011자기보고 ↗
MM-MT-BenchLLM Stats 집계7.79 / 1017자기보고 ↗
MLVU-MLLM Stats 집계78.1%4 / 857자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis47.3%65 / 696확인됨 ↗
MMMU-ProLLM Stats 집계55.9%53 / 6113자기보고 ↗
CharXiv-RLLM Stats 집계46.4%47 / 482자기보고 ↗
MathVisionLLM Stats 집계53.9%29 / 3415자기보고 ↗
ScreenSpot-ProLLM Stats 집계54.6%21 / 2620자기보고 ↗
RealWorldQALLM Stats 집계71.5%24 / 254자기보고 ↗
VideoMMMULLM Stats 집계65.3%22 / 235자기보고 ↗
ScreenSpotLLM Stats 집계94.4%7 / 1660자기보고 ↗
CharXiv-DLLM Stats 집계83%11 / 129자기보고 ↗
Video-MMELLM Stats 집계71.4%11 / 110자기보고 ↗
MMMU (val)LLM Stats 집계69.6%7 / 925자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis20.5%92 / 13934확인됨 ↗
AA-Omniscience IndexArtificial Analysis-51.9115 / 13917확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis119 tok/s35 / 10868확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis2.19초34 / 10869확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 -9.1M (-48.3%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →