Alibaba (Qwen) · 모델

Qwen3.6 Plus

API출시 2026년 4월 2일LLMStats/qwen3.6-plus공식 문서 ↗
종합 레이팅1127 · 71위레이팅 벤치 77개
컨텍스트 창1M
가격 (입력 / 출력, 1M 토큰)$0.500 / $3.00혼합 $1.13
파라미터—
라이선스—
벤치 점수80개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

추론·지식과 멀티모달 레이팅이 돋보이는 1M 컨텍스트 상용 API

포지션

종합 레이팅은 1104(56위), 가중 비교는 32다. 레이팅은 같은 벤치 비교로 만든 상대 지표다. 분야별로 추론·지식 1179(21위), 멀티모달 1101(13위), 코딩 998(59위), 에이전트 917(50위)다.

벤치 결과

같은 LLM Stats 집계 프로필에서 MMLU-Pro 88.5%(3/60), SuperGPQA 71.6%(2/28), AIME 2026 95.3%(7/26), LiveCodeBench v6 87.1%(11/51), SWE-bench Verified 78.8%(18/58)다. 모두 미검증 수치다.

도입 조건

상용 API로 제공되며 컨텍스트는 1M이다. 가격은 1M 토큰당 입력 $0.500, 출력 $3.00이다. 최대 출력과 라이선스는 자료 없음이다.

판단 포인트

에이전트 관련 벤치는 Terminal-Bench 2.0 61.6%(16/40), Toolathlon 39.8%(34/38), OSWorld-Verified 62.5%(22/26)다. 과학·보안 분야 레이팅은 자료 없음이므로 해당 용도는 별도 검증이 필요하다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩1040749
에이전트931829
추론·지식11715147
멀티모달10962210
과학·보안1031502
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

80개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis61.4%42 / 9757확인됨 ↗
Terminal-Bench HardArtificial Analysis43.9%21 / 9379확인됨 ↗
SWE-bench VerifiedLLM Stats 집계78.8%18 / 5870자기보고 ↗
SWE-bench ProLLM Stats 집계56.6%35 / 5538자기보고 ↗
LiveCodeBench v6LLM Stats 집계87.1%11 / 5180자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계61.6%16 / 4062자기보고 ↗
SWE-bench MultilingualLLM Stats 집계73.8%17 / 3553자기보고 ↗
IMO-AnswerBenchLLM Stats 집계83.8%12 / 1838자기보고 ↗
FrontierSWELLM Stats 집계22%17 / 170인용 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis24.7%59 / 10444확인됨 ↗
ToolathlonLLM Stats 집계39.8%34 / 3811자기보고 ↗
MCP Atlas · PublicLLM Stats 집계74.1%18 / 3651자기보고 ↗
OSWorld-VerifiedLLM Stats 집계62.5%22 / 2616자기보고 ↗
Finance Agent v2LLM Stats 집계40.9%17 / 2120인용 ↗
SkillsBenchLLM Stats 집계45.7%9 / 1227자기보고 ↗
Claw-EvalLLM Stats 집계58.7%9 / 1011자기보고 ↗
MCP-MarkLLM Stats 집계48.2%5 / 843자기보고 ↗
TAU3-BenchLLM Stats 집계70.7%1 / 7100자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis27.8%71 / 14150확인됨 ↗
Intelligence IndexArtificial Analysis27.054 / 14162확인됨 ↗
AA-LCRArtificial Analysis78.3%51 / 13964확인됨 ↗
CritPTArtificial Analysis2.9%71 / 13950확인됨 ↗
GPQA DiamondArtificial Analysis88.2%45 / 13066확인됨 ↗
IFBenchArtificial Analysis75.2%19 / 9781확인됨 ↗
τ²-Bench TelecomArtificial Analysis97.7%7 / 9694확인됨 ↗
GPQA DiamondLLM Stats 집계90.4%26 / 9073자기보고 ↗
Humanity's Last ExamLLM Stats 집계28.8%45 / 6430자기보고 ↗
MMLU-ProLLM Stats 집계88.5%3 / 6096자기보고 ↗
IFBenchLLM Stats 집계74.2%21 / 4251자기보고 ↗
MMMLULLM Stats 집계89.5%10 / 3069자기보고 ↗
SuperGPQALLM Stats 집계71.6%2 / 2896자기보고 ↗
AIME 2026LLM Stats 집계95.3%7 / 2676자기보고 ↗
ERQALLM Stats 집계65.7%7 / 2575자기보고 ↗
MMLU-ReduxLLM Stats 집계94.5%3 / 2590자기보고 ↗
IFEvalLLM Stats 집계94.3%3 / 2489자기보고 ↗
MMLU-ProXLLM Stats 집계84.7%4 / 2489자기보고 ↗
LiveBenchLLM Stats 집계70.9%19 / 2318인용 ↗
AA-LCRLLM Stats 집계68.3%9 / 2262자기보고 ↗
NL2RepoLLM Stats 집계37.9%20 / 2210자기보고 ↗
IncludeLLM Stats 집계85.1%4 / 2286자기보고 ↗
MMStarLLM Stats 집계83.3%1 / 22100자기보고 ↗
HMMT25LLM Stats 집계94.6%1 / 20100자기보고 ↗
PolyMATHLLM Stats 집계77.4%3 / 1989자기보고 ↗
AI2DLLM Stats 집계94.4%1 / 18100자기보고 ↗
CC-OCRLLM Stats 집계83.4%1 / 18100자기보고 ↗
WMT24++LLM Stats 집계84.3%5 / 1673자기보고 ↗
Global PIQALLM Stats 집계89.8%6 / 1568자기보고 ↗
HMMT 2025LLM Stats 집계96.7%3 / 1586자기보고 ↗
ODinWLLM Stats 집계51.8%1 / 15100자기보고 ↗
SimpleVQALLM Stats 집계0.78 / 1550자기보고 ↗
WideSearchLLM Stats 집계74.3%7 / 1557자기보고 ↗
LongBench v2LLM Stats 집계62%3 / 1485자기보고 ↗
HMMT Feb 26LLM Stats 집계87.8%8 / 1342자기보고 ↗
C-EvalLLM Stats 집계93.3%2 / 1291자기보고 ↗
MAXIFELLM Stats 집계88.2%4 / 1277자기보고 ↗
NOVA-63LLM Stats 집계57.9%6 / 1255자기보고 ↗
VITA-BenchLLM Stats 집계44.3%4 / 1170자기보고 ↗
DeepPlanningLLM Stats 집계41.5%2 / 1089자기보고 ↗
MLVULLM Stats 집계86.7%3 / 1078자기보고 ↗
DynaMathLLM Stats 집계88%1 / 9100자기보고 ↗
CountBenchLLM Stats 집계1.05 / 843자기보고 ↗
RefCOCO-avgLLM Stats 집계0.91 / 8100자기보고 ↗
MMLongBench-DocLLM Stats 집계0.61 / 6100자기보고 ↗
V*LLM Stats 집계96.9%2 / 690자기보고 ↗
TIR-BenchLLM Stats 집계61.6%1 / 4100자기보고 ↗
We-MathLLM Stats 집계89%1 / 150자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis78.0%28 / 6960확인됨 ↗
MMMU-ProLLM Stats 집계78.8%17 / 6173자기보고 ↗
CharXiv-RLLM Stats 집계81.5%22 / 4855자기보고 ↗
MathVisionLLM Stats 집계88%9 / 3476자기보고 ↗
ScreenSpot-ProLLM Stats 집계68.2%13 / 2652자기보고 ↗
RealWorldQALLM Stats 집계85.4%8 / 2571자기보고 ↗
VideoMMMULLM Stats 집계84%8 / 2368자기보고 ↗
OmniDocBench 1.5LLM Stats 집계91.2%3 / 2089자기보고 ↗
MMMULLM Stats 집계86%1 / 13100자기보고 ↗
Video-MMELLM Stats 집계84.2%6 / 1150자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis26.4%68 / 13951확인됨 ↗
AA-Omniscience IndexArtificial Analysis0.947 / 13967확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis56 tok/s82 / 10824확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis1.95초30 / 10873확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →