OpenAI · 모델

GPT-5.2

API출시 2025년 12월 11일LLMStats/gpt-5.2-2025-12-11공식 문서 ↗
종합 레이팅1124 · 51위가중 비교 10.5
컨텍스트 창400K
가격 (입력 / 출력, 1M 토큰)$1.75 / $14.0혼합 $4.81
파라미터—
라이선스—
벤치 점수24개코딩·에이전트·추론·지식·멀티모달
분야레이팅분야 순위비교 수
코딩1030—0.5
에이전트916—1.5
추론·지식1148316.5
멀티모달1101142
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

24개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench VerifiedLLM Stats 집계80%15 / 5875자기보고 ↗
SWE-Lancer (IC-Diamond subset)LLM Stats 집계74.6%2 / 20자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
BrowseCompLLM Stats 집계65.8%32 / 4733자기보고 ↗
ToolathlonLLM Stats 집계46.3%29 / 3824자기보고 ↗
MCP Atlas · PublicLLM Stats 집계60.6%32 / 3611자기보고 ↗
BrowseComp Long Context 128kLLM Stats 집계92%1 / 150자기보고 ↗
BrowseComp Long Context 256kLLM Stats 집계89.8%1 / 150자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계92.4%13 / 9086자기보고 ↗
Humanity's Last ExamLLM Stats 집계34.5%42 / 6435자기보고 ↗
AIME 2025LLM Stats 집계100%2 / 4097자기보고 ↗
MMMLULLM Stats 집계89.6%9 / 3072자기보고 ↗
LiveBenchLLM Stats 집계74.8%11 / 2355인용 ↗
Tau2 TelecomLLM Stats 집계98.7%3 / 2089자기보고 ↗
HMMT 2025LLM Stats 집계99.4%1 / 15100자기보고 ↗
ARC-AGI v2LLM Stats 집계52.9%8 / 1446자기보고 ↗
Graphwalks BFS >128kLLM Stats 집계94%1 / 12100자기보고 ↗
Tau2 RetailLLM Stats 집계82%4 / 1067자기보고 ↗
Graphwalks parents >128kLLM Stats 집계89%4 / 857자기보고 ↗
ARC-AGILLM Stats 집계86.2%4 / 750자기보고 ↗
FrontierMathLLM Stats 집계40.3%5 / 733자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계79.5%15 / 6177자기보고 ↗
CharXiv-RLLM Stats 집계82.1%20 / 4860자기보고 ↗
ScreenSpot-ProLLM Stats 집계86.3%3 / 2692자기보고 ↗
VideoMMMULLM Stats 집계85.9%4 / 2386자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

OpenAI의 다른 모델

공급사 →