Google · 모델

Gemini 3 Pro

API출시 2025년 11월 18일LLMStats/gemini-3-pro-preview공식 문서 ↗
종합 레이팅1085 · 81위레이팅 벤치 20개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)—
파라미터—
라이선스—
벤치 점수21개코딩·추론·지식·멀티모달

AI AI 해설

2026년 10월 9일 생성

Gemini 3 Pro는 멀티모달과 추론·지식이 상대적으로 돋보이는 상용 API 모델

종합 평가

종합 레이팅은 1063(68위), 가중 비교는 10이다. 레이팅은 같은 벤치 비교를 바탕으로 한 상대 지표다. 분야별로 추론·지식 1074(52위), 멀티모달 1057(17위), 코딩 994를 기록했다.

벤치마크 특징

LLM Stats 집계 프로필에서 AIME 2025는 100%(1/40), VideoMMMU는 87.6%(1/23), SimpleQA는 72.1%(1/12)다. SWE-bench Verified는 76.2%(32/58), MMMU-Pro는 81%(10/61)다. 모든 점수는 미검증이다.

적용 전 확인사항

에이전트와 과학·보안은 자료 없음이다. 컨텍스트, 최대 출력, 입력·출력 가격, 라이선스도 자료가 없다. 업무 도입 전 API 한도와 비용 조건을 별도로 확인해야 한다.

공급사 모델 흐름

Google의 같은 공급사 최신 모델로 DiarizationLM-Gemma-4-E4B-v1, Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.5 Flash-Lite가 제시돼 있다. 본 모델의 출시는 2025-11-18이며 접근 방식은 상용 API다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩1005863
에이전트———
추론·지식10857612
멀티모달1053325
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

21개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench VerifiedLLM Stats 집계76.2%32 / 5846자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계54.2%27 / 4033자기보고 ↗
LiveCodeBench ProLLM Stats 집계2,4392 / 575자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계91.9%17 / 9082자기보고 ↗
Humanity's Last ExamLLM Stats 집계45.8%28 / 6457자기보고 ↗
AIME 2025LLM Stats 집계100%1 / 4097자기보고 ↗
MMMLULLM Stats 집계91.8%4 / 3091자기보고 ↗
LiveBenchLLM Stats 집계73.4%14 / 2341인용 ↗
MRCR v2 (8-needle)LLM Stats 집계26.3%17 / 2221자기보고 ↗
t2-benchLLM Stats 집계85.4%7 / 1967자기보고 ↗
Global PIQALLM Stats 집계93.4%1 / 15100자기보고 ↗
ARC-AGI v2LLM Stats 집계31.1%13 / 148자기보고 ↗
SimpleQALLM Stats 집계72.1%1 / 12100자기보고 ↗
MathArena ApexLLM Stats 집계23.4%10 / 1110자기보고 ↗
Vending-Bench 2LLM Stats 집계547,816%3 / 433자기보고 ↗
FACTS GroundingLLM Stats 집계70.5%1 / 2100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계81%10 / 6185자기보고 ↗
CharXiv-RLLM Stats 집계81.4%23 / 4853자기보고 ↗
ScreenSpot-ProLLM Stats 집계72.7%8 / 2672자기보고 ↗
VideoMMMULLM Stats 집계87.6%1 / 23100자기보고 ↗
OmniDocBench 1.5LLM Stats 집계11.5%18 / 2011자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Google의 다른 모델

공급사 →