Google · 모델

Gemini 3.8 Flash

API출시 2026년 9월 2일Google/gemini-3.8-flash공식 문서 ↗
종합 레이팅1432 · 15위레이팅 벤치 22개
컨텍스트 창1.0M최대 출력 66K
가격 (입력 / 출력, 1M 토큰)$0.750 / $3.75혼합 $1.50
파라미터—
라이선스commercial API
벤치 점수27개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

긴 컨텍스트와 강한 일부 벤치 성적을 갖춘 상용 API 모델

사양과 비용

Gemini 3.8 Flash는 Google의 상용 API 모델이다. 컨텍스트 1.0M, 최대 출력 66K를 지원하며 1M 토큰당 입력 $0.750, 출력 $3.75다.

종합·분야 레이팅

종합 레이팅은 1256(25위), 가중 비교는 5.9다. 분야 레이팅은 코딩 1117(23위), 에이전트 1009, 추론·지식 1131, 멀티모달 1073이며 과학·보안은 자료 없음이다.

주요 벤치 결과

SWE-bench Pro의 Public 731 프로필에서 61.6%, 19/63이다. LLM Stats 집계에서는 LVBench 87.1%로 1/28, Terminal-Bench 2.1 89.4%로 3/43, Terminal-Bench 4.0 19.1%로 17/21이다.

해석 시 유의점

LLM Stats 집계 벤치 점수는 미검증이다. 종합 레이팅이 비슷한 모델은 Gemini 3.7 Flash 1271(23위), GPT-5.6 Terra 1266(24위), Qwen3.8-2.4T-A95B 1245(26위), GLM-5.3-Flash 1242(27위)다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩1212196
에이전트1061413
추론·지식1304148
멀티모달1154103
과학·보안1168102
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

27개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis87.6%7 / 9794확인됨 ↗
SciCodeArtificial Analysis56.6%15 / 8483확인됨 ↗
SWE-bench ProPublic 73161.6%19 / 6371확인됨 ↗
Terminal-Bench 2.1LLM Stats 집계89.4%3 / 4395자기보고 ↗
DeepSWE 1.1LLM Stats 집계73.7%6 / 3987자기보고 ↗
Terminal-Bench 4.0LLM Stats 집계19.1%17 / 2120자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis46.8%29 / 10473확인됨 ↗
OSWorld 2.0LLM Stats 집계59%8 / 1446자기보고 ↗
GDPval-AALLM Stats 집계1,5457 / 1140자기보고 ↗
Harvey's Legal Agent BenchmarkLLM Stats 집계10%2 / 20자기보고 ↗
Vals Finance Agent v2LLM Stats 집계61.4%1 / 150자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis47.8%13 / 14191확인됨 ↗
Intelligence IndexArtificial Analysis40.920 / 14186확인됨 ↗
AA-LCRArtificial Analysis81.3%28 / 13980확인됨 ↗
CritPTArtificial Analysis18.3%23 / 13984확인됨 ↗
GPQA DiamondArtificial Analysis95.3%2 / 13099확인됨 ↗
LVBenchLLM Stats 집계87.1%1 / 28100자기보고 ↗
BioMysteryBenchLLM Stats 집계56.5%5 / 733자기보고 ↗
HLE-VerifiedLLM Stats 집계54.9%1 / 3100자기보고 ↗
LABBench2LLM Stats 집계86.2%1 / 2100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis85.6%4 / 6996확인됨 ↗
CharXiv-RLLM Stats 집계86.2%16 / 4868자기보고 ↗
gdp.pdfLLM Stats 집계35%2 / 886자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis54.6%10 / 13993확인됨 ↗
AA-Omniscience IndexArtificial Analysis29.69 / 13994확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis117 tok/s36 / 10867확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis25.73초84 / 10822확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Google의 다른 모델

공급사 →