Google · 모델

Gemma 4 31B

오픈출시 2026년 4월 2일LLMStats/gemma-4-31b-itHugging Face ↗
종합 레이팅958 · 125위레이팅 벤치 26개
컨텍스트 창262K
가격 (입력 / 출력, 1M 토큰)$0.090 / $0.340혼합 $0.153
파라미터30.7B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수28개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

종합 1005의 오픈 웨이트 모델, 멀티모달·추론 레이팅이 강점

핵심 사양

Google의 오픈 웨이트 모델로 컨텍스트는 262K다. 가격은 1M 토큰당 입력 $0.090, 출력 $0.340이며 최대 출력과 라이선스는 자료 없음이다.

레이팅

종합 레이팅은 1005(81위), 가중 비교는 6이다. 분야별로 코딩 997, 추론·지식 1024(69위), 멀티모달 1032다. 에이전트와 과학·보안은 자료 없음이다.

벤치마크

LLM Stats 집계에서 BIG-Bench Extra Hard 74.4%(1/6), t2-bench 86.4%(5/19), MedXpertQA 61.3%(5/11), MRCR v2 66.4%(8/22)다. 모든 벤치 점수는 미검증이다.

비슷한 레이팅

같은 상대 지표에서 Solar Pro 4는 1005(80위), Qwen3.5-122B-A10B는 1008(79위), Qwen3.6-27B는 1002(82위), MiniMax-M2.7은 1001(83위)다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩9801044
에이전트942—1
추론·지식99611116
멀티모달1005443
과학·보안9131082
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

28개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis43.4%64 / 9734확인됨 ↗
Terminal-Bench HardArtificial Analysis36.4%31 / 9367확인됨 ↗
SciCodeArtificial Analysis45.5%55 / 8435확인됨 ↗
LiveCodeBench v6LLM Stats 집계80%24 / 5154자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis6.1%78 / 10425확인됨 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis23.6%80 / 14144확인됨 ↗
Intelligence IndexArtificial Analysis14.798 / 14131확인됨 ↗
AA-LCRArtificial Analysis69.7%87 / 13938확인됨 ↗
CritPTArtificial Analysis1.4%81 / 13942확인됨 ↗
GPQA DiamondArtificial Analysis85.7%62 / 13052확인됨 ↗
IFBenchArtificial Analysis75.6%15 / 9785확인됨 ↗
τ²-Bench TelecomArtificial Analysis59.9%63 / 9635확인됨 ↗
GPQA DiamondLLM Stats 집계84.3%52 / 9043자기보고 ↗
Humanity's Last ExamLLM Stats 집계26.5%48 / 6425자기보고 ↗
MMLU-ProLLM Stats 집계85.2%18 / 6070자기보고 ↗
MMMLULLM Stats 집계88.4%14 / 3055자기보고 ↗
AIME 2026LLM Stats 집계89.2%19 / 2628자기보고 ↗
MRCR v2 (8-needle)LLM Stats 집계66.4%8 / 2267자기보고 ↗
t2-benchLLM Stats 집계86.4%5 / 1978자기보고 ↗
MedXpertQALLM Stats 집계61.3%5 / 1160자기보고 ↗
BIG-Bench Extra HardLLM Stats 집계74.4%1 / 6100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis73.4%43 / 6938확인됨 ↗
MMMU-ProLLM Stats 집계76.9%22 / 6164자기보고 ↗
MathVisionLLM Stats 집계85.6%12 / 3467자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis20.0%95 / 13932확인됨 ↗
AA-Omniscience IndexArtificial Analysis-47.9109 / 13922확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis35 tok/s104 / 1084확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis1.16초9 / 10893확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Google의 다른 모델

공급사 →