Google · 모델

DiffusionGemma 26B-A4B

오픈출시 2026년 6월 10일LLMStats/diffusiongemma-26b-a4b-itHugging Face ↗
종합 레이팅705 · 190위레이팅 벤치 24개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터25.2B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수25개코딩·에이전트·추론·지식·멀티모달·과학·보안
분야레이팅분야 순위벤치 수
코딩8561573
에이전트904—1
추론·지식77617814
멀티모달897624
과학·보안8661242
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

25개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis12.4%85 / 9713확인됨 ↗
LiveCodeBench v6LLM Stats 집계69.1%35 / 5132자기보고 ↗
CodeForcesLLM Stats 집계0.510 / 100자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis0%86 / 10410확인됨 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis10.8%107 / 14124확인됨 ↗
Intelligence IndexArtificial Analysis9.5119 / 14116확인됨 ↗
AA-LCRArtificial Analysis19.7%124 / 13911확인됨 ↗
CritPTArtificial Analysis0.3%99 / 13927확인됨 ↗
GPQA DiamondArtificial Analysis66.9%108 / 13017확인됨 ↗
IFBenchArtificial Analysis59.5%54 / 9745확인됨 ↗
GPQA DiamondLLM Stats 집계73.2%75 / 9017자기보고 ↗
Humanity's Last ExamLLM Stats 집계11.9%61 / 645자기보고 ↗
MMLU-ProLLM Stats 집계77.6%46 / 6023자기보고 ↗
MMMLULLM Stats 집계81.5%24 / 3021자기보고 ↗
AIME 2026LLM Stats 집계69.1%24 / 268자기보고 ↗
t2-benchLLM Stats 집계56.2%16 / 1917자기보고 ↗
MedXpertQALLM Stats 집계49%7 / 1140자기보고 ↗
BIG-Bench Extra HardLLM Stats 집계47.6%4 / 640자기보고 ↗
MRCR v2LLM Stats 집계32%2 / 20자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis66.5%54 / 6922확인됨 ↗
MMMU-ProLLM Stats 집계54.3%54 / 6112자기보고 ↗
MathVisionLLM Stats 집계70.5%20 / 3442자기보고 ↗
OmniDocBench 1.5LLM Stats 집계31.9%15 / 2026자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis16.6%112 / 13920확인됨 ↗
AA-Omniscience IndexArtificial Analysis-59.2125 / 13910확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Google의 다른 모델

공급사 →