Meta · 모델

Muse Spark

API출시 2026년 4월 8일LLMStats/muse-spark공식 문서 ↗
종합 레이팅1102 · 57위가중 비교 9
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)—
파라미터—
라이선스—
벤치 점수19개코딩·에이전트·추론·지식·멀티모달·과학·보안
분야레이팅분야 순위비교 수
코딩924802
에이전트951—0.5
추론·지식1113424
멀티모달1086—1.5
과학·보안1104—1
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

19개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench VerifiedLLM Stats 집계77.4%27 / 5854자기보고 ↗
SWE-bench ProLLM Stats 집계52.4%47 / 5516자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계59%21 / 4049자기보고 ↗
LiveCodeBench ProLLM Stats 집계15 / 50자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
DeepSearch QALLM Stats 집계74.8%10 / 1110자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계89.5%31 / 9067자기보고 ↗
Humanity's Last ExamLLM Stats 집계58.4%8 / 6489자기보고 ↗
ERQALLM Stats 집계64.7%10 / 2563자기보고 ↗
Tau2 TelecomLLM Stats 집계91.5%11 / 2047자기보고 ↗
SimpleVQALLM Stats 집계0.74 / 1579자기보고 ↗
ARC-AGI v2LLM Stats 집계42.5%9 / 1438자기보고 ↗
ZEROBenchLLM Stats 집계0.35 / 1367자기보고 ↗
MedXpertQALLM Stats 집계78.4%1 / 11100자기보고 ↗
IPhO 2025LLM Stats 집계82.6%1 / 2100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계80.4%13 / 6180자기보고 ↗
CharXiv-RLLM Stats 집계86.4%14 / 4871자기보고 ↗
ScreenSpot-ProLLM Stats 집계84.1%5 / 2684자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
HealthBench HardLLM Stats 집계42.8%1 / 6100자기보고 ↗
FrontierScience ResearchLLM Stats 집계38.3%1 / 5100자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Meta의 다른 모델

공급사 →