Anthropic · 모델

Claude Opus 4.7

API출시 2026년 4월 16일Anthropic/claude-opus-4.7공식 문서 ↗
종합 레이팅1290 · 36위레이팅 벤치 31개
컨텍스트 창1M최대 출력 128K
가격 (입력 / 출력, 1M 토큰)$5.00 / $25.0혼합 $10.0
파라미터—
라이선스commercial API
벤치 점수33개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

긴 컨텍스트와 출력을 제공하지만 종합 레이팅은 1233(29위)

제품·비용

Anthropic의 상용 API 모델이다. 컨텍스트 1M, 최대 출력 128K를 지원하며 1M 토큰당 입력 $5.00, 출력 $25.0이다. 라이선스는 commercial API다.

레이팅 해석

종합 레이팅은 1233(29위), 가중 비교는 9다. 분야별로 코딩 1101(27위), 에이전트 1087(20위), 추론·지식 1159(27위), 멀티모달 1070, 과학·보안 959다. 레이팅은 같은 벤치 비교에서 만든 상대 지표다.

벤치 관찰

LLM Stats 집계 프로필에서 GPQA Diamond 94.2%(5/90), SWE-bench Verified 87.6%(5/58), CharXiv-R 91%(3/48), MMMLU 91.5%(5/30)다. Public 731 프로필의 SWE-bench Pro는 64.3%(11/63)다. 모두 미검증 결과다.

선택 시 참고

Finance Agent는 64.4%(1/8), Legal Agent Benchmark는 7.1%(5/14)이며 모두 LLM Stats 집계·미검증이다. 같은 공급사에는 Claude Haiku 5.5, Claude Sonnet 5.5, Claude Opus 5.5, Claude Fable 5.1이 더 최근 모델로 제시돼 있다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩1172248
에이전트1107267
추론·지식11884811
멀티모달1094232
과학·보안1108263
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

33개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis83.1%16 / 9784확인됨 ↗
Terminal-Bench HardArtificial Analysis51.5%11 / 9389확인됨 ↗
SWE-bench ProPublic 73164.3%11 / 6384인용 ↗
SWE-bench VerifiedLLM Stats 집계87.6%5 / 5893자기보고 ↗
SWE-bench ProLLM Stats 집계64.3%11 / 5581자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계69.4%10 / 4077자기보고 ↗
FrontierCode 1.1LLM Stats 집계38.5%17 / 2224인용 ↗
FrontierSWELLM Stats 집계63%9 / 1750인용 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis42.8%35 / 10467확인됨 ↗
BrowseCompLLM Stats 집계79.3%21 / 4755자기보고 ↗
MCP Atlas · PublicLLM Stats 집계77.3%10 / 3674자기보고 ↗
OSWorld-VerifiedLLM Stats 집계78%13 / 2652자기보고 ↗
Finance Agent v2LLM Stats 집계51.5%8 / 2165인용 ↗
Legal Agent BenchmarkLLM Stats 집계7.1%5 / 1469인용 ↗
Finance AgentLLM Stats 집계64.4%1 / 8100자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis42.3%26 / 14182확인됨 ↗
Intelligence IndexArtificial Analysis40.721 / 14186확인됨 ↗
AA-LCRArtificial Analysis78.7%48 / 13966확인됨 ↗
CritPTArtificial Analysis12%38 / 13973확인됨 ↗
GPQA DiamondArtificial Analysis91.4%26 / 13081확인됨 ↗
IFBenchArtificial Analysis58.6%55 / 9744확인됨 ↗
τ²-Bench TelecomArtificial Analysis88.6%37 / 9662확인됨 ↗
GPQA DiamondLLM Stats 집계94.2%5 / 9096자기보고 ↗
Humanity's Last ExamLLM Stats 집계54.7%14 / 6479자기보고 ↗
MMMLULLM Stats 집계91.5%5 / 3086자기보고 ↗
LiveBenchLLM Stats 집계76.9%6 / 2377인용 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis78.8%23 / 6968확인됨 ↗
CharXiv-RLLM Stats 집계91%3 / 4896자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis48.9%22 / 13985확인됨 ↗
AA-Omniscience IndexArtificial Analysis27.312 / 13992확인됨 ↗
CyberGymLLM Stats 집계73.1%15 / 1922자기보고 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis47 tok/s91 / 10816확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis18.72초81 / 10825확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Anthropic의 다른 모델

공급사 →