OpenAI · 모델

GPT-6 Astra

API출시 2026년 9월 3일OpenAI/gpt-6-astra공식 문서 ↗
종합 레이팅1572 · 2위가중 비교 11
컨텍스트 창1.1M최대 출력 128K
가격 (입력 / 출력, 1M 토큰)$10.0 / $50.0혼합 $20.0
파라미터—
라이선스commercial API
벤치 점수22개코딩·에이전트·추론·지식·멀티모달·과학·보안
분야레이팅분야 순위비교 수
코딩1178—1.5
에이전트117862.5
추론·지식130333
멀티모달1065—0.5
과학·보안125813.5
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

22개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
DeepSWE 1.1LLM Stats 집계74.1%5 / 3989자기보고 ↗
FrontierCode 1.1LLM Stats 집계53.3%4 / 2286자기보고 ↗
Terminal-Bench 4.0LLM Stats 집계57.7%3 / 2190자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
BrowseCompLLM Stats 집계91.5%2 / 4798자기보고 ↗
AutomationBenchLLM Stats 집계41.4%9 / 2465자기보고 ↗
Agents' Last ExamLLM Stats 집계59.3%1 / 21100자기보고 ↗
OSWorld 2.0LLM Stats 집계72.6%3 / 1485자기보고 ↗
BenchCAD (with Python tool)LLM Stats 집계95.9%3 / 767자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계96%1 / 90100자기보고 ↗
ARC-AGI v2LLM Stats 집계95%1 / 14100자기보고 ↗
Humanity's Last Exam (with tools, text-only)LLM Stats 집계57.2%3 / 1078자기보고 ↗
ARC-AGILLM Stats 집계98.5%1 / 7100자기보고 ↗
ARC-AGI-3LLM Stats 집계99.9%1 / 5100자기보고 ↗
FrontierMath Tier 4 (v2)LLM Stats 집계97.6%1 / 4100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
ScreenSpot-ProLLM Stats 집계92.7%1 / 26100자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
HealthBench ProfessionalLLM Stats 집계63.4%6 / 1462자기보고 ↗
ExploitBenchLLM Stats 집계100%1 / 8100자기보고 ↗
ExploitGymLLM Stats 집계42.4%1 / 8100자기보고 ↗
SEC-Bench ProLLM Stats 집계85.4%1 / 7100자기보고 ↗
Terminal-Bench-Science 0.1LLM Stats 집계64.6%1 / 5100자기보고 ↗
LifeSciBenchLLM Stats 집계60.3%1 / 4100자기보고 ↗
GeneBench-ProLLM Stats 집계37.8%1 / 4100자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

OpenAI의 다른 모델

공급사 →

관련 소식

euno.news 패밀리 기사