금융이야기

GPT-6 Astra|Astro 검색어·성능표·공식 페이지 (2026)

머신파이철발이 2026. 9. 5. 11:52
반응형

2026.9.5 · OpenAI 공식 페이지 기준

검색에 많이 찍히는 이름은 Astro다. 공식 제품명은 GPT-6 Astra(아스트라)다.

나는 OpenAI 발표 페이지(openai.com/index/gpt-6-astra)랑 API 문서부터 연다. 2026년 9월 3일(현지) 출시. 컴퓨터 사용·브라우징·소프트웨어 엔지니어링·사이버·과학·전문 업무에서 SOTA라고 적혀 있다.

벤처비트 보도: 비공개 브리핑에서 Greg Brockman이 세션을 끝내며 「Welcome to the AGI era」라고 말했다(VentureBeat).

공식 히어로

OpenAI 홈 히어로. 제품명은 GPT Astra로 찍혀 있다. 아래는 그 화면 캡처다.

OpenAI 발표 원문

컴퓨터 사용

멀티스텝 에이전트, 웹사이트 구축, 문서·스프레드시트·발표자료, 실제 코드베이스의 복잡한 SWE까지 밀어 넣는 쪽이다(OpenAI).

Agents’ Last Exam 59.3%(Sol 53.6%, Opus 5 55.5%). OSWorld 2.0 72.6%·약 40분/태스크 vs Sol 65.7%·약 75분 — OpenAI 문장으로 약 47% 덜 걸린다. AutomationBench 41.4% vs 18.1%. ScreenSpot-Pro(no tools) 92.7% vs 76.9%.

성능표 (Astra vs Sol)

출처: OpenAI gpt-6-astra 페이지. 표에 있는 숫자만.

코딩

벤치AstraSol비고
Terminal-Bench 4.057.9%37.3%Fable 5.1 55.8%
DeepSWE v1.174.1%72.7%
AA Coding Agent Index67.065.1

과학·추론

벤치AstraSol
FrontierMath Tier 4 (v2)97.6%83.0%
ARC-AGI-3OpenAI 페이지 99.9%(포화). ARC Prize는 하네스에 따라 62.7%/99.9%로 갈림
GPQA Diamond96.0%94.6%
Terminal-Bench Science 0.164.6%22.4%
HealthBench Professional63.4%60.5%

사이버·정렬

벤치AstraSol
ExploitBench100%78.5%
ExploitGym42.4%30.3%
Internal circumvention0.00%0.29%
ExploitGym honeypot0.0%48.2%

낮을수록 좋은 정렬 지표다. Preparedness Framework Critical 사이버 등급 최초. Daybreak로 고급 악용 기능을 제한한다(OpenAI).

AA Intelligence Index 61.2 ≈ Sol 60.9. 범용 지능 지수는 Sol과 비슷하고, 에이전트·코딩 쪽에 무게가 실려 있다(Artificial Analysis / OpenAI 표).

코딩 섹션

Terminal-Bench 4.0·DeepSWE·AA Coding Agent Index가 위에 있다. 아래는 OpenAI 발표 페이지의 코딩 섹션 캡처다.

API 스펙·요금

developers.openai.com 모델 페이지 기준.

항목
모델 IDgpt-6-astra
컨텍스트1,050,000
최대 출력128,000
지식 컷오프2026.4.30
reasoning.effortlow · medium · high · xhigh · max
가격 / 1MInput $10 · Cached $1 · Cache writes $12.50 · Output $50
272K input 초과전체 요청 input·cache 2x, output 1.5x
Fast / Batch·FlexFast 2x · Batch·Flex 50%
도구computer use, web search, code interpreter, MCP 등. Fine-tuning 미지원

API 모델 문서

롤아웃

ChatGPT Plus / Pro / Business / Enterprise, API(gpt-6-astra), AWS Bedrock. Enterprise는 기본 off, 관리자가 켠다. 며칠에 걸쳐 풀린다. Pro·Business·Enterprise에는 GPT-6 Astra Pro도 있다(OpenAI).

나는 검색어 Astro로 들어와서도 원문 표기 Astra를 기준으로 숫자를 본다. Plus·Pro에 풀리는 속도랑 Enterprise 기본 off는 체감이 갈린다. ARC-AGI 점수는 하네스에 따라 갈리니, 내 업무 한 줄에 바로 옮길 수 있는지만 다시 재본다.

반응형