GPT-6 아스트라, OpenRouter에 출시
OpenAI의 플래그십 모델 GPT-6 Astra가 OpenRouter 플랫폼을 통해 공개되었습니다. 고급 분석, 소프트웨어 엔지니어링, 심층 연구, 과학 작업, 문서 작성에 적합하며, 컴퓨터·브라우저를 활용한 장기 에이전트 작업에 특히 강점을 보입니다. 입력 1M 토큰당 10달러, 출력 50달러의 가격으로 제공되며 최대 100만 토큰의 컨텍스트를 지원합니다.
Chat Enterprise Docs 가입
OpenAI: GPT-6 Astra (openai/gpt-6-astra)
비교 | 플레이그라운드 | 이 모델 사용해보기
GPT-6 Astra는 까다로운 엔드투엔드 작업을 위한 OpenAI의 플래그십 모델입니다. 고급 분석, 소프트웨어 엔지니어링, 심층 리서치, 과학 작업, 문서 작성에 적합하며, 컴퓨터 및 브라우저 사용이 포함된 장기 에이전트 작업에서 특히 뛰어난 성능을 발휘합니다.
모달리티(입력/출력), 가격: 1M 토큰당 입력 10달러 / 출력 50달러, 컨텍스트: 100만 토큰, 출시일: 2026년 9월 4일
제공자(Providers) 여러 회사가 동일한 모델을 호스팅합니다. OpenRouter는 사용자가 선택한 라우팅 모드에 따라 요청을 이들 중 하나로 전송합니다 — Balanced(가격 + 속도 균형), Nitro(가장 빠름), Exacto(도구 호출 정확도 최고).
가격 제공자가 게시한 가격 옆에 고객이 실제로 지불하는 평균 가격을 표시합니다. 캐싱과 할인 덕분에 실제 지불 가격은 표시된 가격보다 훨씬 낮은 경우가 많습니다.
성능 처리량(Throughput)은 모델이 생성하는 속도(초당 토큰 수 — 높을수록 좋음)입니다. 지연 시간(Latency)은 총 왕복 시간(낮을수록 좋음)이며, TTFT는 첫 번째 토큰까지 걸리는 시간(낮을수록 좋음)입니다.
가동률(Uptime) 가동률은 최근 3일간 최소 한 제공자가 요청에 응답한 시간의 비율입니다. 가용성은 추론이 성공적으로 제공된 시간의 비율입니다. OpenRouter는 한 제공자에서 오류가 발생하면 지속적으로 모니터링하여 다음으로 좋은 제공자로 전환합니다.
앱 이 모델에 가장 많은 트래픽을 보내는 공개 앱들. 실제 프로덕션 워크로드가 어떤 모습인지, 이 모델이 어떤 용도에 적합한지 보여주는 좋은 신호입니다.
활동 시간 경과에 따른 이 모델의 토큰 볼륨 및 요청 트래픽.
빠른 시작 이 모델을 호출하는 바로 사용 가능한 코드. OpenRouter의 API는 OpenAI와 호환되므로 대부분의 SDK는 base URL만 변경하면 작동합니다. 모델 간에 달라지는 것은 아래의 모델 슬러그뿐입니다.
더 많은 모델 탐색: 시각 기능 탑재 AI 모델 - 이미지 이해를 위한 멀티모달 LLM 컬렉션, AI 모델 순위
순위 (표준, 지연 시간/처리량 기준, P50)
| 제공자 | 입력(/M) | 출력(/M) | 캐시 읽기(/M) | 지연 시간 | 처리량 | 가동률 |
|---|---|---|---|---|---|---|
| OpenAI Flex | $5.00 | $25.00 | $0.50 | 1.87초 | 46 tps | 99.90% |
| Azure | $10.00 | $50.00 | $1.00 | 4.70초 | 51 tps | 98.13% |
| OpenAI | $10.00 | $50.00 | $1.00 | 4.39초 | 28 tps | 99.89% |
| Azure (US) | $11.00 | $55.00 | $1.10 | 3.43초 | 40 tps | 100.00% |
| OpenAI Fast | $20.00 | $100.00 | $2.00 | 2.56초 | 46 tps | 99.02% |
처리량: 51 tok/s (P50, 제공자 중 최고), 지연 시간: 1.87초 (P50, 최고 제공자 기준, 모든 지역)
가동률(3일): 100.00%, 가용성(3일): 99.35%
최근 72시간 가용성: 99.35% (3일 전 / 2일 전 / 어제 / 현재)
최근 24시간 가용성:
- OpenRouter 가용성: 98.97%
- 라우팅 미사용 시: 95.39%
상위 제공자에서 오류가 발생하면 요청 필터가 허용하는 경우 다른 정상 제공자로 라우팅하여 복구할 수 있습니다. 제공자별 가동률 데이터는 Endpoints API를 통해 프로그래밍 방식으로 접근할 수 있습니다. 로드 밸런싱 및 커스터마이징 옵션에 대해 자세히 알아보세요.
주요 앱별 트래픽
- omp: 4억 1,800만 토큰
- Codex: AI로 빌드하고 배포하도록 돕는 코딩 에이전트 — 1억 9,500만 토큰
- Descript: AI 영상 및 팟캐스트 편집기 — 1억 8,800만 토큰
- Hermes Agent: Nous Research의 오픈소스 자가 개선형 AI 에이전트. 세션 간 메모리를 유지하며 지속적으로 실행되고 경험으로부터 재사용 가능한 스킬을 구축합니다. 웹 검색, 브라우저 자동화, 비전 등 40개 이상의 내장 도구와 예약 자동화, 서브에이전트 기능 포함 — 1억 5,000만 토큰
- Claude Code: Anthropic의 에이전트 코딩 도구. 전체 코드베이스를 읽고, 여러 파일에 걸쳐 변경 사항을 계획·실행하며, 테스트를 실행하고 실패 시 반복 개선합니다. 모든 것이 자연어 프롬프트로 작동 — 1억 2,300만 토큰
자주 묻는 질문
GPT-6 Astra란 무엇인가요? GPT-6 Astra는 까다로운 엔드투엔드 작업을 위한 OpenAI의 플래그십 모델입니다. 고급 분석, 소프트웨어 엔지니어링, 심층 리서치, 과학 작업, 문서 작성에 적합하며... (이하 생략)