GPT-6 Astra 공개, 성능보다 먼저 봐야 할 ‘제한된 배포’의 의미

OpenAI가 2026년 9월 3일 차세대 주력 모델 ‘GPT-6 Astra’의 배포를 시작했다.

Date: 2026-09-04 Topic: AI Primary source: OpenAI

OpenAI가 2026년 9월 3일 차세대 주력 모델 ‘GPT-6 Astra’의 배포를 시작했다. 다만 모든 이용자가 곧바로 쓸 수 있는 전면 출시는 아니다. 먼저 신뢰 접근 프로그램(Trusted Access Program)에 참여하는 기업에 제공하고, API와 ChatGPT Plus·Pro·Business·Enterprise 이용자에게는 며칠 안에 순차적으로 개방할 예정이다.

Astra는 복잡한 추론과 코딩, 웹 탐색, 컴퓨터 조작을 한 흐름 안에서 수행하도록 설계됐다. 동시에 OpenAI가 자사 준비성 프레임워크에서 처음으로 사이버 보안 역량을 ‘Critical’ 수준으로 분류한 모델이기도 하다. 이번 발표의 핵심은 성능 향상뿐 아니라, 강해진 모델을 어떤 조건과 안전장치 아래 배포할 것인지에 있다.

What Happened

OpenAI 공식 모델 문서에 따르면 GPT-6 Astra는 어려운 다단계 업무를 처음부터 끝까지 처리하는 데 초점을 맞춘 최상위 모델이다. 텍스트와 이미지를 입력으로 받아 추론·코딩·리서치·문서 작성·컴퓨터 사용을 수행하며, Responses API에서는 웹 검색, 파일 검색, 코드 실행, 이미지 생성, 호스티드 셸, MCP 같은 도구를 사용할 수 있다.

배포는 능력과 위험을 함께 고려한 단계형 방식이다. 9월 3일에는 신뢰 접근 프로그램 소속 기업부터 사용을 시작했고, 일반 API와 유료 ChatGPT 요금제는 뒤이어 개방된다. 무료 요금제 제공 여부는 공식 문서에 명시되지 않았다. 따라서 현재 시점에서 “모든 사용자에게 출시됐다”고 표현하는 것은 정확하지 않다.

Key Details

공식 문서에 공개된 주요 사양은 다음과 같다.

  • 컨텍스트 창은 105만 토큰, 최대 출력은 12만8,000토큰이다.
  • 지식 기준일은 2026년 4월 30일이며, 추론 강도는 low부터 max까지 다섯 단계로 조절할 수 있다.
  • API 가격은 100만 토큰당 입력 10달러, 캐시 입력 1달러, 캐시 쓰기 12.50달러, 출력 50달러다.
  • 입력이 27만2,000토큰을 넘으면 전체 요청에 더 높은 요율이 적용된다. 긴 문서를 한 번에 넣는 서비스라면 컨텍스트 크기뿐 아니라 실제 요청 비용도 따져야 한다.
  • 텍스트와 이미지는 입력할 수 있지만 오디오·비디오 입력은 지원하지 않는다.

OpenAI는 Astra가 컴퓨터 사용, 브라우징, 소프트웨어 개발, 과학·전문 업무에서 이전 모델보다 강해졌다고 설명한다. 다만 공개된 성능 수치는 OpenAI가 선택한 평가와 초기 고객 사례를 중심으로 구성돼 있으므로, 독립 평가와 실제 운영 결과가 쌓이기 전까지는 회사의 주장으로 읽는 편이 안전하다.

The Security Angle

이번 모델에서 가장 이례적인 부분은 사이버 보안 평가다. OpenAI는 Astra가 적절한 도구와 접근 권한을 갖추면 사람의 단계별 지시 없이도 잘 보호된 시스템에서 알려지지 않은 취약점을 찾고 공격 방법을 개발할 수 있는 수준이라고 판단했다. 이는 OpenAI 자체 준비성 프레임워크에서 ‘Critical’로 지정된 첫 사례다.

회사는 내부 평가에서 Astra가 알려진 취약점의 공격 코드를 만드는 ExploitBench에서 100%를 기록했고, 최근 V8 취약점으로 구성한 별도 시험에서는 두 건의 제로데이를 찾아 공격 과정에 활용했다고 밝혔다. 이 결과는 기본 제품 설정이 아니라 보안 연구용 접근 권한인 Daybreak Blue 환경에서 나온 수치다. 일반 사용자가 받는 모델의 동작 범위와 같다고 볼 수는 없다.

이에 OpenAI는 모델 체크포인트 암호화, 격리 환경, 전체 작업 흐름 모니터링, 고위험 행동을 중단시키는 절차를 강화했다. 그 대가로 합법적인 방어 보안 작업도 오탐 때문에 느려지거나 중단될 수 있다. ChatGPT나 Codex에서는 사용자가 작업을 검토하도록 요청받을 수 있고, API에서는 해당 작업이 종료될 수 있다고 회사는 안내했다.

Core Lens
Astra의 변화는 단순히 더 높은 성능의 모델이 나온 것이 아니라, 모델의 능력에 따라 접근 권한과 실행 환경을 다르게 설계하는 배포 방식이 본격화됐다는 데 있다.

What Changes for Users and Developers

일반 사용자는 당장 모델 이름보다 자신의 요금제에 실제 접근 권한이 열렸는지 확인해야 한다. 단계적 배포 중에는 같은 요금제에서도 계정이나 지역에 따라 도착 시점이 다를 수 있다. 개발자는 긴 컨텍스트와 도구 사용을 활용할 수 있지만, 27만2,000토큰을 넘는 요청의 할증과 보안 모니터링에 따른 중단 가능성을 서비스 설계에 반영해야 한다.

기업에는 모델 성능 외의 질문이 더 중요해졌다. 어떤 작업에 외부 네트워크나 셸 접근을 허용할지, 중단된 작업을 어떻게 복구할지, 사람이 승인해야 하는 지점을 어디에 둘지 정해야 한다. 특히 보안 자동화에서는 높은 공격 능력이 방어에 도움이 되는 동시에 오용 위험도 키우므로 최소 권한과 실행 기록이 기본 조건이 된다.

What It Means

Astra는 AI 제품 경쟁의 평가 기준을 바꿀 가능성을 보여준다. 이제 모델 비교는 답변 품질이나 벤치마크 점수만으로 끝나지 않는다. 긴 작업을 얼마나 안정적으로 수행하는지, 위험한 권한을 얼마나 세밀하게 나누는지, 문제가 생겼을 때 사람이 개입할 수 있는지가 제품 가치의 일부가 된다.

‘AGI 도달’ 같은 표현은 OpenAI 경영진의 해석일 뿐 합의된 판정이 아니다. 현 단계에서 확인된 사실은 Astra가 더 긴 맥락과 다양한 도구를 다루며, OpenAI가 이전보다 강한 보안 통제를 전제로 제한적 배포를 시작했다는 점이다. 실제 생산성 향상과 안전성은 독립 평가와 현장 사용 사례로 검증돼야 한다.

What To Watch

  • API와 ChatGPT 유료 요금제의 실제 개방 일정 및 지역별 제공 범위
  • 독립 평가에서 확인되는 코딩·컴퓨터 사용 성능과 장시간 작업의 오류율
  • 정상적인 개발·보안 작업이 안전장치 때문에 중단되는 빈도
  • 신뢰 접근 프로그램 밖에서 제공되는 사이버 보안 기능의 범위
  • 105만 토큰 컨텍스트를 실제 서비스에서 사용할 때의 지연 시간과 총비용

Sources