OpenAI, 사이버 위험 '치명적' 등급을 받은 첫 모델 GPT-6 Astra 출시

뉴스 요약
OpenAI는 2026년 9월 3일 GPT-6 Astra를 공식 출시하며, 이전 모델 대비 "세대교체적 도약"이자 자사가 범용 인공지능(AGI)의 도래와 연결 지어 언급할 의향이 있는 첫 번째 모델이라고 설명했습니다. 그렉 브록만 사장은 Astra가 추론, 컴퓨터 사용, 소프트웨어 엔지니어링 역량에서 단계적 변화를 의미한다고 밝혔으며, 동시에 OpenAI는 내부 사이버 보안 위험 대비 체계인 준비도 프레임워크에 따라 이 모델을 "치명적" 등급으로 분류했습니다. 이는 OpenAI가 출시한 모델 중 최초입니다.
배포 및 이용 가능 여부
Astra는 한 번에 전면 공개되지 않고 단계적으로 배포됩니다. 가장 먼저 접근 권한을 받는 그룹은 사이버 보안 방어자를 위한 신청 기반 프로그램인 OpenAI의 Daybreak 참여자들로, 2026년 9월 3일 목요일(태평양 표준시)부터 적용됩니다. 회사 측에 따르면 ChatGPT Plus, Pro, Business, Enterprise 구독자와 OpenAI API를 사용하는 개발자를 대상으로 한 더 폭넓은 이용은 "향후 며칠 내" 가능해질 전망입니다. 이 모델은 Amazon Bedrock을 통해서도 제공되며, API 접근은 gpt-6-astra라는 식별자로 제공되고, 사용량이 많은 구독 요금제를 위한 해당 Astra Pro 등급도 함께 제공됩니다.
개발자용 API 가격은 표준 모드 기준 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러로 책정되었으며, 이는 기존 주력 모델인 GPT-5.6 Sol보다 약 2.5배 비싼 수준입니다. 유사한 작업에서 지연 시간을 약 2.5배 단축해 주는 더 빠른 추론 모드는 표준 가격의 두 배로 책정되었습니다.
기능 및 벤치마크
OpenAI는 Astra를 컴퓨터 사용, 웹 브라우징, 소프트웨어 엔지니어링, 사이버 보안, 과학적 추론 작업 전반에서 최고 수준의 성능을 갖춘 모델로 포지셔닝했습니다. 브록만은 컴퓨터 사용을 핵심 기능으로 강조하며, 이 모델이 일상적인 사무 작업에서 인간을 능가하는 속도라고 표현할 만큼 빠르게 "스프레드시트를 훑고, 양식을 작성하고, 웹 페이지를 탐색할 수 있다"고 말했습니다.
공개된 벤치마크에서 Astra는 컴퓨터 사용 평가 도구인 OSWorld 2.0에서 72.6%를 기록했으며, GPT-5.6 Sol보다 약 47% 짧은 시간 내에 작업을 완료했습니다. 또한 회사는 Astra가 까다로운 수학 벤치마크인 FrontierMath의 4단계(Tier 4)에서 97.6%를 기록해 사실상 만점에 도달했으며, 취약점 발견 및 활용 능력을 평가하는 내부 지표인 ExploitBench에서 100%를 달성했다고 밝혔습니다. 이 결과는 곧바로 모델의 "치명적" 안전 등급 분류로 이어졌습니다.
사이버 보안 안전장치 및 치명적 등급
방어자들에게 유용하게 쓰이는 바로 그 능력들이 OpenAI 내부에서는 경보를 울렸습니다. 회사 측은 Astra가 사람의 단계별 지시 없이도 이전에 알려지지 않은 보안 취약점을 자율적으로 식별하고 잘 보호된 시스템을 대상으로 작동하는 익스플로잇을 구축할 수 있는 최초의 모델이라고 밝혔습니다. 이로 인해 모델의 위험 수준에 맞춰 안전 예방 조치를 확대하는 OpenAI의 내부 정책인 준비도 프레임워크에 따라 "치명적" 등급이 부여되었습니다.
OpenAI는 이러한 위험을 관리하기 위해 출시를 진행하기 전 추가 안전장치를 도입하고 테스트하고자 여러 주에 걸쳐 Astra 개발 일부를 지연시켰다고 설명했습니다. 모델의 가장 고도화된 사이버 보안 기능에 대한 접근은 Daybreak 프로그램을 통해 제한된 검증 테스터들에게만 허용되며, 해당 프로그램 내에서도 승인된 사용자는 일반적인 사이버 방어 작업에는 Astra를 사용할 수 있지만 익스플로잇 개발이나 공격적 사이버 공격 계획에는 사용할 수 없도록 차단되어 있습니다. 테스트가 계속됨에 따라 Daybreak Blue라는 추가 등급을 통해 더 폭넓은 방어 목적의 접근이 제공될 예정입니다.
업계 반응
출시 관련 보도들은 Astra의 벤치마크 결과가 여러 공개 리더보드에서 Anthropic의 Fable 5.1과 비교되는 등 경쟁사 프론티어 모델들을 앞선다는 점에 주목했으며, 이는 추론, 코딩, 에이전트형 컴퓨터 사용 작업 분야에서 주요 AI 연구소 간 경쟁을 더욱 격화시키고 있습니다. 브록만이 Astra가 이미 대부분의 경제적 가치가 있는 작업에서 인간을 능가하는 AI 시스템이라는 OpenAI의 내부 AGI 정의를 충족했거나 그에 근접했을 수 있다고 시사한 점은 업계 관찰자들의 큰 관심을 끌었지만, OpenAI는 해당 기준이 공식적으로 충족되었다고 선언하는 데까지는 나아가지 않았습니다.
향후 전망
OpenAI는 초기 Daybreak 참여자 이후 일반 ChatGPT 및 API 접근이 언제 개방될지에 대한 정확한 날짜를 공개하지 않았으며, 단지 2026년 9월 3일 발표(태평양 표준시)로부터 며칠 내에 확대가 이루어질 것이라고만 밝혔습니다. 회사 측은 준비도 프레임워크에 따라 실제 사용 현황을 지속적으로 모니터링할 것이며, 배포가 기업 및 소비자 대상으로 확대됨에 따라 특히 사이버 보안 관련 기능을 중심으로 안전장치를 조정할 수 있다고 설명했습니다.