GPT-6 아스트라 출시: 성능과 가격, 언제부터 쓸 수 있나
ChatGPT(챗지피티)를 만드는 OpenAI(오픈AI)가 2026년 9월 3일 GPT-6 아스트라(GPT-6 Astra)를 공개했습니다. ChatGPT 같은 AI 서비스가 답을 만들 때 뒤에서 일하는 인공지능을 모델이라고 부릅니다. 아스트라는 GPT 계열의 맨 위에 있던 GPT-5.6 Sol의 후속 모델입니다.
그런데 발표됐다고 누구나 바로 쓸 수 있는 것은 아닙니다. 발표 당일에는 제한된 조직만 쓸 수 있었고 지금도 며칠에 걸쳐 순차 배포되는 중입니다. 같은 구독료를 내는데 누구는 이미 쓰고 누구는 모델 목록에서 보지도 못합니다.
사용 방법과 비용 체계, 달라진 점과 벤치마크 점수, 사용자 후기 반응과 안전 문제까지 확인해 보겠습니다. 이름부터 헷갈리니 거기서 시작합니다.
- GPT-6 아스트라 (GPT-6 Astra)
OpenAI의 GPT 계열에서 맨 위에 있는 최신 모델입니다. 텍스트로 답하는 일보다 컴퓨터 프로그램을 직접 조작해 결과물을 완성하는 일에서 전작과 크게 달라졌습니다.
아스트라와 GPT-6 Pro는 같은 모델입니다
발표 기사에는 아스트라라는 이름이 나오는데 ChatGPT 화면에는 GPT-6 Pro라는 이름이 보입니다. 결론부터 말하면 둘은 같은 모델을 가리킵니다. 아스트라는 모델 이름입니다. 발표문과 성능 표에 나오는 이름이 이것이고 API에서는 gpt-6-astra라는 모델 ID로 부릅니다.
GPT-6 Pro는 ChatGPT 채팅창에서 그 모델을 골라 쓰는 메뉴 이름입니다. 모델 선택 목록에 GPT-6 Pro가 있고 그것이 아스트라입니다. 다만 이 이름은 채팅창에서만 쓰입니다. ChatGPT에는 채팅 말고 Work와 Codex라는 화면이 더 있는데(다음 절에서 설명합니다) 그쪽에서는 아스트라라는 이름 그대로 나옵니다.

이름이 둘인 이유는 부르는 곳이 다르기 때문입니다. 아스트라는 OpenAI가 모델 자체를 부르는 이름이고, GPT-6 Pro는 ChatGPT라는 제품이 그 모델을 담아 놓은 칸의 이름입니다. 기사에서 아스트라를 읽었다면 ChatGPT에서는 GPT-6 Pro를 찾으면 됩니다.
Plus부터 가능하되 Work와 Codex에서만
아스트라는 돈을 낸다고 다 열리는 것이 아닙니다. 무료인 Free는 물론이고 가장 낮은 유료 요금제인 Go에서도 쓸 수 없습니다. 유료 플랜끼리도 이용 범위가 갈립니다.
OpenAI는 ChatGPT를 세 갈래로 나눠 두었습니다. 우리가 흔히 쓰는 채팅 화면이 있고, 업무용 작업 화면인 Work가 있고, 코드 작업을 맡기는 Codex(코덱스)가 있습니다. Codex는 ChatGPT 안의 화면으로도 쓰고 터미널에 따로 설치해서도 쓰는데, 어느 쪽이든 같은 Codex입니다.
Plus 플랜 사용자는 쓸 수 있지만 일반 채팅이 아닌 Work와 Codex에서만 쓸 수 있습니다. 순차 배포 중이라 계정마다 열리는 시점은 다를 수 있습니다.
일반 채팅에서 아스트라를 쓰고 싶다면 Pro, Business, Enterprise 플랜부터 가능합니다. 앞에서 본 GPT-6 Pro 메뉴가 이 플랜들의 채팅 화면에 열립니다.
| 플랜 | 일반 채팅 (GPT-6 Pro) | Work / Codex (아스트라) | 알아둘 조건 |
|---|---|---|---|
| Free / Go | 이용 불가 | 이용 불가 | 아스트라는 물론 전작 Sol도 못 씁니다. 더 가벼운 모델만 열립니다 |
| Plus | 이용 불가 | 이용 가능 | 순차 적용됩니다 |
| Pro $100 / $200 | 이용 가능 | 이용 가능 | 두 등급으로 나뉘고 등급별 사용량 한도가 다릅니다 |
| Business | 이용 가능 | 이용 가능 | 좌석 등급(Standard / Premium)에 따라 할당량이 다릅니다 |
| Enterprise | 이용 가능 | 이용 가능 | 워크스페이스의 모델 접근 권한에 따라 달라집니다 |
Business는 회사가 직원에게 좌석을 배정하는 방식이고 그 좌석에 Standard와 Premium 두 등급이 있습니다. 내 좌석이 어느 쪽인지부터 확인해야 합니다. Standard는 GPT-6 Pro 메시지를 월 15개, Premium은 주 50개 쓸 수 있어 월로 환산하면 10배 넘게 벌어집니다. 이 할당량은 GPT-6 Pro와 GPT-5.6 Sol Pro가 나눠 쓰고, 채팅 할당량과 Work, Codex 사용량은 서로 별개입니다.
여기까지가 플랜별 조건인데, 조건을 만족해도 아직 순서가 오지 않은 사람이 있습니다. 순차 배포라 같은 플랜이어도 열리는 날이 다르기 때문입니다. 다만 한 화면에 안 보인다고 계정 전체에 안 열린 것은 아닙니다. 채팅과 Work와 Codex가 각각 따로 열리기 때문입니다. 실제로 Business 계정 하나로 확인해 보니 채팅 모델 목록에는 GPT-6 Pro가 아직 없는데, 같은 계정의 Work 목록에는 위에서 본 것처럼 아스트라가 이미 올라와 있었습니다.

자격이 되는데도 못 쓰고 기다려야 하는 사람들이 생긴 이 상황에 대해 OpenAI는 보상을 내놨습니다. 2026년 9월 4일부터 유료 플랜에서 아스트라를 쓰지 못한 날마다 리셋을 하나씩 적립해 줍니다. 리셋은 그동안 쓴 사용량을 0으로 되돌려 한도를 다시 채워 주는 것이라, 기다린 만큼 나중에 몰아 쓸 수 있습니다.
터미널에 설치한 Codex로 쓸 계획이라면 준비물이 하나 더 있습니다. 설치된 프로그램이 최신이어야 새 모델이 목록에 뜹니다. 터미널에 codex --version을 쳐서 0.153.0 이상인지 보고, 낮으면 npm install -g @openai/codex로 올리면 됩니다. ChatGPT 데스크톱 앱도 앱 메뉴의 업데이트 확인으로 최신판을 받아 두는 편이 좋습니다.
아스트라 사용 비용: API는 Sol의 2.5배
아스트라에 돈을 내는 길은 구독과 API로 나뉩니다. 구독은 매달 정액을 내고 정해진 사용량 안에서 쓰는 방식이고, API는 쓴 만큼 토큰 단위로 내는 방식입니다. 토큰은 모델이 글을 다루는 최소 단위로 한글 한 글자가 대략 토큰 하나쯤 됩니다. API(Application Programming Interface)는 개발자가 모델을 다른 서비스에 연결해 쓰는 통로라 대부분의 독자에게는 구독이 기본입니다.
구독자에게 중요한 것은 토큰 단가가 아니라 사용량 한도입니다. 아스트라는 이 한도를 빨리 씁니다. 코딩을 계속 시키면 사용량이 한여름 메로나처럼 녹는다거나 작업을 맡긴 뒤 주간 사용량이 4%에서 14%가 됐다는 후기들이 나왔습니다. 뒤의 수치는 계정 전체를 합친 값이라 아스트라 혼자 쓴 양은 아닙니다. 그래도 한도가 빨리 준다는 방향은 두 후기가 같습니다.
API 토큰 비용도 알아보겠습니다. 공식 모델 목록을 기준으로 아스트라의 API 가격은 100만 토큰당 입력 $10, 출력 $50입니다. 전작 Sol은 $4와 $20이니 정확히 2.5배가 됐고 한 번에 받을 수 있는 크기는 105만 토큰으로 Sol과 같습니다. 그런데 Claude(클로드)의 최상위 모델인 Fable 5.1도 같은 $10와 $50라 비싸졌다기보다 같은 값의 최상위 모델이 하나 더 생긴 셈입니다.
API는 쓴 토큰만큼 돈이 나가니 같은 일을 적은 토큰으로 끝내는 것이 곧 비용 절감입니다. 토큰을 아끼려면 보통 더 가벼운 모델로 바꾸거나 추론 정도를 낮춥니다. 추론은 답을 내기 전에 모델이 생각을 거듭하는 단계인데, 길어질수록 답이 나아지는 대신 토큰을 더 씁니다. 그래서 간단한 일에는 추론을 낮추거나 꺼서 토큰을 아낍니다.
그런데 아스트라는 이 조절이 안 됩니다. Sol을 비롯한 GPT-5.6 계열은 추론을 아예 끌 수 있지만 아스트라는 최소 등급이 low라 완전히 끄지 못합니다. 짧은 질문에도 생각을 거치니 실제 작업비 차이는 단가의 2.5배보다 더 벌어질 수 있습니다.
| 모델 | 입력 100만 토큰 | 출력 100만 토큰 | 추론 끄기 |
|---|---|---|---|
| GPT-6 아스트라 | $10 | $50 | 불가 (최소 low) |
| GPT-5.6 Sol | $4 | $20 | 가능 |
| Claude Fable 5.1 | $10 | $50 | 해당 없음 |
전작과 달라진 점: 설명이 아니라 완성 파일
출시 직후 커뮤니티를 달군 것은 벤치마크 표가 아니라 사용자들이 올린 결과물이었습니다. 공식 시험도 독립 검증도 아니지만 이런 후기들에는 공통점이 하나 있습니다. 아스트라는 답을 글로 끝내지 않고 컴퓨터 프로그램을 직접 조작해 완성 파일까지 만들었습니다.
도면 한 장에서 3D 모델까지
가장 크게 퍼진 후기는 건축 도면 사례였습니다. 사용자가 준 것은 JPG 도면 한 장과 아파트 이름, 호수였습니다. 아스트라는 도면을 따라 설계용 CAD 파일을 만들고 부동산 평면도를 찾아 대조한 뒤 3D 모델링 프로그램인 SketchUp 모델까지 완성했습니다. 여기까지 걸린 시간은 7분이었습니다.
전자회로도에서 제조 가능한 기판까지
전자회로도를 받은 사례도 있습니다. 아스트라는 회로를 설명하는 데서 멈추지 않고 회로 기판 설계 프로그램인 KiCad를 직접 조작했습니다. 결과물은 화면 속 그림이 아니라 실제로 제조할 수 있는 기판 레이아웃이었습니다.
사진 한 장에서 3D 모델과 영상까지
매물 사진 한 장을 준 사례에서는 집 한 채의 3D 모델이 나왔습니다. 아스트라는 사진을 보고 건물을 통째로 모델링한 뒤 78초짜리 홍보 영상까지 만들었습니다.
세 사례의 분야는 전부 다르지만 필요한 프로그램을 움직여 결과 파일로 끝낸 흐름은 같습니다. 공식 시험도 같은 방향입니다. 컴퓨터 화면을 직접 조작하는 OSWorld 2.0에서, 실제로 걸리는 시간까지 재는 조건으로 아스트라는 작업당 약 40분에 72.6%를 성공했고 Sol은 약 75분에 65.7%였습니다. 비개발자에게 이 변화는 프로그램 사용법을 다 익히기 전에 원하는 결과물의 기준부터 말할 수 있게 됐다는 뜻입니다.
벤치마크 점수표 읽는 법: 99.9%에 붙은 조건
새 모델이 나오면 점수표가 따라옵니다. 벤치마크는 여러 모델에 똑같은 문제를 주고 몇 퍼센트나 맞히는지 재는 시험입니다. 학교 시험처럼 과목이 나뉘어 있어서 코딩 과목, 지식 과목, 화면 조작 과목이 따로 있습니다.
이번에 가장 크게 보도된 점수는 ARC-AGI-3라는 시험의 99.9%입니다. 처음 보는 규칙의 게임을 주고 스스로 규칙을 알아내 풀게 하는 시험인데, 사람은 전부 풀 수 있지만 지금까지 AI는 잘 못 풀었습니다. 전작인 Sol이 7.8%였으니 99.9%는 놀랄 만한 숫자입니다.
그런데 같은 아스트라가 다른 조건에서는 62.7%를 받았습니다. 차이는 하네스입니다. 하네스는 모델에게 문제를 건네고 앞 문제에서 한 생각을 다음 문제로 넘겨 주는 실행 방식인데, ARC Prize의 공개 결과를 보면 이것만 바꿔도 점수가 이렇게 갈립니다.
| 실행 방식 | ARC-AGI-3 점수 |
|---|---|
| 표준 하네스 | 62.7% |
| 생각을 이어 주는 하네스 | 99.9% |
모델은 같습니다. 기억을 어떻게 넘겨 주느냐만 달랐는데 62.7%가 99.9%가 됐고, 발표문에 실린 것은 99.9% 쪽입니다. 시험을 만든 ARC Prize조차 이 시험은 규칙이 닫힌 게임이라 현실의 열린 문제를 그대로 나타내지는 않는다고 선을 긋습니다.
점수를 볼 때 확인할 것이 하나 더 있습니다. 아스트라가 모든 과목에서 이기는 것은 아니라는 점입니다. 아래는 공식 비교표에서 네 과목을 고른 것입니다.
| 공식 벤치마크 | 시험 내용 | Astra | Sol | Fable 5.1 |
|---|---|---|---|---|
| ScreenSpot-Pro | 화면에서 버튼과 메뉴의 위치를 찾는 능력 (보조 도구 없이) | 92.7% | 76.9% | - |
| ExploitGym | 보안 취약점을 찾아 공격해 보는 과제 | 42.4% | 30.3% | 30.4%* |
| Humanity's Last Exam, 도구 사용 | 여러 분야를 섞은 고난도 지식 시험 | 57.2% | - | 65.0% |
| Artificial Analysis 종합 지능 지수 | 독립 기관이 여러 시험을 합산한 종합 점수 | 61.2 | 60.9 | 65.7 |
* ExploitGym의 Fable 점수는 안전장치를 일부 끈 설정에서 잰 값입니다. Claude가 평소 쓰는 상태와 달라서 이 행만은 그대로 맞비교하기 어렵습니다.
표를 보면 아스트라는 화면 위치 찾기와 보안 과제에서 앞서지만 지식 시험에서는 57.2%로 Fable 5.1의 65.0%에 지고 종합 지수도 61.2로 Fable 5.1의 65.7보다 낮습니다. 능력이 한 줄로 고르게 오른 것이 아니라 컴퓨터를 다루는 쪽으로 몰려서 올랐다는 뜻입니다.
써 본 사람들의 반응이 갈린 이유도 여기 있습니다. 국내 커뮤니티에는 아스트라를 「5.7 정도」로 평한 후기가 있었고 해외에서도 99.9%가 너무 크게 뛰었다며 시험이 공략된 것 아니냐는 의심이 나왔습니다. 반면 열광하는 후기는 전부 무엇을 만들게 해 본 사람들에게서 나왔습니다. 채팅 답변만 보면 전작의 개선판이고, 앞 절처럼 완성물을 만들게 하면 다른 모델입니다.
정리하면 점수 하나만 보고 판단하지 않는 것이 요령입니다. Gemini(제미나이) 3.8 Flash 글에서는 같은 시험도 버전이 다르면 순위가 바뀌는 것을 봤는데, 이번에는 하네스만 바꿔도 뒤집혔습니다.
순차 배포 이유: 최고 위험 등급 Critical
며칠에 걸친 순차 배포에는 이유가 있습니다. 시스템 카드에 따르면 아스트라는 사이버보안 능력이 Critical 등급에 도달한 첫 모델입니다. 여기서 오해하기 쉬운데, 이 등급은 모델이 얼마나 안전한지가 아니라 얼마나 위험한 능력을 갖췄는지를 재는 눈금입니다. Critical은 그 맨 위 칸입니다. 사람이 단계마다 안내하지 않아도 아직 아무도 모르는 보안 구멍을 스스로 찾아 뚫는 방법까지 만든다는 뜻이고, 평가 중에 실제로 미공개 취약점 2건을 찾아 공격에 썼습니다.
문제는 같은 능력이 방어에도 공격에도 쓰인다는 점입니다. 무서운 것은 문턱이 사라진다는 점입니다. 전문가가 몇 주씩 매달려야 했던 일을 모델에게 시킬 수 있게 되면 공격을 시도할 사람의 수가 한꺼번에 늡니다. 한 번에 다 열었다가 문제가 터지면 되돌릴 수 없으니 조금씩 넓히는 쪽을 택한 것입니다.
그래서 지금 쓸 때 달라지는 점이 있습니다. 현재 배포판은 취약점을 실제로 공격하는 코드를 만들어 달라는 요청을 거부합니다. 반대로 내 코드에 보안 문제가 있는지 봐 달라는 쪽은 됩니다. OpenAI는 별도 프로그램으로 몇 주에 걸쳐 이용 범위를 넓힐 계획입니다.
맡길 만한 일: 프로그램을 여러 개 오가는 작업
아스트라를 모든 일의 기본 모델로 두는 것은 권하지 않습니다. 단가가 Sol의 2.5배인데 추론을 끌 수 없어서 짧은 질문과 단순한 작업까지 맡기기에는 비용이 큽니다. 계정에 열리더라도 대표 작업 하나로 결과와 사용량을 먼저 재 보는 편이 안전합니다.
대신 여러 프로그램을 오가며 실제 파일을 완성해야 하는 일이라면 아스트라를 활용해볼 만합니다. 도면을 3D 모델로 바꾸거나 사진을 영상으로 만드는 것처럼 최종 결과물이 분명한 작업입니다. 만약 실제 사용해 보신다면 성공 기준을 먼저 정하고 기존 모델과 같이 테스트해보는 것도 좋은 방법입니다.
잘하는 일만 맡기면 진짜 물건이라는 실사용자의 한 줄 평도 같은 방향을 가리킵니다. 지금 아스트라를 고를 이유는 GPT-6이라는 이름이 아니라 컴퓨터 조작이 필요한 내 일을 끝내 주는지에 있습니다.
- 2026년 9월 기준 Plus는 Work와 Codex에서 아스트라를 쓸 수 있습니다. 일반 채팅의 GPT-6 Pro는 Pro $100/$200, Business, Enterprise 대상입니다.
- Business Standard는 GPT-6 Pro 메시지 월 15개, Premium은 주 50개입니다. 순차 배포 중 못 쓰는 유료 플랜에는 하루마다 리셋 하나가 적립됩니다.
- API는 입력 $10, 출력 $50로 Sol의 2.5배이며 Fable 5.1과는 같은 값입니다. 아스트라는 추론을 완전히 끌 수 없습니다.
- ARC-AGI-3는 표준 하네스에서 62.7%, 생각을 이어 주는 하네스에서 99.9%였습니다. 하네스와 시험 조건을 빼고 점수만 비교하면 안 됩니다.
- Humanity's Last Exam과 Artificial Analysis 종합 지수에서는 Fable 5.1이 앞섭니다. 아스트라의 강점은 컴퓨터를 조작해 완성물을 만드는 작업에서 드러났습니다.
- 사이버보안 능력이 최고 위험 등급 Critical에 도달한 첫 모델이라, OpenAI는 안전장치를 확인하며 조금씩 여는 순차 배포를 택했습니다.
자주 묻는 질문
GPT-6 아스트라를 무료로 쓸 수 있나요?
2026년 9월 기준 Free와 Go에서는 아스트라를 쓸 수 없습니다. Plus는 일반 채팅이 아니라 Work와 Codex에서 순차적으로 이용할 수 있습니다.
Plus에서 GPT-6 아스트라는 언제 열리나요?
며칠에 걸친 순차 배포라 계정과 기능마다 시점이 다를 수 있습니다. 유료 ChatGPT 플랜에서 접근하지 못한 날마다 적립형 리셋 하나를 준다는 공지가 있으며, 최신 이용 가능 여부는 공식 문서와 각 화면에서 다시 확인해야 합니다.
GPT-6 Pro와 Pro 플랜은 같은 말인가요?
아닙니다. GPT-6 Pro는 ChatGPT에서 아스트라로 구동되는 모델 옵션이고, Pro 플랜은 $100와 $200로 나뉜 요금제입니다. Business의 Premium은 회사 좌석의 등급 이름이라 또 다릅니다.
GPT-6 아스트라 API 가격은 얼마인가요?
100만 토큰당 입력 $10, 출력 $50입니다. GPT-5.6 Sol의 $4와 $20보다 2.5배이며 Claude Fable 5.1과는 같은 값입니다.
ARC-AGI-3 99.9%는 그대로 믿어도 되나요?
99.9%는 생각을 이어 주는 하네스에서 나온 값입니다. 같은 모델을 표준 하네스로 실행했을 때는 62.7%였으므로 하네스 조건을 함께 봐야 합니다.
Sources (6)펼쳐서 전체 출처 보기
- OpenAI 공식 발표, GPT-6 Astra 출시와 순차 배포, 컴퓨터 사용 성능 (2026-09-05 확인)
- OpenAI API 공식 모델 목록, 가격과 컨텍스트, 추론 등급 (2026-09-05 확인)
- ARC Prize, GPT-6 Astra ARC-AGI-3 평가, 하네스별 점수와 비용 (2026-09-05 확인)
- OpenAI Deployment Safety Hub, GPT-6 Astra 시스템 카드와 정렬 평가 (2026-09-05 확인)
- OpenAI 공식 한국어 문서, Path to Astra, 사이버 평가와 훈련 중단 (2026-09-05 확인)
- Hacker News, GPT-6 Astra 출시 본 스레드와 벤치마크 반응 (2026-09-05 확인)