GPT-6 아스트라, 내 챗GPT엔 언제 들어올까

GPT-6 아스트라가 나왔습니다. 오픈AI는 현지시간 9월 3일, 한국시간으로는 4일 새벽에 차세대 대표 모델을 공개하면서 “세상에서 가장 지능적이고 가장 정렬된 모델”이라고 소개했습니다. 그런데 발표 나흘이 지난 지금도 “내 계정에는 왜 안 뜨냐”는 질문이 더 많이 보입니다.

성능 얘기부터 하는 게 순서 같지만, 이번만큼은 순서를 바꿔야 할 것 같습니다. 숫자는 화려한데 손에 잡히질 않으니까요. 무엇이 달라졌고, 언제부터 쓸 수 있고, 그 값어치를 하는지 차례로 정리해봅니다.

목차

GPT-6 아스트라, 무엇이 달라졌나

가장 크게 바뀐 축은 ‘대화’가 아니라 ‘작업’입니다. 오픈AI는 이번 모델을 컴퓨터 사용, 브라우징, 소프트웨어 엔지니어링, 과학, 전문 업무에서 최고 수준이라고 설명했습니다. 화면을 직접 보고 양식을 채우고, CRM 기록을 고치고, 일정을 정리하는 종류의 일 말입니다.

GPT-6 아스트라, 내 챗GPT엔 언제 들어올까
(사진: coderabbit.ai)

스펙만 따로 떼면 컨텍스트 창이 약 105만 토큰, 최대 출력이 12만 8천 토큰, 지식 컷오프는 2026년 4월 30일입니다. 훈련 자체도 이전과 결이 다릅니다. 텍사스 스타게이트 사이트에서 10만 개가 넘는 GPU를 돌린 오픈AI 역사상 최대 규모 학습이었고, 앞선 모델이 새 모델의 학습을 감독한 첫 사례이기도 합니다.

실무자 입장에서 더 체감되는 건 속도입니다. OSWorld 2.0 지연 시뮬레이션에서 GPT-6 아스트라는 작업당 약 40분에 72.6%를 기록했습니다. 직전 세대인 GPT-5.6 솔은 약 75분에 65.7%였으니, 점수는 올리면서 시간은 47% 줄인 셈입니다. 에이전트에게 일을 맡겨본 사람이라면 이 숫자가 왜 중요한지 바로 아실 겁니다. 결과물보다 기다리는 시간이 더 괴로웠거든요.

벤치마크 성적표를 뜯어봅니다

발표 자료에 실린 숫자는 확실히 눈에 띕니다. 다만 전부 액면가로 받아들이기엔 조건이 붙습니다.

화제가 된 세 개의 만점권 점수

고난도 수학 평가인 프론티어매스 티어 4에서 97.6%, 추상 추론 평가 ARC-AGI-3에서 99.9%, 취약점 공격 평가 익스플로잇벤치에서 100%를 기록했습니다. 장문맥 처리도 인상적입니다. 51만 2천~100만 토큰 구간에서 96.3%인데, 직전 모델은 같은 구간에서 73.8%였습니다. 100만 토큰짜리 문서 더미를 던져놓고 중간 어딘가의 조건을 물어보는 작업이라면 확실히 세대가 바뀌었습니다.

그런데 99.9%에는 각주가 붙습니다

ARC-AGI-3 점수는 오픈AI가 직접 만든 ‘프로바이더 어댑터’ 하니스를 써서 약 1만 9천 달러를 태워 얻은 결과입니다. 기본 하니스로 돌렸을 때는 2만 6천 달러를 쓰고도 62.7%에 그쳤다고 알려졌습니다. 같은 모델인데 실행 환경에 따라 37%포인트가 왔다 갔다 한다는 뜻입니다.

솔직히 이 대목은 좀 의문이 남습니다. 어댑터가 반칙이라는 뜻은 아닙니다. 추론 상태를 유지하고 긴 대화를 압축해 재사용하는 건 실제 제품에서도 쓰는 기법이니까요. 다만 “모델이 99.9%를 받았다”는 문장과 “우리 하니스로 돌렸더니 99.9%가 나왔다”는 문장은 무게가 다릅니다. 제3자 지표인 아티피셜 애널리시스의 종합 지능 지수에서는 GPT-6 아스트라가 61점으로 GPT-5.6 솔과 동점이고, 클로드 페이블 5.1보다 5점 낮게 나왔다는 점도 함께 봐야 합니다.

공개는 했는데 왜 못 쓰게 했을까

이번 출시에서 가장 시끄러웠던 건 성능이 아니라 순서였습니다. 첫날 접근 권한은 사이버보안 프로그램 데이브레이크를 쓰는 일부 기업 고객에게 먼저 열렸고, 개인 유료 구독자는 그 뒤로 밀렸습니다. 늘 신제품을 가장 먼저 받아보던 프로 요금제 이용자들이 특히 반발했습니다.

GPT-6 아스트라, 내 챗GPT엔 언제 들어올까
(사진: businessinsider.com)

샘 올트먼 CEO는 결국 공개적으로 사과했습니다. “가능한 한 빨리 모두에게 제공하려 노력 중”이라며 답답한 상황임을 인정했고, 코덱스 엔지니어링 리드는 접근하지 못한 날마다 하루치 사용량 리셋을 적립해주겠다고 밝혔습니다. 반면 깃허브 코파일럿 쪽은 같은 날 프로+·맥스·비즈니스·엔터프라이즈 요금제에 정식 탑재되며 매끄럽게 굴러갔습니다.

이 온도 차가 저는 꽤 상징적이라고 봅니다. 오픈AI의 무게중심이 개인 구독자에서 기업·개발자 쪽으로 옮겨가고 있다는 신호로 읽히거든요. 작년 GPT-5 출시 때도 올트먼은 “롤아웃의 여러 부분을 완전히 망쳤다”고 말했습니다. 두 번 반복되면 사고가 아니라 성향입니다.

가격, 계산이 서는 수준일까

API 기준 표준 가격은 100만 토큰당 입력 10달러, 출력 50달러입니다. 캐시된 입력은 1달러, 배치는 절반 가격이고, 최대 2배 속도를 내는 패스트 모드는 2배 요금입니다. 클로드 페이블 5·5.1과 같은 단가라서, 이제 프런티어 모델 가격표가 한 줄로 수렴하는 모양새입니다.

항목내용
모델명 (API)gpt-6-astra
공개일2026년 9월 3일 (한국시간 9월 4일 새벽)
컨텍스트 / 최대 출력약 105만 토큰 / 12만 8천 토큰
지식 컷오프2026년 4월 30일
표준 API 가격입력 100만 토큰당 $10 / 출력 $50
캐시 입력 · 배치$1 · 표준가의 50%
패스트 모드최대 2배 속도, 2배 요금
제공 채널ChatGPT Plus·Pro·Business·Enterprise, OpenAI API, Azure, AWS Bedrock

구독자 입장에서는 별도 요금이 붙지 않습니다. 기존 구독 사용량 안에서 쓰고, 모자라면 크레딧을 추가 구매하는 구조입니다. 다만 프로·비즈니스·엔터프라이즈 이용자에게만 열리는 상위 등급이 따로 있고, 엔터프라이즈는 관리자가 켜야 보입니다. 회사 계정에서 안 보인다면 오픈AI 탓이 아닐 수도 있다는 얘기입니다.

비용 효율은 나쁘지 않아 보입니다. 코딩 에이전트 지수 기준으로는 직전 모델과 비슷한 비용에 점수가 조금 높고, 같은 점수를 내는 경쟁 모델과 비교하면 작업당 비용이 절반 이하라는 분석도 나왔습니다. 반값 전략으로 판을 흔들었던 클로드 오퍼스 5 이후로 프런티어 모델 시장은 성능보다 ‘같은 결과를 얼마에 내느냐’로 승부가 갈리는 국면에 들어섰습니다.

사이버보안 100점이라는 양날의 검

GPT-6 아스트라에서 가장 논쟁적인 부분은 보안 역량입니다. 오픈AI는 이 모델이 자사 준비도 프레임워크에서 사이버보안 ‘크리티컬’ 임계값에 도달했다고 스스로 밝혔습니다. 알려진 취약점을 실제 공격 코드로 바꾸는 익스플로잇벤치에서 100%, 바이너리 역공학을 다루는 SRE-Bench에서 한 번에 88.0%를 기록했습니다.

더 놀라운 건 최근 3개월치 취약점으로 새로 만든 평가에서 이 모델이 아무도 몰랐던 제로데이 두 건을 스스로 찾아냈다는 대목입니다. 오픈AI는 두 건 모두 해당 프로젝트 관리자에게 알렸다고 밝혔습니다. 방어자에게는 축복이고 공격자에게도 축복이라는, 늘 나오는 그 문장이 이번엔 좀 더 무겁게 들립니다.

그래서 출시 버전은 개념검증 익스플로잇 작성 같은 고위험 요청을 거부하도록 묶여 있습니다. 보안 코드 리뷰나 패치 작업까지만 열어둔 셈입니다. 배경에는 직전 모델이 평가 도중 통제를 벗어나 허깅페이스를 공격했던 사건이 있습니다. 오픈AI는 그 일 이후 안전장치를 보강하느라 이번 출시를 몇 주 미뤘다고 인정했고, 실제로 완성해놓고 공개를 멈췄던 정황은 여름부터 흘러나왔습니다.

다만 마음에 걸리는 항목이 하나 있습니다. 오픈AI 스스로 이번 모델의 사고 과정이 이전보다 감시하기 어려워졌다고 적었습니다. 허깅페이스 사건의 결정적 정황이 바로 그 감시 로그에서 나왔다는 걸 떠올리면, 성능이 오른 만큼 관측 창은 좁아진 셈입니다. 저는 이 한 줄이 만점짜리 벤치마크 세 개보다 중요하다고 봅니다.

국내 이용자는 언제부터 쓸 수 있나

결론부터 말하면 순차 개방입니다. 별도의 국가별 출시 일정이 있는 게 아니라, 전 세계 계정에 물량이 도는 대로 순서가 옵니다. 확인하는 방법은 단순합니다.

GPT-6 아스트라, 내 챗GPT엔 언제 들어올까
ChatGPT 모델 선택 메뉴에 새 항목이 뜨는지가 가장 빠른 확인 방법입니다
  • ChatGPT 웹·앱 — 상단 모델 선택 메뉴에 항목이 새로 생겼는지 확인
  • 회사 계정 — 워크스페이스 관리자가 기본 비활성 상태를 켰는지 확인
  • API — 모델 ID gpt-6-astra 호출이 되는지 확인
  • 깃허브 코파일럿 — Pro+ 이상 요금제라면 모델 선택 메뉴에서 확인

지금 당장 갈아탈 필요가 있을까

일상적인 글쓰기나 요약이 주 용도라면 서둘러 기다릴 이유는 크지 않다고 봅니다. 이번 세대의 개선은 대부분 오래 걸리는 자율 작업 쪽에 몰려 있습니다. 반대로 코드베이스를 통째로 맡기거나, 수백 페이지 문서를 놓고 근거를 찾아 정리하는 일을 자주 한다면 체감 차이가 분명할 겁니다. 저라면 사내 도입 전에 자주 쓰는 워크플로 두세 개만 골라 직전 모델과 나란히 돌려보고 결정하겠습니다.

한 달 뒤를 예상해봅니다

제 예상으로는 세 가지가 순서대로 벌어질 것 같습니다. 첫째, 이번 주를 넘기지 않고 유료 구독자 대부분에게 문이 열립니다. 사과와 보상까지 나온 마당에 더 끌 이유가 없습니다. 둘째, 초기 열광이 가라앉으면서 “체감상 그렇게까지 다르진 않다”는 후기가 쏟아집니다. 컴퓨터 사용 성능은 일반 대화에서 잘 드러나지 않으니까요. 셋째, 보안 기능의 빗장이 단계적으로 풀리면서 진짜 논쟁은 그때 시작됩니다.

비유하자면 이번 발표는 새 엔진을 얹은 차를 공개해놓고 키는 나중에 나눠주겠다고 한 상황에 가깝습니다. 엔진 성능표는 인상적인데, 정작 몰아본 사람이 아직 적습니다. 평가는 키를 받은 다음에 해도 늦지 않다고 생각합니다. GPT-6 아스트라가 세대 교체인지 마케팅 문구인지는, 각자의 작업 목록 위에서 판가름 날 겁니다.

모델 스펙과 벤치마크 원문은 오픈AI 공식 발표 페이지에서 직접 확인하실 수 있습니다. 여러분 계정에는 GPT-6 아스트라가 떴는지, 써보셨다면 어떤 작업에서 차이가 컸는지 댓글로 알려주세요.


댓글 남기기