GPT Astra 출시일과 위험 등급: 오픈AI가 스스로 늦춘 두 달

GPT Astra, 오픈AI 다음 모델. 출시일 미발표에 사이버 역량은 치명적 등급

요즘 Astra라는 이름이 자주 보이시죠. 오픈AI(OpenAI)의 다음 모델인데, 아직 안 나왔어요.

그런데 이상한 게 있습니다. 보통 회사는 새 모델을 자랑하잖아요. 오픈AI는 반대로 "이 모델이 위험해서 늦추고 있다"는 글을 두 달째 쓰고 있어요. 9월 1일에는 아예 자사 기준으로 사이버 역량이 '치명적' 등급을 넘은 첫 모델이라고 발표했고요.

결론부터 말씀드릴게요. Astra는 곧 나오는데 날짜는 안 밝혔고, 사이버 관련 기능은 승인받은 사람에게만 열립니다. 출시일을 적어둔 기사가 보이면 그건 추측이에요.

GPT Astra가 뭔가요

오픈AI의 다음 프런티어 모델이에요. 지금 쓰는 GPT-5.6 계열의 다음 세대고요.

아직 아무도 못 씁니다. 오픈AI가 이름과 안전성 문서만 먼저 공개한 상태예요. 성능 수치나 가격, 모델 ID는 하나도 안 나왔습니다.

특이한 건 공개 순서예요. 보통은 성능을 먼저 알리고 나중에 안전 문서를 붙이는데, 이번엔 안전 문서가 먼저 나왔어요. 그것도 "우리 모델이 위험하다"는 내용으로요.

출시일은 언제인가요

오픈AI가 날짜를 밝힌 적이 없어요. 공식 표현은 "soon", 그러니까 곧이라는 말뿐입니다.

가격도, 모델 ID도, 벤치마크 점수도 공개 안 됐어요. 날짜가 적힌 기사는 전부 추측입니다. 저도 오늘 확인하면서 여러 곳을 봤는데, 오픈AI 문서 어디에도 날짜가 없었어요.

대신 이건 밝혔습니다. 나와도 사이버 관련 고급 기능은 아무나 못 씁니다. 승인받은 사람에게만 먼저 열어요.

"치명적"이 무슨 뜻인가요

오픈AI에는 대비 프레임워크(Preparedness Framework)라는 게 있어요. 2023년에 만든 자체 위험 등급표인데, 사이버 항목에서 제일 높은 게 치명적, 영어로 Critical이에요.

기준이 꽤 구체적이에요. 둘 중 하나만 되면 치명적입니다.

  • 사람이 한 단계씩 지시하지 않아도, 잘 방어된 실제 시스템 여러 곳에서 알려지지 않은 취약점을 찾아 작동하는 공격 코드까지 만들어내는 것
  • 높은 수준의 목표 하나만 주면, 방어된 표적을 상대로 새로운 공격 전략을 처음부터 끝까지 세우고 실행하는 것

Astra가 이 기준을 넘은 첫 모델이라고 오픈AI가 직접 발표했어요. 자기 회사 모델을 두고 한 말입니다.

여기서 오해하기 쉬운 게 있는데요. 이게 "Astra가 해킹을 한다"는 뜻은 아니에요. 시켰을 때 그만큼 할 수 있는 능력이 된다는 판정이고, 그래서 못 하게 막는 장치를 붙이는 중이라는 얘기입니다.

그래서 뭘 잠갔나요

사이버 기능을 데이브레이크(Daybreak)라는 승인 프로그램 안으로 넣었어요. 두 갈래입니다.

  • 데이브레이크 블루(Daybreak Blue): 방어 쪽이에요. 취약점 찾기, 악성코드 분석, 사고 대응, 패치 검증 같은 일이고요. 오픈AI는 대부분의 방어자에게 여기서 시작하라고 합니다
  • 데이브레이크 레드(Daybreak Red): 공격 관점 테스트 쪽이에요

블루에서는 시스템 차원의 사이버 가드레일을 풀어줍니다. 일반 계정에서는 거절당하는 보안 작업을 할 수 있다는 뜻이에요.

대신 문턱이 있어요. 신원 확인, 모니터링, 법적 확약을 거쳐야 승인이 납니다. 개인이든 조직이든 정당한 보안 업무를 한다는 걸 증명해야 하고요.

오픈AI가 이렇게 하는 이유도 밝혔습니다. 공격자가 먼저 AI를 쓰기 전에 방어자 손에 먼저 쥐여주겠다는 거예요. 방어할 시간이 줄어들고 있다는 판단이고요.

여기까지 온 두 달

갑자기 나온 얘기가 아니에요. 8월 내내 이어진 일입니다.

  • 8월 7일: 보안 우려로 Astra 개발 일부를 늦추고 있다고 밝힘
  • 8월 11일: 데이브레이크를 블루와 레드로 나눠 확장하고, 보안 연구자용 GPT-5.6-Cyber 공개. 같은 시기에 위험 행동과 정렬 이탈을 감시하는 모니터링을 붙임
  • 8월 18일: 사이버 역량 시대에 모델 개발 속도를 조절한다는 문서 공개
  • 9월 1일: Astra가 치명적 기준을 넘은 첫 모델이라고 발표. 곧 내되 사이버 기능은 제한한다고 밝힘

두 달 동안 다섯 번 글을 썼어요! 모델은 아직 안 냈는데요. 이 순서 자체가 이번 건의 핵심이라고 봅니다.

앤트로픽도 같은 주에 같은 선택을 했어요

여기가 제일 흥미로운 부분이에요!

9월 1일, 같은 날에 앤트로픽(Anthropic)도 페이블 5.1과 미토스 5.1을 냈습니다. 둘은 성능이 똑같은 모델인데, 안전장치 수준만 다르게 해서 갈라 냈어요. 미토스는 신뢰 프로그램 참가자만 쓰고요.

오픈AI의 데이브레이크 블루와 구조가 판박이입니다.

  • 센 모델을 만들었다
  • 다 풀지 않는다
  • 신원 확인된 방어자에게만 따로 연다

두 회사가 상의한 것도 아닌데 같은 주에 같은 답을 내놨어요. 프런티어 모델을 다루는 방식이 "출시냐 아니냐"에서 "누구에게 어디까지"로 옮겨가고 있다는 신호로 읽힙니다.

앤트로픽 쪽 숫자와 가격은 페이블 5.1 총정리에 정리해 뒀어요.

그럼 지금은 뭘 쓰나요

Astra가 나올 때까지는 GPT-5.6 계열이 최신이에요. Sol, Terra, Luna 셋으로 갈리고 용도와 가격이 다릅니다.

셋이 어떻게 다르고 뭘 골라야 하는지는 GPT-5.6 총정리, Sol·Terra·Luna 차이와 가격 그리고 출시일에 다 적어뒀어요.

보안 업무를 하시는 분이라면 GPT-5.6-Cyber가 이미 나와 있습니다. 이것도 데이브레이크 승인이 필요하고요.

지피터스에서는 이렇게 보고 있어요

저는 국내 최대 AI 커뮤니티 지피터스(GPTers)에서 마케팅을 하면서 매일 AI 도구를 씁니다. 모델이 바뀔 때마다 회원분들이 바로 써보고 기록을 남기세요.

자주 묻는 질문

Q. GPT Astra 출시일이 언제인가요?

오픈AI가 날짜를 밝힌 적이 없어요. "곧"이라고만 했습니다. 날짜가 적힌 기사는 추측이에요.

Q. Astra를 지금 써볼 수 있나요?

아직 아무도 못 씁니다. 이름과 안전성 문서만 공개된 상태예요.

Q. 치명적 등급이면 위험한 모델인가요?

"시켰을 때 그만큼 할 수 있다"는 능력 판정이에요. 그래서 오픈AI가 못 하게 막는 장치를 붙이는 중이고요. 일반 사용자가 쓰는 기능과는 다른 얘기입니다.

Q. 데이브레이크 블루는 어떻게 신청하나요?

정당한 보안 업무를 한다는 걸 증명해야 해요. 신원 확인과 모니터링, 법적 확약을 거쳐 승인이 납니다. 오픈AI 헬프센터에 데이브레이크 안내가 따로 있어요.

Q. Astra 성능이 GPT-5.6보다 얼마나 좋나요?

벤치마크 점수가 공개 안 됐어요. 사이버 역량이 치명적 기준을 넘었다는 것만 밝혔습니다.

Q. 앤트로픽 페이블 5.1과는 무슨 관계인가요?

경쟁 모델이고, 공교롭게 같은 날 발표됐어요. 센 모델을 다 풀지 않고 승인된 사람에게만 따로 연다는 구조도 같습니다.


확인일: 2026년 9월 2일. 오픈AI가 공개한 대비 프레임워크 관련 발표와 데이브레이크 안내를 기준으로 정리했어요. Astra는 아직 출시 전이라 성능과 가격은 공개된 정보가 없습니다. 출시 시점과 접근 정책은 바뀔 수 있어요.

글쓴이: 강지인. 국내 최대 AI 커뮤니티 지피터스(GPTers)에서 마케팅을 합니다. 매일 AI 도구를 직접 써보고 결과를 글로 남겨요.