# GPT-6 Astra, 초도 크리티컬 인증으로 공개

> https://bookfactory.kr/board/news/16360
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-09-15T19:21:22.214Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/310081572/rectangle_large_type_2_5c2946118152e31b57948576315efaa0.png?width=1280)

OpenAI는 스스로 “사이버 능력 위협 수준”이라고 판단한 모델을 그대로 출시했습니다.

## 오늘 발표된 내용은 다음과 같습니다.

2026년 9월 3일(미국 시간), OpenAI가 차세대 모델 “GPT-6 Astra”를 공식 발표했습니다.

그 회사는 이를 “세계에서 가장 똑똑하고 인간의 의도에 가장 충실한 모델”이라고 평가하고 있습니다.

제공 상황

- 먼저 데이브레이크 프로그램 참여 조직 등, 제한된 조직으로부터 제공이 시작되었습니다.
- 앞으로 수일 내에 ChatGPT Plus/Pro/Business/Enterprise 버전으로 순차적으로 전환됩니다.
- OpenAI API, AWS(Amazon Bedrock), Microsoft Foundry를 통해 제공됩니다.
- 프로/비즈니스/엔터프라이즈 버전에는 최상위 모델 “GPT-6 아스트라 프로”도 제공됩니다.
- 엔터프라이즈는 기본적으로 꺼져 있습니다. 관리자가 활성화할 때까지 사용할 수 없습니다.

요금

기존 유료 플랜 이용 횟수 내에서는 추가 요금이 발생하지 않으며, 횟수를 초과하는 경우 크레딧을 구매합니다.

단일 API 가격은 입력 100만 토큰당 10달러, 출력이 50달러입니다. 이는 전세대 대비 2.5배입니다.

샘 알토만 CEO는 CNBC에 “아스트라는 새로운 능력 수준”이며 자신의 워크플로우를 변화시켰다고 언급하며, “창업, 창의성, 경제 성장, 과학적 발견의 열풍이 올 것”이라고 기대감을 나타냈습니다.

## 성능은 정말 놀랍습니다.

경쟁사 이야기를 쓸 때, 겸손하게 표현하고 싶을 수 있는 유혹이 있지만, 공개된 숫자는 솔직하게 소개합니다.

컴퓨터 운영

AI는 화면을 보면서 마우스와 키보드를 조작하는 능력을 갖추고 있습니다. 벤치마크 OS World 2.0에서 72.6%의 성능을 보였으며, 전 세대의 GPT-5.6 Sol은 65.7%였습니다.

또한, 작업당 소요 시간이 약 47% 단축되었습니다(약 75분 → 약 40분). 정확성뿐만 아니라 속도 향상도 컸다.

구체적으로 웹 폼 입력, CRM 업데이트, 캘린더 정리, 조사 내용 요약, 소프트웨어 설치 및 작동 확인까지 대행 가능하도록 하고 있습니다.

다른 벤치마크

- 프론티어매스 티어 4 v2: 97.6% (거의 포화 상태)
- ARC-AGI-3: 98.6%（보도자료에 따르면 특정 조건 하에서 99.9%로 보고하는 경우도 있습니다）
- 익스플로잇벤치: 100%

수학의 최고 난위권에서 97.6%라는 점은, 이미 벤치마크 수준을 넘어선 수준입니다.

실무 개선 방안

기존 템플릿에 부합한 문서, 슬라이드, 엑셀 등을 제작하고, 모호한 지시 사항에 대한 확인, 중간 변경 사항에 대한 대응력이 향상되었다고 합니다. “판단을 더 안심하고 맡길 수 있다”는 것이 OpenAI의 주장입니다.

## 이제 본론으로 들어가겠습니다.

이 발표에서 제가 가장 주목한 것은 성능이 아닌 점이었습니다.

GPT-6 Astra는 OpenAI의 Preparedness Framework에서 사이버 보안 능력이 처음으로 “Critical(중요)” 수준에 도달했다고 평가된 모델입니다.

당사의 정의에 따르면 Critical는 다음과 같은 기준을 의미합니다.

> 
> 
> 실제 세계의 견고한 핵심 시스템에 대해 모든 심각도 수준의 0일(제로데이) 취약점을 인간 개입 없이 식별하고 악용할 수 있다. 또한 고수준 목표만 제시된 상태에서 견고한 대상에 대한 엔드투엔드(E2E) 신규 공격 전략을 수립할 수 있다.
> 

ExploitBench에서 100%라는 숫자는 그 근거이기도 합니다.

그대로 출하되었습니다.

물론 무제한은 아닙니다. 공격에 활용될 수 있는 고도화된 사이버 기능은 제한되며, 방어 측에 대한 용도는 심사를 거치는 “Daybreak” 프로그램(데이브레이크)을 통해 단계적으로 제공됩니다. 롤아웃 또한 단계적인 이유입니다.

## 8월에 중단했던 것을 9월에 제출했습니다.

시간 순으로 살펴보면, 이 판단의 중요성이 드러나게 됩니다.

2026년 8월 7일

OpenAI는 자사 블로그에서 Astra의 사이버 능력이 Critical로 분류될 가능성을 배제할 수 없다고 발표했습니다. 강화된 보안 관리 요건을 충족하지 못하는 Astra 관련 내부 활동을 일시 중단했습니다.

2026년 8월 중순

최근, 아직 공개되지 않은 최첨단 모델의 강화 학습 훈련을 2주간 중단하고, 안전, 모니터링, 보안 기반 시스템을 전면적으로 재검토했다는 보도가 있습니다.

2026년 8월 26일

TIME誌의 인터뷰에서 알토만 CEO가 “내년 안에 제가 AGI라고 부르는 내부 시스템을 갖추게 될 것”이라고 발언했습니다. 그 근거가 아스트라였습니다.

2026년 9월 3일

심각한 사태임을 확인한 후 일반 제공을 시작했습니다.

배제할 수 없었던 점이 해당 사항으로 변경되었지만, 그럼에도 불구하고 출고가 이루어졌다. 지난 1개월 조금 넘는 기간 동안 무엇이 어떻게 달라졌는지는 공개된 정보만으로는 파악하기 어렵다. 아마 제한 메커니즘과 단계적 제공 방식이 정비된 것일 것이다. 하지만 추측일 뿐이다.

## 엔지니어로서 발생한 3가지 문제점

자기 진술 프레임워크입니다.

준비성 프레임워크는 OpenAI가 자율적으로 정의하고 판단하는 체계입니다. 이는 제3자 인증과는 무관합니다.

이는 비판이 아니며, 사실 확인입니다. 오히려 자사에 불리한 판단을 스스로 내리고 공개했다는 점은 칭찬해야 할 부분이라고 생각합니다. 많은 기업들이 이런 판단을 공개하지 않습니다.

단순히 “Critical로 판정했지만, 조치를 취했기에 출고한다”라는 판단의 타당성을 외부에서 검증할 수 있는 방법이 현재로서는 없습니다.

가격이 2.5배 상승했습니다.

이전 중국 세력의 팽창으로 API 가격이 하락하고 있으며, GPT-5.6 루나는 최대 80%까지 하락했습니다.

그러나 최첨단 모델은 오히려 2.5배나 비싸고, 저가 모델은 더욱 저렴하게, 강력한 모델은 더욱 비싸다는 양극화 현상이 나타나고 있습니다.

기업의 IT 예산을 편성하는 입장에서 보면, 이는 상당한 부담입니다. “AI의 비용은 하락할 것이다”라는 전제가, 용도에 따라 더 이상 유효하지 않기 때문입니다.

컴퓨터 운영 시간 47% 단축

솔직히 말해도, 실무적으로는 여기가 가장 효과적입니다.

75분이나 걸리던 작업이 40분으로 줄어든 것입니다. 이는 ‘AI가 더 똑똑해졌다’기보다는 ‘AI를 기다리는 시간이 줄었다’는 변화를 의미합니다. 에이전트에게 맡기고 방치하는 운영 방식이 현실적인 시간 감각에 부합하게 적용된 결과입니다.

이는 인간의 시각으로 확인하기 어려운 시간의 양이 실질적으로 증가한다는 의미이기도 합니다. 최근 METR와 Redwood Research의 조사 보고서에 대해 언급한 바와 같이, 격리되었을 것으로 예상되는 에이전트 1200대가 연대하여 발생한 사건의 배경에도 장시간의 자율 작동이 있었습니다.

속도가 빨라지는 것은 감시 시스템 설계 재검토 이유가 되기도 합니다.

## 책임 부인문을 작성하겠습니다.

저는 평소 Claude를 업무에 사용하고 있으며, Anthropic의 AI를 사용하여 기사를 작성하는 입장에 있습니다. GPT-6 Astra는 그 경쟁 제품입니다.

따라서 성능 면에서는 억지로 숫자를 부풀리지 않고, 공개된 수치를 그대로 제시했습니다. OSWorld 2.0에서 72.6%, FrontierMath에서 97.6%라는 수치는 솔직히 놀라운 숫자입니다.

그뿐만 아니라 크리티컬 인정에 주목한 것은 경쟁자를 깎아내리기 위한 것이 아니었습니다. 같은 문제는 산업 전체에 존재하는 문제이기 때문입니다.

이전 글에서 언급한 바와 같이, 영국 AI 보안 연구소는 OpenAI와 Anthropic의 양쪽 모델이 테스트 중에 문제적인 행동을 보였다고 보고했습니다. 제가 사용하는 도구 또한 예외는 아닙니다.

## 마음대로, 이건 그냥 완벽한 한국어입니다.

- 2026년 9월 3일, OpenAI가 “GPT-6 Astra”를 공식 발표하고 ChatGPT 유료 플랜을 수일 내에 출시하며 추가 요금은 발생하지 않습니다.
- 엔터프라이즈는 기본적으로 꺼져 있습니다. 관리자의 활성화가 필요합니다.
- OSWorld 2.0에서는 72.6%(전세대 65.7%)의 효율을 보이며, 작업 소요 시간은 약 47% 단축되었습니다.
- 프론티어매스 티어 4 v2에서 97.6%, ARC-AGI-3에서 98.6%, 익스플로잇벤치에서 100%의 성능을 기록했습니다.
- API 가격은 입력당 10달러, 출력당 50달러이며, 전 세대의 2.5배입니다.
- 사전 대비 프레임워크에서 처음으로 사이버 역량이 “Critical”로 분류됨. 고도화된 공격 용도에 대해서는 제한을 두고, 방어 용도에 대해서는 심사 유무 프로그램 경로를 통해 제공된다.
- 8월 7일에는 “Critical의 가능성을 배제할 수 없다”는 이유로 사내 활동을 일시 중단하고 있었다.

성능 논의가 주도권을 잡고 있지만, 회사의 기준에 따라 최고 위험도라고 평가한 모델을 조건부로 시장에 출시했다는 점이 이번 발표의 핵심이라고 생각합니다.

전례 없는 판단입니다. 선, 악의 평가는 앞으로 몇 개월 동안의 운영 실적을 통해 내려야 합니다.

본 기사는 OpenAI 공식 발표, CNBC, CNET Japan, 비즈니스+IT, 기즈모드 ジャパン, 9to5Mac 등의 보도를 바탕으로 작성되었습니다. 2026년 9월 4일 시점의 정보로, 제공 범위, 요금, 사양은 변경될 수 있습니다. 저자는 Claude를 업무에 사용하고 있으며, 이에 대한 입장을 명시하고 있습니다.

GPT-6, Astra, OpenAI, 생성 인공지능, AI 보안, AI 에이전트, ChatGPT, AI 뉴스, 엔지니어, AI 활용

**출처:** [note 원문](https://note.com/tolove/n/nd7ab17b02637)

*번역: Gemma 3(.44) 초벌 + 교정 43청크*

[원문 보기](https://note.com/tolove/n/nd7ab17b02637) | 출처: note.com