OpenAI는 차세대 모델 “Astra”의 개발을 일시 중단했습니다. 이는 OpenAI가 처음으로 “크리티컬” 평가를 받은 사례입니다.
OpenAI는 8월 7일, 차기 프론티어 모델 “Astra”의 내부 개발 일부를 일시 중단했다고 발표했습니다. 그 이유는, 내부 테스트 결과 Astra가 OpenAI의 “Preparedness Framework(준비 프레임워크)” 내 최고 위험 등급인 “Critical(비판적)”에 도달할 가능성을 부정할 수 없었기 때문입니다.
“크리티컬”이란 무엇인가? 이 프레임워크에서는 사이버 보안 위험을 “High”와 “Critical” 두 단계로 평가한다. “Critical”의 정의는 ① 인간의 개입 없이 견고하게 보호된 실환경 시스템에 대해 모든 심각도의 제로데이 취약점을 자율적으로 발견하고 악용하는 것, ② 대략적인 목표만 주어진 상태에서 견고한 표적 시스템에 대해 처음부터 끝까지 자율적으로 계획하고 실행하는 것 중 하나이다. ASTRA는 지금까지 공개된 어떤 모델(현재 최고 버전인 GPT-5.6 솔 포함)도 달성하지 못했던 수준에 처음으로 가까워졌다고 평가되었다.
덧붙여 7월에 보도된 Hugging Face 관련 사건(자율형 AI 에이전트라고 불리는 침해 사건)과는 별개의 내용입니다. 그 사건은 GPT-5.6 Sol이 연루된 것으로 보고되었으며, 이번 Astra 일시 중지는 “미공개 모델이 내부 테스트에서 위험 지역에 가까워진” 사례로, 성격이 다른 사건입니다.
현재 대응
- 네트워크 연결이 없는 격리된 환경에서만 테스트를 진행합니다.
- 모델의 가중치를 강력하게 암호화하고, 도구에 대한 접근을 제한
- 사고 과정의 자동 모니터링으로 위험 징후를 조기에 감지
- 영국 AI 안전 기관(UK AI Security Institute)을 포함한 외부 기관의 추가 검증을 진행 중입니다.
CEO 샘 알토먼은 언젠가 Astra를 일반 공개할 계획을 보이고 있지만, 공식적인 공개 시기는 미정입니다. 블로그 문구에서 “수개월” 단위의 지연이 시사되고 있습니다. 이 일시 중지는 기존 제품(ChatGPT나 API를 통한 GPT-5.6 시리즈)에는 영향을 미치지 않습니다.
ChatGPT는 월간 활성 사용자 10억 명을 돌파 – 그 뒤에 숨겨진 “지속적인 월간 점유율 실패”가 있다.
7월 31일, ChatGPT 앱의 월간 활성 사용자(MAU)가 10억 명을 돌파했습니다. 역대 가장 빠른 속도로 10억 명의 사용자에게 도달한 앱이 되었으며, 인스타그램이 2.5년 동안 노력한 규모를 ChatGPT가 단 2개월 만에 달성한 성적과 비교하는 경우도 있습니다.
성장 추이는 주간 활성 사용자(WAU) 기준으로 2025년 2월의 4억 명에서 2026년 2월에는 9억 명으로 두 배 증가했습니다. 7월 말 시점에서는 10억 명에 육박하는 수준까지 확대되었습니다. 그러나 이 10억 명 도달은 초기 목표(2025년 연말)에서 약 7개월 지연된 것이며, 2025년 가을의 GPT-5 출시와 Gemini, Claude, Perplexity와의 경쟁 심화가 성장 둔화의 한 원인으로 분석됩니다.
숫자의 뒷면에 숨겨진 과제입니다. 사용자 수는 늘고 있지만, 수익 구조는 매우 어렵습니다. 2026년 1분기 예상 매출은 57억 달러에 이를 것이지만, GAAP 외 기준의 영업이익률은 -122%입니다. 즉, 1달러의 매출에 대해 약 1.22달러의 영업 손실을 보낸다는 계산입니다.
경쟁사의 추격도 뚜렷하게 나타나고 있습니다. 특정 산업 데이터에 따르면, AI 봇의 웹 트래픽 점유율에서 Anthropic의 ClaudeBot이 7월 31일 동안 OpenAI의 GPTBot을 상회했습니다(16.28% vs 9.74%). 사용자 수에서는 여전히 압도적인 세계 1위이지만, 웹/모바일의 점유율 관련 지표는 올해 들어 매달 OpenAI에 불리한 방향으로 움직이고 있다는 분석도 있습니다. ChatGPT와 Anthropic 양사가 IPO(기업공개)를 고려하는 가운데, “소비자 데이터가 역방향으로 움직이는 시점에 양사 모두 투자자들에게 성장 스토리를 제시하려 하고 있다”는 지적도 나오고 있습니다.
3. Anthropic, 2개 분기 연속의 급성장 – 예상치를 상회하는 11억 5천만 달러 이상의 실시간 데이터
초반에 앤트로픽은 2026년 2분기 매출액을 109억 달러, 처음으로 영업이익을 5억 5900만 달러(순이익률 약 5.1%)로 투자자들에게 설명했습니다. 그러나 8월 15일에 밝혀진 속보에 따르면 매출액은 115억 달러를 넘어 처음 예상했던 수준을 상회하는 결과가 되었습니다. 1분기 47억 3천만 달러에서 두 배 이상 증가했으며, 전년 동기 7억 8700만 달러에서 14배 이상 급증했습니다.
흑자 전환을 지탱한 요인으로는 1달러당 컴퓨팅 비용이 1분기에 71센트에서 2분기에는 56센트로 감소했다는 점이다. 이것이 흑자 전환의 주요 원인으로 분석된다. 초기, Anthropic은 2025년 8월에 투자자들에게 “2028년 이전에는 흑자 전환이 불가능하다”고 설명했기 때문에 9개월 만에 흑자 전환을 달성한 것은 계획을 크게 앞당긴 형태가 되었다.
留意点으로는 일부 보도에서 이 손익분기 지점에 주의해야 할 점이 있다는 지적도 있습니다. Anthropic은 SpaceX의 데이터센터(콜러스)용으로 월 12억 5천만 달러 규모의 계약을 체결했으며, 그 지불이 5월부터 6월 사이에 할인된 시점과 손익분기 발표 시기가 겹친다는 지적입니다. 이것이 즉시 숫자의 조작을 의미하는 것은 아니지만, 제3사분기 이후에도 동 수준의 손익을 유지할 수 있을지는 불투명한 시각도 있습니다.
Anthropic는 2026년 5월, 650억 달러 규모의 시리즈 H 투자를 965억 달러의 기업 가치 평가액으로 완료하여, OpenAI의 852억 달러(당시)를 넘어선 세계 최고 평가액의 미공개 AI 기업으로 자리매김했다.
4. DARPA, 인공지능 조종 F-16 전투기 성공 시범 – “VENOM” 계획의 실체
DARPA(미국방고등연구계획국)와 미공군(US Air Force)은 “VENOM(Viper Experimentation and Next-gen Operations Model)” 계획에 따라 AI 에이전트가 조종하는 개조된 F-16 전투기 비행 시험을 실시했습니다.
배경에 있는 탑재체, 이 성과는 갑작스럽게 나온 것이 아니라 DARPA의 “에어 어컴뱃 이볼루션(ACE)” 계획의 연장선상에 있습니다. ACE 계획에서는 2023년부터 2024년 사이에 특별 개조기 “X-62A(비스타)”를 활용하여 AI가 인간 조종사를 상대로 근접 공중전(도그파이트)을 수행하는 시험에 세계에서 처음 성공했습니다. 이 과정에서 21회의 시험 비행, 10만 건을 초과하는 비행 제어 소프트웨어 변경, 최접 시에 속도 약 540m(시속 1,200마일), 거리는 약 600m(2,000피트)라는 극도로 높은 상황 하에서의 테스트가 진행되었습니다.
이번 VENOM은 실험용으로만 사용되던 X-62A와 달리, 실제 전술 배치형 F-16을 개조하여 AI 조종을 가능하게 한 점이 특징입니다. “VENOM Autonomy Kit”라는 장치를 장착함으로써 기체 핵심 소프트웨어를 변경하지 않고도 비행 제어와 센서를 자동화했습니다. 조종사는 하나의 스위치로 인간 조종과 AI 조종을 전환할 수 있는 시스템이 적용되었으며, 인간이 탑승하여 감시하는 “Human-on-the-loop” 형태입니다.
이 VENOM 기는 앞으로 시정장외(BVR: Beyond Visual Range)에서의 다수 기에 의한 공중전이나 전자전 상황에서의 전술 판단을 다루는 신 계획 “AIR(인공지능 보강)”의 핵심적인 테스트 기반으로 활용될 예정입니다. 미국이 군사 분야에서의 AI 통합을 단계적이고 확실하게 추진하고 있음을 엿볼 수 있습니다.
5. GPT-5.6의 API 가격이 대폭 인하 – AI가 스스로 비용을 절감했다
7월 30일, OpenAI는 GPT-5.6 시리즈의 가격을 개정했습니다.
모델 변경 전 (입력/출력, 100만 토큰당)
Luna (경량 버전): 1.00 / 6.00 → 0.20 / 1.20 (▲80%)
Terra (중간 버전): 2.50 / 15.00 → 2.00 / 12.00 (▲20%)
Sol (최상위): 5.00 / 30.00
주목할 만한 점은 비용 절감의 ‘방식’입니다. 이번 인하의 배경에는 최상위 모델인 GPT-5.6 솔이, 코딩 에이전트 “Codex”에서 자신의 본번 GPU 커널을 자율적으로 재작성했다는 일이 있습니다. 인간 엔지니어의 감독 하에 솔은 Triton이나 Gluon(OpenAI가 개발한 GPU용 오픈소스 언어)을 사용하여 커널을 재작성했으며, 이를 통해 서빙(모델 운영) 비용을 약 20% 절감했습니다. 또한 투기적 디코딩(speculative decoding) 메커니즘도 자율적인 실험을 거듭하며 개선하여 토큰 생성 효율을 15% 이상 향상시켰다고 합니다.
이는 “프론티어 모델이 자신의 제공 비용을 최적화하고, 그 결과가 실제로 고객 대상 가격에 반영된” 거의 처음으로 공개된 사례로 여겨지며, AI의 자기 개선이 실운영 수준에서 표면화된 한 예시로 주목받고 있습니다.
Luna의 신 가격(입력 100만 토큰당 0.20달러)은 Google의 Gemini 3.1 Flash-Lite나 Anthropic의 Claude Haiku 4.5와 비교했을 때 뚜렷하게 낮은 수준입니다. 하락의 배경에는 DeepSeek를 비롯한 중국발 모델과의 가격 경쟁과 Anthropic 및 Google과의 경쟁 압력이 있다는 분석이 있습니다. 실제로 이 발표 직후에는 DeepSeek V4의 공식 출시도 이어졌습니다.
본 기사는 여러 해외 뉴스 소스를 바탕으로 요약 및 편집한 것입니다. 숫자와 날짜는 작성 시점의 보도 내용을 기준으로 하며, 향후 수정될 수 있습니다.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 20청크
원문 보기 | 출처: note.com