# 'GPT-6 Astra' 등장, PC 조작을 매우 잘해 'Blender로 3D 모델을 만들어 UE5에서 걸어 다닐 수 있는 공간으로 만들기' 등도 가능 & ARC-AGI-3에서 99.9% 달성

> https://bookfactory.kr/c/news/10846
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-09-05T02:52:43.992Z

---

OpenAI가 2026년 9월 3일에 새로운 AI 모델 'GPT-6 Astra'를 발표했습니다. GPT-6 Astra는 PC 조작이나 브라우징, 프로그래밍, 과학, 사이버 보안 등에서 기존의 GPT-5.6 Sol을 상회하는 성능을 표방하고 있으며, Blender를 사용한 3D 제작이나 Unreal Engine 5를 조작하는 데모도 공개되어 있습니다. 나아가 AI의 미지의 문제에 대한 대응력을 조사하는 'ARC-AGI-3'에서는 최대 99.9%를 기록하고 있습니다.GPT-6 Astra: A new generation of intelligence | OpenAIhttps://openai.com/index/gpt-6-astra/

This is GPT-6 Astra.Anything you can do on a computer, Astra can do for you. Fast.pic.twitter.com/gDd0IsewJw

최근의 AI는 문장을 만드는 것뿐만 아니라, 브라우저나 PC용 앱을 실제로 조작하여 업무를 진행하는 'AI 에이전트'로도 활용되고 있습니다. GPT-6 Astra는 PC 조작 능력이 크게 강화되어 양식 입력이나 일정 정리, 웹 조사, 웹사이트 제작, 소프트웨어 설치 및 테스트 등을 실행할 수 있다고 합니다. OpenAI 사이트에서는 GPT-6 Astra가 Excel을 능숙하게 다루어 Excel 세계대회 과제를 푸는 모습 외에도, PC상의 다양한 작업을 수행하고 있는 사례가 게재되어 있습니다.

3D 제작이나 회계, 소프트웨어 개발 등 실제 업무에 가까운 장시간 PC 작업을 AI가 어디까지 해낼 수 있는지를 조사하는 벤치마크 'Agents' Last Exam'에서는 59.3%를 기록하며 GPT-5.6 Sol의 53.6%를 상회했습니다. 최고 점수를 기록한 설정에서는 Claude Opus 5보다 출력 토큰 수가 약 65% 적었다고 합니다.

PC를 조작할 수 있는 능력은 크리에이티브 분야에서도 활용되고 있습니다. 다음은 GPT-6 Astra를 통한 Blender에서의 3D 모델링 예시.

그리고 다음은 Blender로 모델링한 집을 Unreal Engine 5로 가져와 걸어 다닐 수 있는 상태로 만든 데모입니다.

이처럼 GPT-6 Astra는 Blender나 게임 엔진 같은 제작 툴을 사용하면서 작업을 진행할 수 있다는 것입니다. 게임 개발사인 Playco도 GPT-6 Astra를 사용한 게임 제작을 시도하고 있으며, 기존 모델에 비해 수작업을 통한 수정이 50% 감소했다고 보고했습니다. OpenAI 페이지에서는 실제로 GPT-6 Astra가 제작한 게임을 플레이해 볼 수 있습니다.

더욱 눈길을끄는 것은 'ARC-AGI-3'의 성적입니다. ARC-AGI-3는 처음 보는 추상적인 턴제 환경을 AI에게 조작하게 하여, 규칙을 추론하면서 문제를 풀 수 있는지를 조사하는 벤치마크. GPT-6 Astra는 OpenAI 측의 컨텍스트 관리 기능을 이용할 수 있는 'Provider Adapter harness'에서는 최고 99.9%를 기록했습니다.

덧붙여 동일한 조건에서 각사의 모델을 비교하기 쉽게 만든 'Standard harness'에서의 최고 점수는 62.7%입니다. ARC Prize는 62.7%와 99.9% 모두를 최고 수준의 결과로 평가하고 있습니다.

또한, Provider Adapter harness에서는 사람이 클리어했을 때의 중앙값보다 적은 조작 횟수로 해결한 스테이지가 96%에 달했다고 합니다. 아래 이미지는 ARC-AGI-3에서 GPT-6 Astra와 사람의 조작 효율을 비교한 그림입니다. 점이 대각선 기준선보다 아래쪽에 있는 경우, GPT-6 Astra가 사람보다 적은 조작 수로 클리어했음을 나타냅니다.

사이버 보안 분야에서도 성능이 향상되었습니다. 알려진 소프트웨어 취약점으로부터 실제로 공격 가능한 코드를 만들 수 있는지를 조사하는 'ExploitBench'에서는 100%를 기록해 GPT-5.6 Sol의 78.5%를 상회했습니다. OpenAI는 GPT-6 Astra가 자사의 안전성 평가에서 사이버 능력의 'Critical' 수준에 도달한 최초의 모델이라고 밝혔으며, 고도화된 공격으로 이어지는 요청을 제한하는 안전 대책도 강화하고 있습니다. 아래 표는 OpenAI가 공개한 GPT-6 Astra와 GPT-5.6 Sol의 주요 벤치마크 결과를 비교한 것입니다.

GPT-6 Astra는 기사 작성 시점에 일부 조직을 대상으로 제공이 시작되었으며, 향후 며칠에 걸쳐 ChatGPT Plus, Pro, Business, Enterprise 및 OpenAI API, Amazon Bedrock에도 배포될 예정입니다. OpenAI는 장시간에 걸친 PC 조작이나 전문적인 작업을 수행하는 능력을 향상시키는 한편, 사용자가 지정한 작업 범위를 준수하는 능력에 대해서도 개선했다고 밝혔습니다.

[원문 보기](https://gigazine.net/news/20260904-openai-gpt-6-astra/) | 출처: Gigazine