OpenAI의 AI 고속 처리 서비스 “Ultrafast”에서 GPT-6 Astra가 이용 가능해졌습니다. GPT-6 Astra의 Ultrafast는 표준 모드의 최대 8배의 속도를 실현한다고 합니다. Ultrafast 모드 | OpenAI API https://developers.openai.com/api/docs/guides/ultrafast-mode
오늘부터 GPT-6 Astra에서 Codex, ChatGPT Work, 그리고 API에서 Ultrafast가 이용 가능하며, GPT-6.1 Sol이 곧 출시될 예정입니다. Codex와 ChatGPT Work에서 이를 이용하려면 Pro 500—최고 사용량 제한(25x Plus) 및 Ultrafast에 대한 액세스를 제공하는 새로운 플랜을 도입합니다. https://t.co/AjmAVwyUQI
울트라파스트는 2026년 8월에 GPT-5.6 솔로 등장한 고속 추론 기술로, 출력 토큰당 요금이 높아지는 대신 처리 속도를 올리는 “Fast 모드”보다 훨씬 더 초고속 처리를 가능하게 합니다. GPT-5.6 솔에서는 프리뷰 버전이 제공되고 있지만, GPT-6 아스트라에서는 울트라파스트가 널리 이용 가능해지고 있습니다. 다음은 OpenAI 개발자들이 게시한 표준 모드와 울트라파스트를 비교한 뮤비입니다. 같은 프롬프트를 입력해도, 울트라파스트는 압도적으로 빠르게 콘텐츠 생성이나 질문에 대한 답변을 출력하는 것을 알 수 있습니다.
울트라파스트는 아스트라와 함께 구축하는 가장 빠른 방법입니다: 코덱스에서는 울트라파스트가 아스트라 스탠다드보다 최대 8배 더 빠르고 아스트라 패스트보다 4배 더 빠릅니다. 아이디어를 최대한 빨리 입력하는 대로 구현하세요. pic.twitter.com/FSk8eNRmWz
또한, 다음은 로켓을 3D 렌더링하여 하늘에 날리는 애니메이션을 제작하는 속도를 표준 모드와 Ultrafast 모드로 비교한 영상입니다. OpenAI에 따르면, Ultrafast는 Codex에서 최대 8배 빠른 토큰 생성(1초당 300 토큰)을 제공하며, API에서는 최대 6배 빠른 속도를 제공한다고 합니다.
이것은 Ultrafast입니다. 저희 프리미엄 속도 티어, Ultrafast는 Codex에서 최대 8배 빠른 토큰 생성(1초당 300 토큰)을 제공하며, API에서는 최대 6배 빠른 속도를 제공합니다. pic.twitter.com/ekyzT1vFan
사용하려면 “response.create” 이벤트 요청 설정 시 “model”을 “gpt-6-astra”, “service_tier”을 “ultrafast”로 설정하면 OK 합니다. 또한, Ultrafast는 SDK를 통한 HTTP 요청도 지원합니다. GPT-6 Astra의 기본 초고속 토큰 제한에서는 API 사용 레벨이 tier1~3 경우에는 1분당 50만 토큰, tier4 경우에는 1분당 100만 토큰, tier5 경우에는 1분 500만 토큰이 됩니다. 또한, 가격표에 따르면 표준 경우에는 입력 100만 토큰 당 간단한 설명은 10달러(약 1500원), 긴 컨텍스트는 20달러(약 3100원)이지만, Ultrafast 경우에는 입력 100만 토큰 당 간단한 설명은 60달러(약 9300원), 긴 컨텍스트는 120달러(약 18000원)로 높습니다. OpenAI는 “속도가 비용 증가에 부합하는 경우에만 사용해 주세요”라고 언급했습니다.
Ultrafast는 2026년 9월 30일부터 Codex, ChatGPT Work, 그리고 API에서 GPT-6 Astra를 대상으로 이용 가능합니다. GPT-6.1 Sol은 다가오는 시점에 출시될 예정입니다. 또한, Codex 및 ChatGPT Work에서 Ultrafast에 접근하기 위해서는 함께 출시된 월 84,000엔(₩84,000)의 요금제 “Pro 500”을 계약해야 합니다. Pro 500은 Ultrafast를 사용할 수 있을 뿐만 아니라, ChatGPT의 이용 제한도 크게 상향 조정되었습니다.
원문 보기 | 출처: Gigazine