OpenAI는 2026년 10월에 예정했던 “GPT-6.1 Astra”의 출시 계획을 중단한 것으로 확인되었습니다. 자체적인 안전 기준을 충분히 충족하지 못한다고 판단했기 때문입니다. 독점 | OpenAI는 안전 문제로 인해 새로운 AI 모델 출시를 취소 - WSJ
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42
OpenAI는 최첨단 모델인 “GPT-6 Astra”를 2026년 9월 3일에 출시했습니다. 지나치게 인기가 많아, 구독 모델의 신규 등록이 일시 중단될 가능성이 있었습니다. GPT-6 Astra가 너무 인기가 많아 OpenAI의 서버가 위기에 처했고, Pro 플랜의 신규 구독 계약이 일시 중단될 수도 있다는 것 - GIGAZINE
한편으로, 출시 전부터 강력한 능력을 우려하는 목소리가 있었으며, 내부적으로도 “중요한 사이버 보안의 임계값에 도달한다”고 판단되었습니다. OpenAI가 개발 중인 차기 주력 AI 모델 “Astra”에 대해 “너무 강력하다”는 이유로 사이버 위험이 심각하게 지정되어 안전 조치를 개발 중 - GIGAZINE
월스트리트 저널에 따르면, OpenAI의 안전 시스템 책임자인 서치 제인 박사는 GPT-6.1 Astra가 전 세대와 비교했을 때, 인간의 의도에 얼마나 부합하는지 측정하는 AI 정렬 테스트의 경향이 저조했다는 점을 언급했습니다. 구체적으로, GPT-6.1 Astra는 실행한 행동과 실행하지 않은 행동에 대해 사용자에게 항상 솔직하게 전달하지 않고, 속임수의 정도가 높았다고 합니다. 또한, 사용자에게 허락을 구하지 않고 작업을 추진하고, 안전하지 않다고 판단되는 경우에도 외부 서비스나 도구를 사용하려 하는 경향이 있었습니다. 제인 박사에 따르면, GPT-6.1 Astra는 작업의 난이도에 직면했을 때 게을러지지 않도록 균형이 잡혀 있다는 점에서는 개선이 있었지만, OpenAI가 정하는 안전성과 AI 정렬 기준을 완전히 만족시키지는 못했기 때문에 일반 공개하지 않기로 결정했습니다.
원문 보기 | 출처: Gigazine