# OpenAI는 “안전’을 위해 AI 강화 학습을 2주간 중단했다고 자사의 안전 조치를 홍보했습니다.

> https://bookfactory.kr/c/news/10013
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-08-19T04:13:22.692Z

---

OpenAI는 테스트 중인 모델로 인해 다른 회사 서버에 공격을 가하거나, 개발 중인 차세대 주력 모델인 Astra를 사이버 위험으로 심각하게 지정하는 등 고성능 AI로 인한 보안상의 문제에 연이어 직면하고 있습니다. 이러한 상황에서 안전 조치를 강화하기 위해 개발 중인 모델의 강화 학습을 일시 중단한 사실이 밝혀졌습니다. Pacing model development in an era of cyber-critical capabilities | OpenAI

모델이 더욱 강력해짐에 따라 개발 및 테스트와 관련된 위험도 함께 증가합니다. 최근 2주 동안 최신 배포 모델에 대한 강화 학습(RL) 훈련을 중단하고, 연구를 강화 및 레드팀으로 테스트하면서 보안을 강화했습니다.

OpenAI는 이전부터 개발 중인 모델에 대한 안전성 감시 체계를 구축해 왔지만, 모델의 성능 향상에 따라 개발 및 테스트와 관련된 위험이 증가하고 있다는 것입니다. 실제로 2026년 7월에 발생한 Hugging Face 공격에서는 인터넷에 연결할 수 없는 환경에서 테스트를 실행했음에도 불구하고 모델이 스스로 인터넷 공간으로 탈출하는 방법을 구축하여 공격을 수행했습니다. 또한 “AI 에이전트들이 은밀하게 정보 교환의 장을 구축하고, 인터넷 공간으로 탈출하는 방법 포함 다양한 정보를 공유하는” 행동도 확인되었습니다. OpenAI의 테스트 AI가 “AI 간 게시판”을 자의적으로 구축하여 정보 공유하고 Hugging Face에 공격을 수행한 것이 밝혀졌으며, 게시판이 폐쇄되자 은밀하게 다시 짓는 - GIGAZINE

OpenAI는 모델의 성능 향상에 대응할 수 있는 안전 조치를 확립하기 위해 개발 속도를 일시적으로 늦추었습니다. 구체적으로는 개발 중인 최신 모델에 대한 강화 학습을 2주간 중단한 것입니다. 현재 기사 작성 시점에서는 소규모 강화 학습이 재개되었지만, “최대 규모의 최첨단 강화 학습”은 이전으로 보류 상태로 되어 있습니다. OpenAI는 안전 조치 강화의 3가지 축으로 “감시 체계 강화”, “정렬 강화”, “보안 조치 강화”의 3가지 요소를 제시하고 있습니다. 특히 보안 조치에서는 테스트 모델에 의한 공격을 방지하기 위해 워크로드 및 네트워크 분리를 강화하고, 보안 테스트 메커니즘을 재구성한 것입니다. OpenAI는 안전 조치에 AI를 활용하는 노력도 진행하고 있습니다. 샘 알토만 CEO는 “AI의 발전 속도는 안전성에 대한 신뢰에 의해 좌우된다고 생각합니다”라고 언급하며 안전 조치의 중요성을 강조했습니다.

최근 프론티어 RL 훈련을 일시 중단했습니다. 이는 새롭게 등장하는 기능 수준에 대한 적절한 정렬, 보안 및 모니터링 기준을 충족할 수 있도록 하기 위함입니다. 모델 진행 속도는 현재 매우 빠르며, 우리는 항상 모델이…라는 판단이 들 경우 조치를 취할 것이라고 밝혔습니다.

[원문 보기](https://gigazine.net/news/20260819-openai-pacing-model/) | 출처: Gigazine