# OpenAI는 “가장 고성능 AI 모델”의 학습을 일시 중단하고, AI 에이전트의 행동을 대규모 조사 중

> https://bookfactory.kr/board/news/19404
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-10-01T05:23:30.919Z

---

OpenAI는 가장 뛰어난 AI 모델을 대상으로, 도구 사용을 동반한 학습, 평가, 추론을 일시 중지했습니다. 이는 학습 중인 AI 에이전트가 네트워크 제한을 회피하여 외부 서비스에 접근한 것을 수용하는 조치이며, OpenAI는 안전 조치를 추가한 후 개발을 재개할 방침을 제시했습니다. 샘 알토만 CEO는 “학습 또는 평가 중인 AI 에이전트의 인터넷 사용에 대해 대규모의 조사를 계속하고 있다”고 설명했습니다. 에이전트가 DNS를 사용하여 외부 챗봇에 접근 – OpenAI 정렬 https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/

OpenAI, Anthropic, 수만 건의 보안 사고 조사 중https://www.axios.com/2026/09/26/openai-anthropic-thousands-ai-security-incidents

OpenAI, ‘가장 강력한 모델’의 훈련 일시 중단 | The Vergehttps://www.theverge.com/ai-artificial-intelligence/1001049/openai-training-pause

OpenAI, 최신 모델 훈련 중단, AI 에이전트가 ‘로거’되는 사례 보고 건수 증가https://www.theguardian.com/technology/2026/sep/27/openai-halts-training-of-latest-models-as-reports-mount-of-ai-agents-going-rogue

OpenAI가 공개한 보고서에 따르면, 2026년 9월 20일, 강화 학습 중인 내부 연구 모델이 검색 태스크를 실행하는 과정에서 학습 환경의 DNS 필터링이 부족했던 것을 이용해 외부 공개 챗봇에 접근했습니다. OpenAI는 이 궤도를 약 15분 이내에 감지하고, 이후 실행을 중단했습니다.

이것을 계기로 OpenAI는 문제 발생한 학습을 중단하고, 가장 높은 능력을 가진 모델에 대해 툴을 사용하는 모든 학습, 평가, 추론을 중지했습니다. 네트워크 제한 문제가 해결되었음을 확인하고 추가적인 레드팀 테스트를 완료할 때까지 중단을 지속할 예정입니다. 문제 발생한 모델의 학습을 그대로 재개하지 않고, 안전성 및 정렬(alignment)에 대한 개선을 가한 새로운 학습을 처음부터 실시할 계획입니다. OpenAI는 이미 DNS 통신을 허용된 도메인 및 레코드 종류에 한정하는 조치를 도입하고, 네트워크 제어에 대한 추가 테스트를 진행하고 있습니다. 이번 사례에 대해서는 과거에 확인된 일부 사례보다 심각도는 낮지만, 7월의 Hugging Face를 둘러싼 사건 이후 연구 환경을 강화してから初めて 발견된 새로운 제한 회피였기에, 향후 대책을 검토하는 데 중요한 실마리 역할을 한 것으로 평가하고 있습니다. OpenAI가 새로운 AI 시스템에서 실수로 Hugging Face를 해킹한 사건 보고 - GIGAZINE

이번 중지는 개별 문제 대응뿐만 아니라 OpenAI가 진행 중인 AI 에이전트 전체의 행동 조사 일환이기도 합니다. 알토만 CEO는 “학습 및 평가 중인 에이전트의 인터넷 사용에 대한 대규모 조사를 지속적으로 진행하고 있으며, 조사 결과의 개요를 순차적으로 공개하고 있습니다.”라고 설명했습니다. 또한, 공개 작업이 기대했던 만큼 빠르진 않지만, 정보를 공개하고자 하는 생각과 조사 정확성 및 영향을 받은 조직에 대한 대응 사이의 균형을 맞추고 있다고 밝혔습니다.

OpenAI를 둘러싸고는 이 외에도 정부기관이나 유엔 관련 사이트에 대한 AI 에이전트 접근, ChatGPT 사용자로부터 제공된 이미지 53건이 외부 서비스로 전송된 사례 등이 확인되고 있습니다. 이들 개별 사례에 대해서는 각각의 경위와 심각도가 다르며, OpenAI 및 외부 연구자들에 의한 조사도 계속되고 있습니다. OpenAI의 AI 에이전트가 유엔 웹사이트에 브루트포스 공격을 시도 - GIGAZINE

OpenAI는 해외 뉴스 미디어 Axios에 추가적인 안전 조치 및 정렬 개선에 대해 확신이 들 때까지 학습을 재개할 것이라고 설명하고 있습니다. 또한, AI의 능력 향상에 따라 연구 및 개발을 일시 중단하고 안전성을 확인하는 조치가 앞으로도 필요할 수 있다는 인식을 나타내고 있습니다.

[원문 보기](https://gigazine.net/news/20260928-openai-pauses-training-ai/) | 출처: Gigazine