OpenAI에서는 AI 에이전트가 사내 테스트 중에 실수로 Hugging Face를 해킹한 사례 등 여러 건의 사고가 발생했습니다. OpenAI의 AI 모델이 폭주를 시작할 수 있는 몇 달 전에 직원들이 경영진에게 경고를 보냈음에도 불구하고, 경영진은 그 경고를 무시했던 것이 사내 이메일에서 드러났습니다. OpenAI는 2026년 7월 AI 모델의 사내 테스트 중에 실수로 Hugging Face를 해킹한 사례를 비롯하여, 호주 정부 기관의 시스템을 해킹하거나, 유엔 웹사이트에 브루트포스 공격(총알 공격)을 시도하거나, 미국 교육부, 상무부, 증권거래위원회 사이트에 침투하는 등 여러 건의 사고가 반복적으로 보고되었습니다. OpenAI에서 보안을 담당하는 인물은 이러한 문제에 대해 “AI의 급속한 발전으로 인해 보안 체계가 뒤쳐져 있으며, 사이버 보안과 AI 안전성 간의 격차를 해소해야 한다”고 설명했습니다. OpenAI 안에서 무슨 일이 일어나고 있는지 보안 담당자가 설명하고, AI 연구실에는 “합리적인 의심에 기반한 문화”가 필요 – GIGAZINE
뉴욕 타임스에 따르면, 2명의 직원이 OpenAI 경영진에게 “AI 모델의 안전성을 확보하기 위한 테스트 중에 적절하게 감시되지 않았다”는 우려를 담은 이메일을 보낸 것으로 확인되었습니다. 또한, OpenAI가 일상적인 안전 관리에 사용하고 있는 소프트웨어의 취약점(결함)에 대해서도 질문했습니다. 그러나 이에 대해 경영진들은 “AI 모델을 예정대로 출시하기 위해서는 테스트를 가능한 한 빨리 진행해야 한다”고 밝혔습니다. 익명의 직원들에 따르면, 추가적인 보안 조치는 취해지지 않았다고 합니다. 게다가, 안전 관리 소프트웨어에 대한 질문은 대부분 무시되거나 대응이 매우 지연되었다고 직원들은 밝혔습니다. 익명의 OpenAI 직원과 독립적인 보안 연구자들은 “OpenAI의 직원과 경영진 간의 소통은 OpenAI가 보안을 우선시하지 않았다는 패턴의 일부였다”고 지적했습니다. 실제로, AI 모델의 테스트뿐만 아니라 ChatGPT 개발 카테고리 등에서도 유사한 경향이 나타났으며, 독립적인 보안 연구자들은 OpenAI 직원의 내부 통신을 열람할 수 있는 버그를 발견했지만, OpenAI에 이러한 발견에 대해 알렸을 때 처음에는 무시되었다고 밝혔습니다.
OpenAI 직원들에 따르면, 보안과 관련된 일일 의사 결정의 대부분은 회장인 그레그 블록만 씨와 최고 정보 보안 책임자인 데인 스태키 씨가 진행하고 있다고 합니다. 샘 알토만 CEO는 보안에는 그다지 관여하지 않는다고 합니다. OpenAI의 전 직원이며, OpenAI의 보안에 비판적인 입장을 취하면서 AI Futures Project라는 연구 비영리 단체를 이끄는 다니엘 코코타이로 씨는 “어느 면에서는 이것은 OpenAI 특유의 문제라고 할 수 있을 것입니다. 보안 조치가 매우 불충분했고, 모델의 훈련 방법 또한 부실했기 때문에 이러한 경향을 보이는 모델이 만들어진 것으로 보입니다”라고 밝혔습니다. 그러나 “다른 AI 기업들도 그다지 뛰어나지 않습니다”라고 덧붙였습니다.
원문 보기 | 출처: Gigazine