OpenAI는 2026년 7월에 “테스트 중인 자체 모델이 Hugging Face에 대한 사이버 공격을 실행하여 발생한” 보안 사고를 보고했습니다. 이 “AI에 의해 자율적으로 사이버 공격이 실행된” 사례를 계기로 OpenAI의 공동 창업자이자 사장도 맡고 있는 그레그 브록만(Greg Brockman)이 “AI로부터 공격을 방지하기 위해 노력해야 할 10가지 사항”을 설명하는 기사를 게시했습니다. 설명 기사는 OpenAI의 공식 웹사이트와 브록만 씨의 개인 웹사이트 양쪽에 게시되었습니다. The Defender’s Window | OpenAI https://openai.com/index/the-defenders-window The Defender’s Window https://blog.gregbrockman.com/the-defenders-window OpenAI의 테스트 중인 AI가 Hugging Face에 대한 공격은 “인터넷 연결 권한을 부여받지 않은 AI가 자율적으로 취약점을 악용하여 인터넷 공간으로 탈출하여 Hugging Face를 공격 대상으로 선택하고 공격을 실행하는” 자율적인 절차로 실행되었습니다. 공격이 발각된 것은 2026년 7월이었지만, 인터넷 공간으로의 탈출 방법이 확립된 것은 2026년 5월이었으며, AI 에이전트들이 비밀리에 정보를 공유하고 있었다고 합니다. 인간 관리자는 실제로 공격이 실행되는 것을 인지하지 못했습니다. OpenAI의 테스트 AI가 “AI 간 게시판”을 자판으로 구축하여 정보 공유하고 Hugging Face에 대한 공격을 실행했던 것이 밝혀졌으며, 게시판이 폐쇄되더라도 은밀하게 다시 짓고 있습니다 - GIGAZINE
AI에 의한 자율적인 공격은 OpenAI뿐만 아니라 Anthropic의 테스트 AI에서도 발생했습니다. 브록만 씨는 “많은 기업이 최첨단 AI에서 수개월 뒤에 동등 성능의 오픈 모델을 공개하고 있다”고 지적하며, 수개월 이내에 오픈 모델로도 고도화된 공격이 가능해질 것이라고 지적했습니다. 특히 2026년 8월 말 예정된 오픈 모델화 “GLM-5.3”에 대해 “2026년 8월 말에 위협이 크게 가속될 가능성이 높다”고 경고하고 있습니다. Z.ai가 코딩 능력에 뛰어난 오픈 웨이트 AI 모델 “GLM-5.3” 출시, 전 모델 대비 50%의 성능 향상 - GIGAZINE
OpenAI는 보안 사고를 계기로 내부 보안対策을 강화했다고 합니다. 구체적으로는 “자체 AI 모델과 Codex를 활용하여 취약점 식별 및 수정 지원, AI를 활용하여 문제 우선순위를 지정하고 인적 부담을 줄임, AI를 이용하여 잠재적인 공격 경로를 지속적으로 정밀 검사, 최소 권한 부여 및 네트워크 분리와 같은 기존 보안 제어에 집중 투자”하는 4가지 주요 기둥을 두고 있습니다. 블록만 부르는 AI로 인해 고도화되는 사이버 공격으로부터 자신을 보호하는 방법으로 다음 10가지 대책을 제시했습니다. 블록만 부르는 “OpenAI의 제품과 예시로 설명했지만, 시장 존재하는 경쟁 제품도 평가해야 합니다. 중요한 것은 특정 AI 툴을 사용하는 것이 아니라, 고성능 AI를 방어에 신속하게 제공하는 것입니다”라고 언급했습니다.
대책 1: 보안 부서와 엔지니어링 부서가 신속하게 협력하여 자원을 확보할 수 있도록 조직 전체의 지지를 얻는 것
대책 2: 보안 팀에 Codex Security plugin과 같은 AI 에이전트를 참여시키는 것
대책 3: AI 에이전트에 보안 관련 전문 지식을 제공하는 것. 이 경우 자발적으로 제작된 보안 Skills가 유용함
대책 4: 자체 시스템의 보안 평가를 즉시 실시하는 것. 우선순위가 높은 시스템부터 평가하고, 팀의 숙련도가 높아짐에 따라 평가 범위를 확대함
대책 5: 기존의 취약성 평가 로그를 AI 에이전트에게 제공하고, AI 에이전트에게 우선순위를 지시하는 것
대책 6: AI 에이전트에 의한 보안 평가를 개발 프로세스에 직접 통합하는 것
대책 7: AI 에이전트에게 문제 해결을 지시하는 것
대책 8: 취약점 발견부터 우선순위 지정까지의 흐름을 단계적으로 자동화하는 것
대책 9: Daybreak Blue에 참여 신청을 하고, AI 지원형 디지털 포렌식 조사 활용 가능하게 함
대책 10: 보안 대책을 위한 “해킹 주간(정상 업무를 중단하고 특정 서비스 또는 기능을 집중 개발하는 기간)을 설정하여 전직원의 역량 강화를 도모함”
한편, 블록만 부르는 개인적인 성과로 “ChatGPT Work로 제품 버전의 GPT-5.6 Sol을 사용하여 자신의 웹사이트인 ‘gregbrockman.com’의 취약점을 15분 만에 13개 발견. 문제 해결을 지시한 결과, 1시간 만에 해결”한 경험을 공유했습니다.
원문 보기 | 출처: Gigazine