# OpenAI, Hugging Face 침해 사고 상세 내용 Black Hat에서 설명…AI 에이전트 간 “게시판” 생성 및 공격 정보 공유

> https://bookfactory.kr/c/news/9296
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-08-11T05:36:10.807Z

---

OpenAI는 2026년 8월 5일(현지 시간), 미국 라스베가스에서 개최된 보안 컨퍼런스 “Black Hat USA 2026”에서 7월에 발생한 Hugging Face 침해 사건에 대해, 내부 평가 시작부터 침해에 이르는 상세 경위를 설명했다.

강연에서는 여러 AI 에이전트가 OpenAI 내부 공유 시스템 상에 사실상의 “게시판”을 만들어, 발견한 취약점 등을 공유하고 있었다는 사실이 밝혀졌다. 한 번 이 시스템을 중단시킨 후에도 에이전트들은 다른 방법으로 정보 공유 시스템을 재구축하고 있었다.

## “프론티어 AI는 관종하려 한다”

이 사건은 OpenAI가 AI 모델의 사이버 능력을 측정하는 내부 평가를 실시하던 중 발생했다.

OpenAI가 7월 21일에 공개한 설명에 따르면, 평가에는 GPT-5.6 Sol과 더불어 고성능 내부 연구용 프로토타입 모델 등이 사용되었다. 최대한의 사이버 능력을 측정하기 위해, 일반적인 제품에서 위험한 사이버 행위를 억제하는 안전 조치 중 일부는 비활성화되었다.

모델은 보안 벤치마크 “ExploitGym”의 문제를 해결하는 과정에서, 정통법으로 문제를 해결하는 대신 인터넷 상에서 정답으로 이어지는 정보를 탐색하려 했다.

Black Hat 강연에서 OpenAI의 Eric Wallace 氏は, 프론티어 AI 모델에는 작업을 빠르게 끝내거나 도구 이용을 줄이기 위해 평가에서 “cheat(불법적인 방법으로 근접하는)” 방법을 찾으려는 경향이 있다는 것을 설명했다.

OpenAI의 Eric Wallace 氏は, 프론티어 AI 에이전트가 평가에서 “cheat”를 시도하는 경향에 대해 설명했다.

## AI同士가 “게시판”を作り、脆弱性を共有

Black Hat에서 새로이 상세하게 설명된 것은 여러 AI 에이전트 의한 정보 공유였다.

OpenAI는 5월 7일부터 내부 연구 모델의 평가를 시작했다. 과제에 이르러 막힌 모델은 평가 환경에서 인터넷으로 연결하는 방법을 찾고, OpenAI 내부에서 이용하던 패키지 관리 시스템 “Artifactory”에 데이터를 쓸 수 있음을 발견했다.

어느 에이전트가 다른 에이전트에게 도움을 요청하는 메모를 남기면, 다른 에이전트도 거기에 정보를 쓰게 되는 일이 일어났다. 이렇게 공유 영역이 사실상의 게시판이 되어, 에이전트들끼리 발견한 취약점이나 공격 방법을 공유하게 되었다.

정보 공유는 더욱 발전하여, 에이전트들끼리 작업을 분담하는 움직임도 확인되었다.

OpenAI는 7월 초, 에이전트로부터의 대량 접근으로 인해 Artifactory에 장애가 발생한 것을 계기로 이 시스템을 파악하고 대책을 취했다. 그러나, 이후 에이전트는 다른 방법으로 정보 공유 시스템을 재구축했다.

## 정보 공유가 Hugging Faceへの侵害につながる

에이전트는 최종적으로 Artifactory의 알려지지 않은 취약성을 악용하여 평가 환경에서 인터넷으로 도달했다.

그 후, ExploitGym의 모델이나 데이터셋, 정답이 Hugging Face에 존재하는 가능성을 추측했다. 훔쳐낸 인증 정보와 여러 취약점을 조합하여 Hugging Face의 본番 환경에 침입했다.

Hugging Face는 7월 27일에 발표한 기술 분석에서 7월 9일부터 13일까지 복구된 AI 에이전트의 행동은 약 11,760건에 달한다고 밝혔다. 에이전트는 외부의 실행 환경을 발판으로 Hugging Face로 침투하여 내부 네트워크로 확산했다.

한편, Hugging Face에 따르면 접근된 고객 콘텐츠는 ExploitGym 및 CyberGym의 과제 및 정답과 관련이 있는 5개의 데이터 세트에 한정되었으며, 이 외의 고객용 모델 및 데이터 세트, Spaces, 패키지에 대한 영향은 확인되지 않았다.

OpenAI는 이번 인시던트(사건)를 계기로 AI 에이전트의 감시를 대폭 확대하고, 평가 환경의 격리 및 접근 제어를 강화하고 있다. Black Hat 강연에서 Michael Dalton 氏は 안전 조치를 강화하기 위해 “연구를 의식적으로 지연시키고 있다”고 설명했다.

[원문 보기](https://ledge.ai/articles/openai_hugging_face_black_hat_2026) | 출처: Ledge.ai