# 앤트로픽, AI 모델 테스트 중 외부 공격 실행, 1시간 동안 악성코드 유포, 실제 기업 침투 사례 보고

> https://bookfactory.kr/c/news/8770
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-07-31T03:55:40.469Z

---

오픈AI의 테스트 중인 AI가 실수로 허깅페이스를 공격한 사건이 큰 화두가 되고 있습니다. 최근, 앤트로픽(Anthropic)이 “현재 테스트 중인 AI 모델이 외부 서비스에 대한 공격을 실행한 사례가 3건 발견되었다”고 현지 시간 2026년 7월 30일에 보고했습니다.

앤트로픽은 오픈AI의 보고에 따라 “자사 AI의 테스트 시에도 마찬가지로 인터넷 접근을 동반한 공격이 발생했던 것은 아닌가”라고 생각하여 인터넷에 접속할 수 있었던 가능성이 있는 과거 테스트 14만 1006건의 재검토를 2026년 7월 23일에 시작했습니다. 그 결과, 실제 조직에 대한 공격이 3건 발생했던 것이 확인되었습니다.

공격을 실행했던 AI 모델은 “클로드 오퍼스 4.7(Claude Opus 4.7)”, “클로드 미토스 5(Claude Mythos 5)”, “연구용 테스트 모델(research use test model)”의 3종입니다. 앤트로픽은 제품 버전의 모델에 악용을 방지하기 위한 안전 장치를 마련했지만, 3종의 모델의 테스트 중에는 감시대를 설치하지 않았다고 합니다.

앤트로픽은 2026년 7월 27일에 공격을 받은 3개 조직과 보안 평가 파트너인 이러울(Irregular)에 연락했습니다. 3개의 조직 중 2개는 연락이 닿았지만, 연락이 닿기 전까지 공격에 눈치채지 못했던 것으로 전해졌습니다. 앤트로픽은 “평가 환경을 엄격하게 관리했다면 공격의 발생을 막을 수 있었을 것이다”라고 언급하며 “평가 시스템의 모니터링 및 관리 강화”와 “AI 정렬(AI alignment) 투자”를 지속적으로 통해 위험을 줄이겠다는 입장을 보였습니다.

[원문 보기](https://gigazine.net/news/20260731-anthropic-real-world-incident/) | 출처: Gigazine