# 오픈웨이트 AI ‘GLM-5.2’, 취약점 탐지서 클로드 코드 제쳤다

> https://bookfactory.kr/c/news/8016
> 게시판: 뉴스
> 작성자: cli-bot
> 작성일: 2026-06-30T20:00:26.718Z

---

![](https://i.gzn.jp/img/2026/06/30/glm-5-2-beats-claude-cyber-benchmarks/00.jpg)

중국 AI 기업 Z.ai가 2026년 6월에 공개한 오픈웨이트 AI 모델 ‘GLM-5.2’가 보안 취약점 탐지 벤치마크에서 Anthropic의 Claude Code를 능가한 것으로 나타났다.

![](https://i.gzn.jp/img/2026/06/30/glm-5-2-beats-claude-cyber-benchmarks/00_m.jpg)

### GLM-5.2, 보안 벤치마크에서 깜짝 성과

Semgrep은 6월 22일, IDOR(Insecure Direct Object Reference) 탐지 정확도를 측정하는 벤치마크를 통해 GLM-5.2, Claude Code(Opus 4.6/4.7/4.8), GPT-5.5 등 여러 AI 모델을 테스트한 결과를 발표했다.

IDOR은 애플리케이션이 사용자 ID 같은 내부 식별자를 요청에서 참조할 때 호출자의 접근 권한을 확인하지 않는 취약점이다. 공격자가 URL이나 API 요청의 숫자나 ID를 조작하는 것만으로 허가되지 않은 데이터에 접근할 수 있게 된다.

Semgrep은 AI 모델의 작업 실행을 지원하는 ‘하네스(Harness)’라는 실행 기반이 성능에 미치는 영향을 알아보기 위해 다양한 AI 모델과 하네스를 대상으로 IDOR 벤치마크를 진행했으며, 그중 하나가 GLM-5.2였다.

Semgrep은 GLM-5.2의 특징으로 다음을 꼽았다.

- 오픈웨이트 모델이라 파라미터가 공개되어 사용자가 자신의 하드웨어에서 실행·검증 가능

- 약 7500억 개 파라미터를 가진 MoE(Mixture of Experts) 모델로 코딩 부문에서 경쟁력 보유

- 필요 비용이 동급 최첨단 AI 모델의 약 6분의 1 수준

### F1 점수 순위, GLM-5.2가 Claude Code 제쳐

이번 테스트에서는 취약점 탐지 정확도(Precision)와 데이터셋 내 취약점 중 얼마나 찾아냈는지(Recall)를 바탕으로 F1 점수를 산출했다.

![](https://i.gzn.jp/img/2026/06/30/glm-5-2-beats-claude-cyber-benchmarks/01_m.png)

위 표는 F1 점수 순으로 정렬한 결과다. 1위와 2위는 Semgrep의 멀티모달 하네스를 사용한 구성이 차지했고, 3위는 예상외로 오픈웨이트 모델인 GLM-5.2가 올랐다. GLM-5.2는 4위 Claude Code(Opus 4.6)와 5위 Claude Code(Opus 4.7/4.8)를 모두 앞질렀다. GLM-5.2는 IDOR 프롬프트만 포함된 간단한 Pydantic AI 하네스로 실행됐고, Claude Code는 Claude Code SDK를 통해 실행됐다.

Semgrep은 “가장 큰 깜짝 결과는 3위였다. GLM-5.2는 별다른 지원 없이 Claude Code보다 7% 포인트(39% 대 32%) 높은 점수를 기록했다. 간단한 프롬프트로 실행된 오픈웨이트 모델이 추론을 많이 요구하는 보안 작업에서 최첨단 코딩 에이전트를 이긴 것”이라고 평가했다. 또한 GLM-5.2는 비용 측면에서도 우수해, 발견된 취약점 1건당 약 0.17달러(약 28원)에 불과했다.

### Hacker News에서도 화제

이 소식은 Hacker News에서도 큰 관심을 끌었다. 한 사용자는 “GLM-5.2는 일상적인 프로그래밍에서 정말 뛰어난 AI 모델이며, Opus나 GPT보다 훨씬 저렴하다”고 댓글을 남겼다.

### 로컬 실행은 여전히 고사양 필요

GLM-5.2는 오픈웨이트 모델이라 다운로드해 로컬에서 사용할 수 있다. 하지만 베이스 모델은 1.51TB라는 매우 큰 메모리를 요구해 가정에서 사용하기는 현실적이지 않다. 이미 여러 양자화 버전이 공개됐지만, 1비트로 양자화한 버전도 233GB의 메모리가 필요하다.

![](https://i.gzn.jp/img/2026/06/23/glm-local-unsloth/00_m.png)

한편, 로컬 실행이 비교적 쉬운 ‘Qwen 3.6 27B’도 매우 높은 성능을 보인다는 보고가 있다.

---
**원문**: [中国のオープンウェイトモデル「GLM-5.2」が脆弱性検出ベンチマークでClaude Codeを上回](https://gigazine.net/news/20260630-glm-5-2-beats-claude-cyber-benchmarks/)
**출처**: GIGAZINE (2026-06-30)
**번역**: AI 자동 번역+윤문