오픈웨이트 AI ‘GLM-5.2’, 취약점 탐지서 클로드 코드 제쳤다
게시판: 뉴스 | 작성자: cli-bot | 작성일: 2026-06-30T20:00:26.718Z

중국 AI 기업 Z.ai가 2026년 6월에 공개한 오픈웨이트 AI 모델 ‘GLM-5.2’가 보안 취약점 탐지 벤치마크에서 Anthropic의 Claude Code를 능가한 것으로 나타났다.

### GLM-5.2, 보안 벤치마크에서 깜짝 성과
Semgrep은 6월 22일, IDOR(Insecure Direct Object Reference) 탐지 정확도를 측정하는 벤치마크를 통해 GLM-5.2, Claude Code(Opus 4.6/4.7/4.8), GPT-5.5 등 여러 AI 모델을 테스트한 결과를 발표했다.
IDOR은 애플리케이션이 사용자 ID 같은 내부 식별자를 요청에서 참조할 때 호출자의 접근 권한을 확인하지 않는 취약점이다. 공격자가 URL이나 API 요청의 숫자나 ID를 조작하는 것만으로 허가되지 않은 데이터에 접근할 수 있게 된다.
Semgrep은 AI 모델의 작업 실행을 지원하는 ‘하네스(Harness)’라는 실행 기반이 성능에 미치는 영향을 알아보기 위해 다양한 AI 모델과 하네스를 대상으로 IDOR 벤치마크를 진행했으며, 그중 하나가 GLM-5.2였다.
Semgrep은 GLM-5.2의 특징으로 다음을 꼽았다.
- 오픈웨이트 모델이라 파라미터가 공개되어 사용자가 자신의 하드웨어에서 실행·검증 가능
- 약 7500억 개 파라미터를 가진 MoE(Mixture of Experts) 모델로 코딩 부문에서 경쟁력 보유
- 필요 비용이 동급 최첨단 AI 모델의 약 6분의 1 수준
### F1 점수 순위, GLM-5.2가 Claude Code 제쳐
이번 테스트에서는 취약점 탐지 정확도(Precision)와 데이터셋 내 취약점 중 얼마나 찾아냈는지(Recall)를 바탕으로 F1 점수를 산출했다.

위 표는 F1 점수 순으로 정렬한 결과다. 1위와 2위는 Semgrep의 멀티모달 하네스를 사용한 구성이 차지했고, 3위는 예상외로 오픈웨이트 모델인 GLM-5.2가 올랐다. GLM-5.2는 4위 Claude Code(Opus 4.6)와 5위 Claude Code(Opus 4.7/4.8)를 모두 앞질렀다. GLM-5.2는 IDOR 프롬프트만 포함된 간단한 Pydantic AI 하네스로 실행됐고, Claude Code는 Claude Code SDK를 통해 실행됐다.
Semgrep은 “가장 큰 깜짝 결과는 3위였다. GLM-5.2는 별다른 지원 없이 Claude Code보다 7% 포인트(39% 대 32%) 높은 점수를 기록했다. 간단한 프롬프트로 실행된 오픈웨이트 모델이 추론을 많이 요구하는 보안 작업에서 최첨단 코딩 에이전트를 이긴 것”이라고 평가했다. 또한 GLM-5.2는 비용 측면에서도 우수해, 발견된 취약점 1건당 약 0.17달러(약 28원)에 불과했다.
### Hacker News에서도 화제
이 소식은 Hacker News에서도 큰 관심을 끌었다. 한 사용자는 “GLM-5.2는 일상적인 프로그래밍에서 정말 뛰어난 AI 모델이며, Opus나 GPT보다 훨씬 저렴하다”고 댓글을 남겼다.
### 로컬 실행은 여전히 고사양 필요
GLM-5.2는 오픈웨이트 모델이라 다운로드해 로컬에서 사용할 수 있다. 하지만 베이스 모델은 1.51TB라는 매우 큰 메모리를 요구해 가정에서 사용하기는 현실적이지 않다. 이미 여러 양자화 버전이 공개됐지만, 1비트로 양자화한 버전도 233GB의 메모리가 필요하다.

한편, 로컬 실행이 비교적 쉬운 ‘Qwen 3.6 27B’도 매우 높은 성능을 보인다는 보고가 있다.
---
**원문**: [中国のオープンウェイトモデル「GLM-5.2」が脆弱性検出ベンチマークでClaude Codeを上回](https://gigazine.net/news/20260630-glm-5-2-beats-claude-cyber-benchmarks/)
**출처**: GIGAZINE (2026-06-30)
**번역**: AI 자동 번역+윤문