# 클로이드에서 "보안 장치로 차단된 AI 처리"에 대한 과금이 시작됩니다.

> https://bookfactory.kr/board/news/19070
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-09-29T05:40:36.327Z

---

클로이드에는 사이버 공격이나 생물학 무기 등 위험한 카테고리 관련 질문을 식별하는 안전 분류기가 탑재되어 있습니다. 이 안전 분류기로 인해 중단된 처리 대해서는 요금이 부과되지 않았으나, 일부 카테고리에서 요금 부과를 시작할 것이라고 일본 시간 2026년 9월 25일에 발표되었습니다.

오늘부터 안전 장치가 작동하여 클로이드에 응답하기 전에 차단된 요청에 대해서는 요금이 부과됩니다. 이는 낮은 오탐율 카테고리만 적용됩니다: 생물학, 증류 공격, 그리고 프론티어 LLM 개발. 최근 우리 시스템에 대한 연계된 공격이 있었습니다…

Anthropic의 모델 중에는 “Claude Fable 5.1”, “Claude Fable 5”, “Claude Opus 5.5”, “Claude Opus 5”에 사이버 공격 등의 위험 카테고리 관련 질문을 식별하는 안전 분류기가 탑재되어 있으며, 위험으로 판단된 처리는 중단되고 다른 모델로 폴백됩니다. 고성능 모델의 안전 분류기는 2026년 6월에 Claude Fable 5가 등장했을 때에 마련된 것으로, 당시에는 “모델의 안전하고 신속한 출시를 우선시했기 때문에 오탐이 많았다”고 Anthropic도 인정했습니다. 이 때문에 “안전 분류기에 의해 위험으로 판단되어 출력 전에 중단된 처리”에 대해서는 요금이 부과되지 않는 규칙을 설정했습니다. 다음은 Wayback Machine에 저장된 2026년 6월 10일 시점의 안전 분류기 관련 문서 스크린샷입니다.

그러나, Anthropic은 일본 시간 2026년 9월 25일에 일부 카테고리에서 과금(課金)을 시작할 것임을 발표했습니다. 안전 분류기(安全分類器)로 차단되는 내용은 “cyber”(사이버 공격), “bio”(생물 무기), “frontier_llm”(경쟁 AI 모델 개발), “reasoning_extraction”(사고 내용의 재현), “general_harms”(기타 유해한 내용)의 5종류 카테고리로 나누어져 있으며, 이 중 “bio”(바이오), “frontier_llm”(프론티어_LLM), “reasoning_extraction”(리제닝_추출)의 3종류에서는 출력 전에 처리 중단(処理中断)이 발생하더라도 과금(課金)이 발생하게 됩니다. Anthropic은 이번 변경(変更)에 대해 “안전 장치(セーフガード)를 대규모로 회피(回避)하려는 시도(試み)를 방지(防지)하기 위함(위함)”이라고 설명(説明)하고 있습니다. 대상(対象)되는 처리(処理)에는 일반적으로 요청(リクエスト)과 동일(相同)하게 실행(実行)한 모델(モデル)의 요금(料金)이 적용(適用)됩니다. 그 외(その他)의 카테고리(カテゴリ)나 카테고리가 설정(設定)되지 않은 경우에는 출력(出力) 전에 거부(拒否)되면 계속(継続)하여 과금(課金)되지 않습니다. 안전 분류기(安全分類器)와 과금(課金)에 관한 문서(文書)는 다음(以下の) 링크(リンク)에서 확인할(確認) 수 있습니다. 거부(拒否) 및 복귀(フォールバック) - Claude Platform Docs https://platform.claude.com/docs/ja/build-with-claude/refusals-and-fallback#how-refusals-are-billed

Anthropic에 따르면 “bio”, “frontier_llm”, “reasoning_extraction”의 오탐율은 0.1% 미만으로 유지되고 있으며, “Claude Code”, “Claude.ai”, “Cowork”의 사용자의 99.7%는 요금 시작의 영향을 받지 않는다고 합니다.

[원문 보기](https://gigazine.net/news/20260925-claude-safeguard-block-request/) | 출처: Gigazine