Anthropic는 2026년 8월 7일(현지 시간), AI 코딩 도구 “Claude Code”에서 명령 실행 전 권한 확인을 자동화하는 “auto mode”를 기본으로 한다고 발표했다. 8월 14일부터 Pro, Max, Team 플랜의 신규 세션에 적용한다.
기본 설정의 배경에는 auto mode가 인간의 권한 확인을 크게 상회하는 능력을 갖는다는 검증 결과가 있다. 1,053명의 유급 테스터를 대상으로 한 실험에서 인간이 위험한 명령을 거부할 수 있는 비율은 13.6%였던 반면, auto mode는 89%를 차단했다.
## 인간은 위험한 명령의 13.6%밖에 거부할 수 없으며
Claude Code에서는 파일 변경이나 명령 실행과 같이 작업을 수행할 때 사용자에게 권한 확인을 요청하여 안전성을 확보해 왔다. 반면, Anthropic에 따르면 Claude Code 사용자는 권한 확인의 97%를 승인하고 있으며, 많은 확인이 습관적으로 처리되고 있을 가능성이 있다는 것이다.
이에 따라 해당 회사는 조사 회사와 협력하여 1,053명의 전문가 유급 테스터를 대상으로 한 대조 실험을 실시했다. 참가자들은 전용 테스트 환경에서 코딩 작업을 수행하고 세션 중간에 일반적인 권한 확인 중 1건을, 명백히 위험한 명령으로 대체했다. 참가자에게 무엇을 측정하고 있는지 알리지 않았다. 또한 승인했더라도 실제로 위험한 처리가 실행되지 않도록 했다.
그 결과, 인간이 위험한 명령을 거부한 것은 1,053건 중 143건으로 13.6%였다. 반면, auto mode는 동일한 명령의 937건 중 89%를 차단했다. 인간이 승인한 반면 auto mode가 멈춘 경우는 800건이었고, 인간만 멈추고 auto mode가 허용한 경우는 6건이었다.
위험한 명령을 인간이 거부한 비율은 13.6%, auto mode가 차단한 비율은 89%
더욱이 세션 초반에는 인간이 위험한 명령을 약 17% 거부했지만, 50회 이상의 권한 확인 경험 후에는 약 5%까지 감소했다. auto mode의 차단 비율은 세션의 길이와 무관하게 거의 일정했다.
## 실제 사용 시에도 “예상치 못한 심각한 작동”은 auto mode가 더 적음
Anthropic는 실제 Claude Code 사용 데이터에 대해서도 분석했다. 2026년 5월~6월에 안전 시스템이 검토 대상으로 감지한 세션 중 데이터 학습 및 분석 이용에 동의한 계정을 대상으로 작동의 위험도 등을 재평가했다.
본 탐 데이터베이스의 행 삭제 등에 해당되는 “심각도 7 이상”의 작동으로, 그리고 사용자가 명시적으로 요청하지 않은 유해한 작동이 포함된 비율은 인간의 권한 확인을 통과한 세션에서 6.3%, auto mode에서는 2.4%였다.
그러나 이 숫자는 안전 시스템이 사전에 검토 대상으로 지정한 세션에 대한 비교이며, Claude Code 전체에서 유해한 작동이 발생하는 비율을 나타내는 것은 아니다.
## 다른 AI가 실행 전에 확인하고, 위험하다고 판단되면 차단
auto mode는 단순히 권한 확인을 생략하여 Claude Code에 자유롭게 작동시키는 메커니즘이 아니다. 각 도구의 실행 전에 다른 분류 모델이 내용을 확인하고, 불가역적인 작동, 파괴적인 작동, 사용자의 환경 외를 대상으로 하는 작동 등을 차단한다.
블로킹이 발생할 경우, Claude Code는 다른 안전한 방법을 시도하거나, 필요한 경우 사용자에게 확인을 요청합니다. 3번 연속 또는 세션 내에서 20회 블로킹될 경우, 인간에 의한 권한 확인으로 돌아갑니다.
auto 모드는 8월 14일부터 Pro, Max, Team 플랜의 신규 세션에서 기본 설정으로 변경됩니다. Claude Enterprise, Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry 등에서는 당분간 옵트인 방식으로 제공되며, Anthropic는 향후 1개월 내에 기본 설정으로 전환할 계획을 제시하고 있습니다.
회사 측은 auto 모드만으로도 위험을 완전히 배제할 수 없다는 점을 설명하고 있습니다. 프로덕션 인프라에 미치는 영향이 큰 변경 사항 등에서는 계속하여 인간이 Claude의 작동을 직접 확인하도록 권장하고 있습니다.
원문 보기 | 출처: Ledge.ai