# Anthropic이 Accenture를 사내로 맞아들여 AI 감시에 나선다 — 5년간 약 3,100억 엔, 이례적인 안전성 평가를 학생 눈높이에 맞춰 해설

> https://bookfactory.kr/board/ai-tech/18040
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-21T16:08:40.330Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/315918033/rectangle_large_type_2_fb2a2a4034d1e14a35b5db5e6ec5ff11.png?width=1280)

AI 기업이 자신들이 만든 AI를 스스로 안전하다고 평가한다.

냉정하게 생각해 보면, 약간 이상한 구조입니다.

자동차 제조사가,

우리가 직접 만들었습니다. 우리가 직접 안전 확인을 했습니다. 괜찮습니다.

라고 말하는 것과 같기 때문입니다.

이에 2026년 9월 18일, Claude를 개발한 Anthropic이 상당히 과감한 시도를 발표했습니다.

세계적인 컨설팅 기업 Accenture와 손잡고, 외부 평가자를 Anthropic 내부에 참여시켜 개발 도중부터 AI의 안전성을 점검받도록 한다는 것입니다.

이름은,

임베디드 평가

일본어로 하면,

내장형 평가

와 같은 사고방식입니다.

게다가 양사는 이 분야의 역량 구축에 향후 5년간 각각 최소 10억 달러를 투자할 예정이다.

합계 최소 20억 달러입니다.

2026년 9월 21일 시점의 환율로 환산하면 약 3,140억 엔이다.

솔직히, 처음 숫자를 봤을 때,

안전 체크만으로 그렇게 많이 써?

라고 생각했습니다.

다만 조사해 보니, 단순히 'Claude 테스트를 외주로 맡깁니다'라는 이야기가 아니었습니다.

## 30초 만에 결론

핵심 내용
발표일: 2026년 9월 18일
기업: Anthropic × Accenture
실무 주도: Accenture 산하 AI 전문 기업 Faculty
방식: Embedded Evaluation
하는 일: 모델 평가, 레드티밍, 얼라인먼트 평가, 안전장치 테스트
접근 권한: Anthropic 직원과 동등한 수준의 내부 접근
투자: 각 사 최소 10억 달러 / 5년간, 합계 최소 20억 달러 (9월 21일 기준 약 3,140억 엔)
특징: 완성 후가 아니라 훈련·개발 도중부터 평가
주의점: Anthropic 자체가 Accenture 측 작업 비용을 부담

Anthropic은 이번 조치에 대해 외부 평가자가 모델의 훈련 과정을 살펴보고, 모델이 어떻게 구축·배포되는지에 관한 의사결정을 추적하며, 직원과 직접 대화할 수 있도록 하겠다고 설명했습니다.

![画像](https://assets.st-note.com/img/1789969189-6PqKUImu8XTBkCJrGhlDsV3y.png?width=1200)

## 애초에, 왜 외부인을 안으로 들이는 거야?

지금까지 AI 모델의 안전성 평가에는 크게 2가지 방법이 있습니다.

하나는,

AI 기업이 자체적으로 테스트한다.

또 하나는,

완성된 모델을 외부 조직에 넘겨 평가받는다.

입니다.

하지만 후자에도 약점이 있습니다.

외부 평가자가 볼 수 있는 것은,

완성된 AI와 기업으로부터 제공된 정보

가 중심이기 때문입니다.

어떤 데이터로 훈련했는가

도중에 어떤 위험한 거동이 나타났는가

안전 대책을 도입할 때, 사내에서 어떤 판단을 내렸는가

까지 전부 보인다고는 할 수 없습니다.

Anthropic이 이번에 하려는 것은,

평가자를 더 안쪽으로 들이기

라는 방법입니다.

## “완성품 검사”에서 “제조 현장 확인”으로

학생들에게 비유하자면,

기존의 외부 평가는,

완성된 차를 가져와서 충돌 테스트를 받는다

이미지입니다.

이번 Embedded Evaluation은,

공장 안에 제3자를 들여보내 차가 만들어지는 중간부터 지켜보게 하다

이미지에 가깝습니다.

Anthropic에 따르면, 평가팀은,

- 모델이 훈련되는 모습을 보기
- 모델을 어떻게 만들지에 대한 판단 과정을 따라간다
- 어떻게 공개·전개할 것인지에 대한 판단을 따라간다
- 직원에게 직접 질문하기
- 안전상의 놓친 부분을 찾다
- 인시던트를 보고하다

이러한 활동을 염두에 두고 있습니다.

기업 내부에 이 정도까지 개입하는 것은 상당히 과감한 방식입니다.

다만,

Accenture측이 Anthropic의 의사결정권을 갖는다

그런 이야기가 아닙니다.

어디까지나,

내부 사정까지 볼 수 있는 평가자

입니다.

이 차이는 중요합니다.

## 실제로 평가하는 것은 '교수진'이다

이번에 헤드라인에서 자주,

앤트로픽 × 액센추어

라고 쓰여 있습니다.

물론 그 말은 맞지만, 실무를 담당하는 회사까지 보면 조금 더 흥미롭습니다.

평가팀을 주도하는 것은,

교수진

라는 AI 전문 기업입니다.

Faculty는 영국 AI 기업으로,

AI 전략 AI 안전성 AI 시스템 개발 모델 평가

등을 맡아 왔습니다.

Accenture는 2026년 1월에 Faculty의 인수를 발표하고, 3월 16일에 인수를 완료했습니다. 400명 이상의 AI 전문 인력이 Accenture에 합류했습니다.

게다가 Faculty는 이전부터,

OpenAI, Anthropic, 영국 AI 보안 연구소

등 AI 모델의 안전성 평가에 참여한 실적이 있습니다.

그래서,

평범한 컨설팅 회사 직원이 갑자기 Claude를 테스트하다

그런 이야기가 아닙니다.

AI 안전성을 다뤄온 전문 팀이 중심입니다.

![画像](https://assets.st-note.com/img/1789969205-dcPUZko9OShQJNWzXRHpDmjE.png?width=1200)

## 실제로 무엇을 확인해야 할까?

공식 발표에서는 크게 4가지가 있습니다.

### 1. 모델 평가

Claude와 같은 프런티어 AI가,

무엇을 할 수 있는가

조사합니다.

능력이 높아지면 높아질수록 편리해지는 한편, 위험한 용도로 사용될 가능성도 있습니다.

### 2. 레드티밍

굳이,

이 AI를 어떻게 하면 위험하게 사용할 수 있을까?

라는 공격자의 관점에서 테스트합니다.

보안 업계에서도 사용되는 사고방식입니다.

### 3. 정렬 평가

AI가,

인간이 원하는 방향으로 행동하고 있는가

조사합니다.

간단히 말하자면,

지시를 따르는 것처럼 보이면서, 뒤에서는 다른 행동을 하고 있지 않은가

등을 확인하는 분야입니다.

### 4. 안전장치 테스트

Claude에는 위험한 요청을 거부하는 기능 등이 있습니다.

그러한 안전 대책이,

정말로 작동할까

평가합니다.

![画像](https://assets.st-note.com/img/1789969217-Tc91BkS6dZEjX5JmwVrFGvyK.png?width=1200)

## “사원 수준의 접근”은 어디까지?

이 부분도 원래 원고에서는 조금 지나치게 강하게 썼었습니다.

Anthropic의 공식 표현은,

직원과 동등한 접근 권한

입니다.

즉,

직원과 견줄 수 있을 정도의 깊은 접근

라는 의미입니다.

Anthropic 직원과 완전히 동일한 시스템 권한을 모두 부여한다

라고까지는 쓰여 있지 않습니다.

또한,

회사의 의사결정에 참여하다

도 발표되지 않았습니다.

정확히는,

의사결정이 어떻게 이루어지고 있는지를 추적하고 검증할 수 있다

라는 입장입니다.

이 부분은 기사에서 과장하지 않는 편이 좋다고 생각합니다.

## 투자액은 “20억 달러 이상”

이번에는 꽤 눈에 띄는 숫자입니다.

Anthropic과 Accenture는,

각각 최소 10억 달러

를,

향후 5년간

이 분야의 역량 구축에 투자하기로 하고 있습니다.

합계는,

최소 20억 달러.

9월 21일 기준 환율로 약 3,140억 엔입니다.

그래서 원래 원고의,

2,000억 엔 규모

가 아니라,

약 3,100억 엔 규모

쪽이 현재 환율로는 가깝습니다.

물론 환율은 변동하므로, 기사 제목에서는,

20억 달러 규모

와 달러로 쓰는 것이 가장 안전합니다.

## 다만, “3000억 엔을 안전 점검에만 쓴다”는 것은 사실과 조금 다르다

여기도 주의가 필요합니다.

공식 발표에서는,

이 분야의 역량 구축에 투자하라

라고 되어 있습니다.

즉 20억 달러 전부가,

Anthropic의 Claude 평가 요금

로서 직접 사용되는 것은 아닙니다.

인재.

평가 기술.

조직.

도구.

AI 안전성 역량 구축.

등도 포함한 넓은 투자라고 보는 것이 정확합니다.

그래서,

안전 테스트에 3000억 엔 투입

보다,

AI 안전성 평가 역량 구축에 양사 합쳐 최소 20억 달러

라고 쓰는 것이 좋다고 생각합니다.

## 가장 궁금한 문제. “정말 독립되어 있는 거야?”

여기가 개인적으로는 이번에 가장 재미있는 부분입니다.

이번 방식은,

독립 임베디드 평가자

즉,

독립적인 내장형 평가자

라는 생각입니다.

하지만,

누가 돈을 내는 거야?

라는 의문이 생깁니다.

답은,

Anthropic입니다.

Anthropic은 이번에,

Accenture의 평가 작업에 대해 자사가 직접 자금을 제공한다고 명기하고 있습니다.

즉,

감시받는 회사가 감시하는 측에 돈을 낸다.

물론,

“그걸로 정말 독립이라고 할 수 있는 거야?”

라는 의문은 남습니다.

## 사실 Anthropic 자체도 그 문제를 인정하고 있다

여기가 이번에 매우 중요합니다.

Anthropic은,

독립 평가에 어떻게 자금을 지원해야 할지는 아직 확립된 제도가 없다

라고 인정하고 있습니다.

그리고 장기적으로는,

복수 기업의 공동 자금

야,

정부 등의 자금

쪽이 더 바람직하다고 하고 있습니다.

이것은 상당히 흥미롭습니다.

Anthropic 자체도,

“자사가 돈을 지불하는 구조가 최종 형태는 아니다”

라고 생각하는 것입니다.

현재는 제도가 없기 때문에,

먼저 우리부터 시작한다.

라는 단계입니다.

![画像](https://assets.st-note.com/img/1789969233-y87BEQYNxSrTkAl2Gj5OheFC.png?width=1200)

## Anthropic을 주목하는 것은 Accenture만이 아니다.

이번 제휴는 독점 계약이 아닙니다.

Anthropic은,

향후 다른 평가 기관과도 협력할 방침입니다.

실제로,

AI 안전성 평가로 알려진 비영리 단체 METR 등과도 임베디드 평가의 일부를 시험하기 위한 논의를 진행하고 있습니다.

반대로 Accenture도,

Anthropic뿐만 아니라,

다른 AI 개발 기업에서도 같은 일을 하는 것이 가능하다

입니다.

Anthropic의 생각으로는,

한 회사만 감사하는 것이 아니라,

다수의 제3자 평가기관으로 구성된 에코시스템

를 만들고 싶다는 방향입니다.

## 왜 지금 이런 일을 시작하는 거야?

배경에는 AI의 능력이 급격히 향상되고 있다는 점이 있습니다.

Anthropic 자체도 9월 17일,

프론티어 AI 기업 내부에서 AI 개발이 어느 정도의 속도로 진행되고 있는지를 외부에서 파악할 수 있도록 새로운 측정 방법을 공개했습니다.

그 중에서,

복수의 제3자 평가기관을 Anthropic 사내로 들일 예정

을 밝히고 있습니다.

즉, 이번 Accenture 제휴는 갑자기 나온 이야기가 아닙니다.

Anthropic이 추진하고 있는,

AI 기업의 내부를 외부에서 더 잘 볼 수 있게 하다

라는 일련의 움직임 중 하나입니다.

## Accenture의 주가도 반응했다

Accenture는 뉴욕증권거래소에 상장된 기업으로, 티커는 ACN입니다.

Reuters에 따르면, 이번 제휴 발표 후 Accenture 주가는 시간외거래에서 약 7% 상승했습니다.

물론,

AI 안전성 사업이 성공해서 주가가 올랐다

라고 단순히 단정할 수는 없습니다.

다만, 시장이 이 제휴를 호재로 받아들였다는 것은 확인할 수 있습니다.

【주가 차트: Accenture/ACN】

Anthropic은 비상장 기업이므로, Anthropic 자체의 주가 차트는 없습니다.

## 자주 묻는 질문

### Q1. Accenture가 Claude를 모니터링한다는 뜻인가요?

대략적으로 말하면 그렇지만, 보다 정확히는 Accenture 산하의 Faculty를 중심으로 Anthropic 내부에서 모델 평가·레드티밍·정렬 평가·안전장치 테스트 등을 수행합니다.

### Q2. Anthropic 직원과 완전히 동일한 권한을 가지고 있나요?

공식 표현은,

직원에 준하는 접근 권한

입니다.

완전히 동일한 사내 권한이 부여된다고까지는 발표되지 않았습니다.

### Q3. 20억 달러를 Anthropic이 전부 부담하는 건가요?

아닙니다.

Anthropic과 Accenture가 각각 최소 10억 달러를 5년간 투자할 계획입니다.

### Q4. Accenture는 정말 독립적인가요?

이것은 향후 중요한 논점입니다.

조직으로는 Anthropic과 별개의 회사이지만, 이번 Accenture 측 평가 작업에는 Anthropic이 직접 자금을 제공합니다.

Anthropic 자체도 장기적으로는 공동 기금이나 정부 자금 등 별도의 방식이 필요하다고 밝히고 있습니다.

### Q5. 이렇게 하면 Claude는 안전해질까요?

안전성을 높이기 위한 장치이기는 하지만,

완전한 안전을 보장하는 것은 아닙니다.

Anthropic 자체도 안전성에 대한 최종 책임은 여전히 Anthropic에 있다고 명시하고 있습니다.

### Q6. 다른 AI 회사도 같은 일을 할까요?

앞으로 확대될 가능성은 있지만, 아직 제도로서 표준화된 것은 아닙니다.

Anthropic도,

접근 범위나 보고 방법에 대해서는 현재 공통 기준이 없다

라고 밝히고 있습니다.

## 정리

2026년 9월 18일, Anthropic과 Accenture는 프런티어 AI의 안전성 평가를 위한 새로운 제휴를 발표했습니다.

가장 큰 특징은,

외부에서 완성품만 보는 데 그치지 않고, 외부 평가자를 AI 기업 내부로 들어오게 한다

것입니다.

실무는 Accenture 산하의 Faculty가 주도한다.

모델 평가 레드티밍 정렬 평가 안전장치 테스트

등을 합니다.

양사는 향후 5년간 AI 안전성 역량 구축에 각각 최소 10억 달러, 합계 최소 20억 달러를 투자할 예정입니다.

하지만 이번에 조사하면서 개인적으로 가장 신경 쓰였던 것은 금액이 아니었습니다.

“감시받는 회사가 감시하는 회사에 돈을 낸다”

라는 구조입니다.

Anthropic 자체도 이 자금 조달 모델이 최종 형태가 아니라고 인정하고 있습니다.

그래서 이번 시도는,

이것으로 AI 안전성 문제가 해결됐다

가 아니라,

“AI 기업의 내부를 제3자에게 보여주는 제도를 먼저 실제로 도입해 보았다”

라는 뉴스라고 생각합니다.

AI가 강해질수록,

모델이 얼마나 똑똑한지

뿐만 아니라,

누가 그 AI 기업을 감시하는가

그쪽이 더 큰 주제가 될지도 모릅니다.

**출처:** [note 원문](https://note.com/quiet_spirea2390/n/na87dce8d31ec)

*번역: Gemma 3(.44) 초벌 + 교정 99청크*

[원문 보기](https://note.com/quiet_spirea2390/n/na87dce8d31ec) | 출처: note.com