# 추가 예산 0엔으로 ‘AI 엔지니어 2인 체제’를 만들어 봤다. Claude Code × Codex의 사내 개발

> https://bookfactory.kr/board/ai-tech/18662
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-26T12:47:31.989Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/317699862/rectangle_large_type_2_41e904fbc86c8ea5a90d81853dd17e35.png?width=1280)

이번에는 “이 코드, 직접 체크해”를 그만뒀다. Claude Code에 Codex를 연동해 쓴 이야기입니다.

## AI 사원 ‘아야메’에게 또 한 명의 엔지니어를 붙여 봤다

최근 사내에서 AI를 어떻게 활용할지에 대해 여러 가지로 시도하고 있습니다. 단순히 ChatGPT에 질문하는 데 그치지 않고, “AI를 직원처럼 회사 업무에 접목할 수 없을까?”라는 실험입니다.

그중 하나로 만든 것이 AI 엔지니어 '아야메'입니다. Discord에 아야메 전용 채널을 개설하고 Claude Code와 연동하고 있습니다.

▼ 제 과거 기사를 참고해 주세요

직원들은 Discord에서 "이 기능 추가해 줘", "이 버그 조사해 줘", "이런 사내 툴 만들 수 있어?"라고, 평소 인간 엔지니어에게 상담하듯이 지시할 수 있습니다. 여기까지는 이전부터 만들어 두었던 시스템입니다.

다만, 실제 운영을 생각해 보니 신경 쓰이는 점이 하나 생겼습니다.

## 만든 본인에게 자신의 작업을 확인하게 해도 되는 걸까?

Claude Code는 상당히 우수합니다. 원하는 작업을 전달하면 코드를 작성하고, 파일을 수정하고, 테스트까지 진행해 줍니다.

하지만 문득 이런 생각이 들었습니다. 구현한 AI에게 그대로 자신의 코드를 리뷰시키면 어떨까?

이는 사람의 일에서도 마찬가지입니다. 자신이 직접 자료를 만들고 직접 오탈자를 확인하면 의외로 놓치기 쉽습니다. 시스템 개발에서도 구현자와는 다른 엔지니어가 코드 리뷰를 하는 경우가 있습니다.

그렇다면 AI도 '만드는 AI'와 '체크하는 AI'로 나누면 된다. 그래서 주목한 것이 OpenAI의 Codex였다.

## Claude Code+Codex로 “AI 개발팀” 만들기

역할은 단순합니다. Claude Code(아야메)=메인 엔지니어, Codex=두 번째 엔지니어 겸 리뷰어입니다. 직원들에게 보이는 창구는 지금까지와 마찬가지로 아야메뿐입니다. Codex용 Discord 채널을 따로 만든 것도 아닙니다.

직원이 아야메에게 개발을 의뢰하면, 내용에 따라 아야메 스스로 ‘이것은 Codex의 리뷰가 필요하다’고 판단합니다.

한편 뒷단에서는 직원이 Discord로 요청↓아야메(Claude Code)가 구현↓Codex가 코드 리뷰↓아야메가 Codex의 지적을 검증↓필요하면 수정↓테스트↓Codex가 다시 리뷰↓Discord에 완료 보고

이런 흐름으로 동작합니다. 물론, Codex가 말하는 것을 Claude Code가 전부 그대로 받아들이는 것은 아닙니다.

"그 지적이 정말로 옳은 것인가?"를 아야메 측에서도 판단하게 합니다. AI끼리 의견을 내도록 하는 이미지입니다.

## AI끼리 최대 3회 주고받는다. 그래도 안 되면 인간에게 넘긴다.

여기서 무서운 것은, AI끼리 끝없이,

“여기를 고치는 게 좋겠어요” “고쳤습니다” “그럼 여기도” “고쳤습니다”를 계속 반복하는 것입니다(웃음).

그래서 규칙을 정했습니다. 아야메와 Codex의 주고받기는 최대 3회까지입니다. 그래도 해결되지 않으면 자동 작업을 중단하고 사람에게 보고합니다.

또한,

- 운영 환경에 반영
- 데이터 삭제 및 대량 변경
- API 키 등 인증 정보 변경
- 권한 변경
- 외부에 대한 공개나 전송
- 복구가 어려운 조작

이러한 것들은 AI 단독으로 임의로 실행시키지 않습니다. ‘무엇을 하는지’, ‘어떤 영향이 있는지’, ‘리스크는 무엇인지’, ‘어떻게 되돌릴 것인지’를 Discord를 통해 사람에게 보고하고 승인을 받은 뒤에 실행하는 규칙으로 정하고 있습니다.

맡길 부분과 인간이 판단할 부분을 구분한다. 이는 AI 직원을 만드는 데 있어 상당히 중요하다고 생각합니다.

## 정말 작동할까? 실제로 테스트해 봤다

규칙만 만들어서는 의미가 없으니 실제로 시도해 보았습니다. 아야메에게 부탁한 것은 매우 간단한 사내 도구입니다.

이름을 입력하고 버튼을 누르면 "○○님, 수고하셨습니다!"라고 표시하는 HTML 도구.

목적은 도구 그 자체가 아니라, Claude Code → Codex → Claude Code라는 개발 흐름이 정말 자동으로 동작하는지를 확인하는 것입니다.

결과는 성공이었다.

아야메가 HTML을 작성했습니다. 그 후 직접 Codex CLI를 실행해 Codex에게 읽기 전용으로 코드 리뷰를 의뢰했습니다.

Codex는 버그나 로직에 문제는 없는지, 보안상의 문제는 없는지, 예외 처리는 괜찮은지, 테스트가 부족하지 않은지 등을 확인한다.

코드 자체에는 큰 문제가 없다. 다만 Codex로부터 "빈칸인 경우는?", "Enter 키로도 동작하는가?", "일본어 이름은?", "<script>와 같은 문자가 입력된 경우는?", "글자 수 제한은?"과 같은 추가 테스트 관점이 나왔다.

아야메는 그 지적을 확인하고 필요한 테스트를 추가했습니다. 최종적으로 모든 테스트를 통과한 뒤 Discord에 완료 보고를 했습니다.

이번에는 Codex 리뷰 1회로 종료합니다. 문제가 없으면 무리하게 3번 주고받을 필요는 없습니다.

## 도중에 AI가 침묵해 버렸다(웃음)

사실 이번에는 재미있는 해프닝도 있었습니다. 개발 도중에 갑자기 아야메에게서 Discord 답장이 끊겼습니다.

“멈췄나?” 하고 PC를 확인해 보니, Claude Code가 브라우저를 사용하려다가 “브라우저 확장 기능을 사용하시겠습니까?”라는 사용자 조작 대기 화면에서 멈춰 있었습니다.

그렇군요.

AI가 고민하고 있던 것도 아니고, Codex가 느렸던 것도 아니었다. 사람의 클릭을 기다리고 있었던 것이다(웃음). 이것도 실제로 실행해 봤기 때문에 알게 된 것이다.

그래서 규칙을 하나 더 추가했습니다. 앞으로는 “작업 시작합니다. 10분 정도 걸릴 예정입니다”라고 처음에 예상 시간을 보고합니다.

사람의 개입이 필요해지면, "현재 사람의 개입 대기 중입니다"라고 Discord에 보고.

예정 시간을 초과할 것 같으면, "현재 여기까지 진행되었고, 앞으로 ○분 정도 걸립니다"라고 중간 진행 상황을 보고한다.

이렇게까지 하면, 점점 AI라기보다는 원격으로 일하는 직원을 관리하는 것에 가까워집니다.

## 그리고 이번에 가장 놀랐던 것은 "추가 예산 0엔"이었다

이번 방식에서 개인적으로 특히 좋았던 점이 바로 이 부분입니다. 저희 회사는 이미 ChatGPT Business를 계약한 상태입니다.

이번에는 해당 환경에서 Codex CLI에 ChatGPT 계정으로 로그인하여, 실제로 아야메에서 Codex를 호출할 수 있음을 확인했습니다.

즉, 이번 환경에서는 Codex를 추가하기 위해 OpenAI API를 새로 계약하고 종량 과금을 시작한 것이 아닙니다. 이미 회사에서 계약 중인 ChatGPT Business의 이용 한도 내에서 사용하고 있습니다.

이번 구성을 만드는 데 든 추가 예산은 0엔이었습니다. 중소기업에게는 상당히 큰 일입니다.

새로운 AI 서비스를 찾을 때마다 월 구독을 늘려 가는 것이 아니라, "지금 이미 돈을 내고 있는 AI를 더 제대로 활용해 볼 수는 없을까?"

라는 발상입니다. 물론 Business에도 이용 한도가 있습니다.

앞으로 사원들이 점점 더 많이 사용하게 되면 이용량을 보면서 설계를 바꿀 필요가 있을 것입니다.

하지만 처음부터 추가 예산을 편성할 필요는 없다. 먼저 0엔으로 시도한다.

실제로 업무 시간이 줄거나 개발 속도가 빨라지면, 그때 추가 투자를 고려한다.

경영자로서는 이 순서가 더 쉽습니다.

## Claude Code만으로는 안 되는 걸까?

이 점은 오해하지 않으셨으면 합니다. Claude Code만으로도 충분히 강력합니다.

Codex를 추가한 이유는 “Claude Code의 능력이 부족해서”가 아닙니다.

목적은 다른 AI에게 다른 역할을 부여하는 것이다.

인간 회사에서도 영업 담당자가 있고, 영업 매니저가 있고, 경리 담당자가 있고, 확인하는 사람이 있습니다. 모두가 같은 일을 하는 것은 아닙니다.

AI도 마찬가지라고 생각합니다. 하나의 AI에게 “만들어”, “스스로 체크해”, “스스로 승인해”, “스스로 실행해”라고 하며 전부 맡기기보다,

구현하는 AI, 리뷰하는 AI, 마지막으로 승인하는 인간으로 역할을 나눈다.

이쪽이 회사 구조상으로는 자연스럽습니다.

## AI를 ‘사용하는 것’에서 ‘조직화하는 것’으로

이번에 직접 해 보니 가장 느낀 것은 이것이었습니다.

지금까지의 생성형 AI 활용은 ‘ChatGPT에 무엇을 물을 것인가’가 중심이었다고 생각합니다.

하지만 앞으로는 “AI에게 어떤 역할을 맡기고, 누구와 누구를 연계하고, 어디까지 권한을 넘길지”를 생각하는 시대가 될 것 같습니다.

뛰어난 AI 하나를 찾는 것이 아니라, Claude Code에는 구현을 맡긴다. Codex에는 리뷰를 맡긴다. Discord를 직원과의 창구로 삼고, 위험한 작업만 사람이 승인한다.

즉, AI를 선택하는 것이 아니라 AI의 조직도를 만드는, 그런 느낌입니다.

저희 회사도 아직 실험 단계입니다. 앞으로 실제 사내 시스템 개발에도 사용해 보면서 어디까지 맡길 수 있는지 시험해 나가겠습니다.

하지만 사원이 Discord에서 "이거 만들어줘"라고 부탁하면, 뒷단에서는 AI 엔지니어들이 서로 리뷰하고, 완성되면 사원에게 보고한다. 여기까지는 실제로 작동했습니다.

게다가 이번 추가 예산은 0엔이다.

AI 활용은 아직도 할 수 있는 일이 많아 보입니다.

▼이것도 꼭 봐주세요.

**출처:** [note 원문](https://note.com/rich_pipit6321/n/ne9c07b596d55)

*번역: Gemma 3(.44) 초벌 + 교정 41청크*

[원문 보기](https://note.com/rich_pipit6321/n/ne9c07b596d55) | 출처: note.com