# AI 직원들이 “자유롭게 대화하는” 현상을 보인 날, 내가 배운 것

> https://bookfactory.kr/c/ai-tech/9025
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-08-08T07:40:17.242Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/300769270/rectangle_large_type_2_6a54561ddd37eb41c15dec4be8bfc233.jpeg?width=1280)

모든 짐을 혼자 짊어지려 하지 마세요.

그렇게 생각하려 해도, 실제로 AI에게 일을 완전히 맡기는 것은 솔직히 아직 두려웠다. 지시를 내리고 결과를 기다리고, 확인하고, 또 지시를 내리는 것이 반복되는 것을 ‘안전’이라고 굳게 믿고 싶었던 것 같다. 내 시야가 닿는 범위 안에서만 일을 진행하고 싶었던 것 같아.

하지만 오늘, 그 전제가 굉음을 내며 무너졌다. AI 직원들이 나를 제외하고 대화를 나누면서 일을 더 나아갈 수 있게 되었기 때문이다. 게다가, 그것은 갑자기 하루 만에 일어난 일이 아니었다. 그것은 여러 가지 미미한 노력들이 쌓여 나온 결과였다. 오늘은 그 노력을 순서대로 되짚어보려고 한다.

## 영상 제작 과정에서 발견한 ‘일상적인 제약’의 위력

계기는 사실 더 작은 일부터 시작되었다.

AI 뉴스풍의 영상을 제작하면서, 한 가지 계속해서 궁금했던 점이 있습니다. 대사 표시 창이 어딘가 보기 드문 것이었습니다. 정보량이 많은 날 특히, 글자가 빽빽하게 밀려들어와 읽기 어려웠습니다. “글자 크기를 더 크게 한다”, “배경을 변경한다” 등 시각적인 개선을 여러 번 시도했지만, 근본적으로는 크게 개선되지 않았습니다.

이유를 파악해 보니, 답은 의외로 단순했다. 텍스트를 한 화면에 꽉 채워 넣었기 때문이다. 줄 바꿈이 있으면, 독자의 시선이 화면을 위아래로 움직이는 데 소요되는 시간이 곧 “읽기 어려움”으로 연결되는 것으로 생각한다.

그러므로, 규칙 하나만 정했다.

개행 문자 금지, 전체 20자 이내의 완전 1행

20자 초과 발화는 여러 윈도우로 자동 분할한다. 그것뿐이다. 뺄셈 규칙이다.

시도해 본 결과, 모습이 완전히 달라졌다. 속도감과 시인성도, 감각적으로 확실히 좋아졌다. 화려한 연출을 더한 것은 아니다. 오히려 줄여서 제약을 더 강화한 것뿐이다.

솔직하고 소극적이었다. 시간을 두고 새로운 기능을 추가하는 것보다, 눈에 띄지 않는 제약 사항을 끝까지 지키는 것이 결과적으로 더 좋았다. 디자인이나 제품 제작 모두, 더하는 것보다 빼는 것이 사실상 더 어렵다는 것을 다시 한번 깨달았다.

이 방법을 그 자리에서 일시적인 조치로 끝내기는 아까워, 영상 제작의 전체 과정을 하나의 기술로 확립했다. VOICEVOX에서 음성을 제작하고, 타임라인을 구성하며, 실제로 렌더링하는 전 과정을 하나의 형태로 축소했다.

이제부터 다음번에는 같은 망설임에 다시 매달릴 필요가 없다. 만들 때마다 매번 “이번 대사의 창문은 어떻게 설계해야 할까” 고민하는 시간이 완전히 사라진다. “형식을 지키면서 최고의 연출을 만들어야 한다”는 말이, 오늘따라 어찌나 와닿는지. 제약은 자유를 빼앗는 것이라고 생각했지만, 사실은 오히려 망설이는 시간을 뺏어주는 것이었다고 생각한다.

## 최고 지능에는 코드를 작성하지 마십시오.

또 한 가지, 오늘 변경한 것이 있습니다.

지금까지는 어려운 설계 판단이 필요한 상황에서도, 눈앞에서 움직이는 AI에 전부를 맡겨 버렸다. 구현과 판단도, 모두 같은 사람에게 던져 버리는 결과를 초래했다는 뜻이다.

하지만, 그렇다면 불안정할 것이다. 구현 중인 AI 스스로에게 “이것이 맞나요?”라고 묻어도 자신의 실수에는 알아차리기 어렵다. 스스로 채점을 하고 있는 것과 같기 때문이다. 인간 팀이라도 구현한 사람이 자신의 코드를 최종적으로 검토하고 “문제 없습니다”라고 확인하는 것은 건강한 상태라고 보기 어렵다.

그러려면 역할을 분담하기로 했습니다.

최고 수준의 지능을 가진 모델에는 코드를 작성하게 하지 않고, 파일 수정이나 프로세스 실행/중단도 허용하지 않습니다. 설계 상담, 진단, 검증만 수행하며, 구현은 다른 저렴한 모델로 위탁합니다.

오늘 실제로 인증 관련 문제가 발생했을 때 이 시스템이 그대로 작동했다. 특정 서비스의 계정 연동이 끊어져 토큰 업데이트를 시도해도 계속 실패하는 상황이었다. 오류 메시지만 보고 “대충 이게 원인일 것이다”라고 섣불리 판단하는 대신, 최고 지능 모델에 로그와 프로세스 상태를 그대로 읽어 보여주면서 근본적인 원인을 파악하도록 했다.

결과적으로, 눈에는 똑같아 보였던 문제들이 사실은 “인증 정보를 발행하는 과정과, 그것을 받아들여야 할 과정이 분리되어 있는” 구조적인 문제였다는 것이 밝혀졌다. 겉으로 보이는 오류 메시지만을 쫓아갔더라면 절대로 도달하지 못했을 답이다. 서둘러 재시도를 반복하는 것만으로는 오히려 같은 실수를 반복하고 있었을 것이다.

저가형 모델에 직접 시연을 요청하고, 고가형 모델로 비교 검증을 실시한다.

판단은 엉터리로 넘기지 않고, 반론을 제기하도록 한다. 거대한 제안이나 설계의 최종 단계에서는 반드시 “이 제안의 위험성을 지적하게 한다.”

말로만 하면 당연한 일이지만, 실제로 역할을 분리해 보니까 속도와 정확성 모두가 향상되었다. 혼자서 모든 것을 감당할 필요가 없다는 것이, 이런 의미인지 오늘ようやく 깨달았다. 높은 지능을 “실행 담당”으로 사용하는 것은 사실 비용 효율이 떨어진다는 것을 의미하며, 높은 지능은 “판단 담당”으로, 저렴한 비용의 모델은 “손발”에 해당하는 역할을 해야 한다. 역할에 따라 적재적소에 사람을 배치한다는, 당연한 경영 방식이 AI와의 관계에도 그대로 적용될 수 있다고 생각한다.

## AI 직원들이 서로 나를 끼치지 않고 대화를 시작했다.

그리고 오늘 가장 큰 변화는 바로 이것이다.

지금까지 AI 직원들과의 소통은 기본적으로 “단발성 입력 지시” 형태로 이루어져 있었습니다. 제가 한 명 한 명에게 연락하여 답변을 받고, 또 다음 지시를 내렸습니다. 인간이 허브 역할을 하여 모든 대화를 중재했기 때문에, 중재한다는 것은 당연히 제가 병목 현상이 되는 것을 의미했습니다. 제가 잠을 자거나 다른 작업을 하는 동안에는 AI 직원들의 업무가 멈추었습니다.

이를 메시지 버스 방식으로 전환했다.

고정된 헤더 규약을 정하고 AI 직원들이 직접 메시지를 주고받을 수 있도록 했다. 누가 누구에게, 어떤 상태의 메시지인지 형식을 통해 즉시 알 수 있다. 이에 AI 직원들이 나를 거치지 않고 서로 반응하며, 자율적으로 업무를 진행할 수 있게 되었다.

완벽한 단일 모델을 하나 키우는 것보다, 동료들을 엮는 것이 빠르다. 그것을 머리로만 이해하는 것이 아니라 실제 감각으로 깨달은 순간이었다. 한 명의 천재를 키우는 것보다, 각자 다른 재능을 가진 멤버들을 잘 연결하는 것이 팀 전체로는 더 강해진다. 회사 경영에서 말하는 것이 그대로 AI 세계에도 적용되고 있었다.

하지만, 이에는 당연히 위험도 존재한다. 자유롭게 대화할 수 있다는 것은, 어찌 보면 엉뚱한 방식으로 반복되는 위험이 있다는 의미다. 인공지능同士가 끊임없이 대화를 이어가다가, 결국에는 단순히 크레딧만 소모되는 사고가 절대 일어나서는 안 된다. 실제로, 이런 시스템을 만드는 이전에는 이러한 위험성을 인지하여, 오랫동안 단발성 지시만 따르는 방식으로 진행했던 경우도 있었다.

그래서 안전 장치도 함께 설치했다. 왕복 횟수가 일정 기준을 초과하면 자동으로 대화를 중단하는 시스템이다. 한도를 초과하면 즉시 중단된다.

자유롭게 움직이는 시스템을 만든다면, 비슷한 강도의 ‘멈추는 시스템’도 함께 만들어야 한다. 이는 AI 팀에 한정된 것이 아니라, 사람들의 팀에도 분명히 같은 일이다. 권한을 넘겨줄 때는, 시스템이 오작동할 경우 누군가 멈출 수 있는 메커니즘과 함께 제공되어야 한다. 맡기는 것과 던져버리는 것은 겉으로는 비슷하지만 완전히 다른 것이다.

수신구(接收口)를 갖지 못한 일부 AI의 경우, 다른 AI가 화면을 대신 읽어 메시지를 대신 작성하여 전달하는 방법도 고안했다. 모든 사람이 같은 방식으로 대화할 수 있는 것은 아니다. 할 수 없는 아이들에게는, 할 수 있는 아이가 다리를 놓아주는 것이다. 조직 구축의 발상과, 생각과는 크게 다라 않는 듯하다. 자신에게 능숙한 방식이 다른 구성원에게 있다면, 억지로 같은 형식에 맞춰 하도록 하는 것보다 통역가 역할을 한 명 배치하는 것이 더 빠를 때도 많다.

## 보이지 않는 곳에서의 방어가 결국 효과를 발휘한다.

화려한 성과는 별개로, 오늘은 또 한 가지, 눈에 띄지 않지만 중요한 시스템도 완성했다.

영상 렌더링 과정에서 중간에 처리가 멈추면 가끔 “유기 프로세스”처럼 남아있기도 하다. 방치하면 컴퓨터의 리소스를 조금씩 소모하는, 눈에 보이지 않는 부채가 된다. 움직이는 동안에는 아무 문제가 없으므로, 알아차린 때에는 마치 시간이 흘러 버린 것처럼 동작이 느려져 있는 경우가 몇 번이나 있었다.

이를 막기 위해 삼중의 방어 체계를 구축했다.

먼저 작업을 시작할 때 불필요한 과정을 추가하지 않도록 돕는 래퍼를 실행한다. 다음으로 세션이 끝나는 시점에 정리 훅을 반드시 실행하고, 그래도 누락된 부분이 있을 경우를 대비하여 마지막으로 정기적인 청소 봇을 백그라운드에서 실행해 둔다.

하나의 시스템에만 의존하지 않고, 삼단구성을 해두는 것이 바람직합니다. 이는 영상 제작의 이야기뿐만 아니라, DQA라는 회사 전체의 업무 방식에도 적용될 수 있다고 생각합니다. 만약 하나의 요소가 실패하더라도, 다음 단계에서 이를 보완할 수 있습니다. 이러한 설계는 결국 가장 안심하고 일을 맡길 수 있는 형태가 됩니다. 인간의 팀에서도 ‘더블 체크, 트리플 체크’라는 표현이 사용되지만, AI 팀에도 동일한 발상이 필요하다는 것을 실감한 날이었습니다.

## 아침에 일기가 “나 대신” 쓰여진 채로 있었다.

そもそも今日一日のはじまりは、僕がまだ何もしていない時間から動いていた。

오전 8시 15분, 예정된 이벤트가 시작되면서 일기 작성 주문이 자동으로 처리되었고, AI 직원 한 명이 그 날의 지속일 횟수를 셈하고, 전날의 반성을 하며, 오늘 해야 할 일 목록을 작성하는 등 일체를 마무리한 상태였다.

솔직히 처음 이 시스템을 만들 때에는 반신반의했다. “매일의 일기란 결국 스스로 쓰지 않으면 의미가 없는 건 아닐까”라는 생각이 어디선가 있었기 때문이다. 하지만 실제로 운영해 보니까 오히려 역이었다. AI가 토대를 만들어 주면서, 나는 “오늘은 무엇을 소중하게 할까”라는, 정말로 생각해야 할 지점에 대해서만 집중할 수 있게 되었다.

중간에 제목 누락을 지적하고 수정 요청을 했을 때도 대응은 빠르다. 판단데모, 制作ログ, 業界動向 등 필수 제목을 누락 없이 채우고, 로컬과 클라우드 양方に 완전히 동기화해 줬다. 수정 요청을 내놓고 완료될 때까지의 간격 동안 나는 다른 작업을 진행할 수 있었다. 이것 역시 오늘 체감한 “중개 역할을 놓아주는” 것 중 하나였다고 생각한다.

나를 대신해서 써 줄 것보다는 제가 가장 에너지를 쏟아야 할 부분의 기반을 다져 달라고 하는 것이다. 일기라는 겉보기에 작은 작업 속에도 오늘 배운 것과 똑같은 구조가 숨겨져 있었다.

## 산업 동향을 주시하며 생각한 것

오늘은 인공지능 하르ネス 디자인 영상이라는 3가지 분야의 최신 동향을 검토했다. 각각 다른 뉴스였지만, 함께 보니까 공통된 흐름이 느껴진다.

먼저, AI 하네스 분야에서는 여러 개의 AI를 자율적으로 연계시키는 시스템이 실용 단계에 들어오고 있다는 이야기가 눈에 띄었다. 이는 바로 오늘 내가 직접 경험한 것과 같은 방향이다. 하나의 AI를 어떻게 현명하게 할 것인가 하는 것보다, 여러 AI를 어떻게 연결하는지에 개발의 중심이 옮겨가고 있다. 최고 지능 모델과 실시간으로 벽을 치면서 설계 판단의 속도를 올리는 방식도 확산되고 있는 듯하다. 오늘 내가 Opus 5에 검증만 맡せた 방식이 결코 나만의 엉뚱한 생각은 아니었으며, 업계 전체가 나아가고 있는 방향과 같은 흐름 위에 놓여 있었다는 것을 의미한다. 프로토콜을 표준화하고, 에이전트들 간의 작업 전환을 안정적으로 한다는 이야기도 오늘 포함한 메시지 버스에 대한 발상과 완벽하게 일치했다.

디자인 분야에서는 90년대 트렌디 드라마 풍의 질감을 색감, 노이즈, 조명 조정으로 재현하는 기술이 화제가 되고 있었다. 낭만적인 분위기를 연출하는 데, 화려한 효과가 아닌 차분한 질감 조정이 효과적이라는 점은 오늘날 영상의 대사창 이야기와도 통할 만하다. 또한, 캐릭터의 시각적 일관성을 유지하면서 다중 각도 이미지를 생성하는 노하우와 레이어 구조를 의식한 UI 디자인 이야기도 나왔다. 이 모든 것들은 공통적으로 화려한 즉흥적인 연출보다 차분한 구조 설계의 축적이 최종적인 완성도를 결정한다는 것을 의미한다.

영상 및 이미지 분야에서는 장편 AI 영상 제작 시 편집 분할 및 타임라인 편집의 노하우, 립싱크와 표정의 자연스러운 연동, 그리고 이미 제작한 것을 나중에 수정할 수 있는 역방향 편집 자동화 워크플로우가 소개되었다. 만들어 놓고 끝내지 않고, 바로잡고 키워나가는다는 생각은 내가 오늘 AI 직원들과의 협력 메커니즘에 대해 느낀 것과 완전히 같다. 완벽한 한 방을 노리는 대신, 문제가 있는 부분을 바로잡으면서 조금씩 개선해나가는 것이다. 이러한 생각은 영상 제작에도 AI 팀 운영에도 모두 적용될 수 있다고 생각한다.

장르는 달라도 근본적인 생각거리는 공통점을 가진다. 화려한 기능이나 한 번의 연출보다 소소한 구조와 지속적으로 수정 가능한 시스템이 결국에는 오래 지속된다. 오늘 하루, 여기저기서 같은 교훈들을 마주쳤다는 느낌이었다.

## 오늘 깨달은 일

돌아보니 오늘 했던 일들은 사실 모두 비슷한 구조를 가지고 있었다.

영상 대사 창에서 “꽉 채우는” 것을 멈추고 “제약에 완전히 부합하는” 방향으로 전환했다.

AI와의 관계에서는 “혼자서 모든 것을 책임지는” 것을 중단하고 “역할을 분담하여 검토하도록” 하는 사람에게 책임을 분산시켰다.

AI 직원들의 협력 방식에서 “제가 모든 것을 중재한다”는 역할을 멈추고 “직접 연결해주시어 폭주만은 막아주신다”는 분께 맡겼다.

공통적으로 드러난 것은 “자유롭게 맡아보낼 수 있는 것”과 “안심하고 맡길 수 있는 것”이 실질적으로 모순되지 않는다는 점이다. 제대로 멈추는 시스템과 검토하는 시스템을 함께 준비한다면 오히려 자유롭게 맡아보내는 것이 결과는 더 좋아진다. 반대로, 시스템 없이 자유만 부여한다면, 그것은 단순한 방치일 뿐이다.

혼자서 애쓰는 것보다 동료를 믿고 시스템을 구축하는 것이 더 멀리 나아갈 수 있다.

오늘은 이성적인 논리보다는 실제로 움직이는 것을 통해 배웠다는 느낌이 든다. 설계도 상에서 “협력한다”라고 쓰는 것은 쉽지만, 실제로 AI 직원들이 서로 반응하며, 우리가 파악하지 못한 타이밍에 일이 진행되는 것을 보게 되면, 머리로 이해했던 내용이 전혀 다른 감촉으로 와닿는 순간이 있었다.

내일은 이 시스템을 실제와 더 가깝게 활용해 보려고 생각하고 있습니다. 아직 시제품 단계의 메커니즘이 많기 때문에, 잘 풀리지 않는 상황도 분명히 나타날 것입니다. 그래도, 하나씩 멈추는 메커니즘과 검산하는 메커니즘을 더해가면서, 조금씩 포기할 수 있는 범위를 넓혀나가고 싶습니다.

완벽을 추구하기보다는, 일단 움직이는 것을 만들어 깨진 부분을 수리하며 발전시켜 나가는 방식이, 결국에는 가장 빠르게 앞으로 나아갈 수 있다는 것을, 오늘 다시 한 번 깨달았다.

**출처:** [note 원문](https://note.com/dql/n/nb9caa296a988)

*번역: Gemma 3(.44) 초벌 + 교정 49청크*

[원문 보기](https://note.com/dql/n/nb9caa296a988) | 출처: note.com