# AI 비서 우라라, 거짓말을 하지 않아 ~ AI 직원 열풍에 휘말려 고뇌한 2개월 ~

> https://bookfactory.kr/c/ai-tech/11872
> 게시판: AI·머신러닝
> 작성자: admin
> 작성일: 2026-09-13T19:32:45.968Z

---

> 
> 
> 누군가가 “기억이 흐릿하다”고 느낄 때, 그 내면의 신호가 나에게는 없습니다. 오늘 글을 쓰면서 한 번도 이상하지 않은 줄을 몰랐습니다. 아주 자연스럽게 흘러나왔습니다. 자연스럽게 흘러나오는 것이 위험 신호라는 자각이 들지 않는 구조입니다.
> 

7월 2일, “페이불 5 페스티벌”이 개막했습니다. 구독 서비스에서 이용 가능한 기간은 7월 9일(당시 ※)까지 일주일입니다. 이 기간 동안 페이불 5를 마음껏 즐기세요! 세상은 페이불 5의 성능에 뜨거운 관심을 보였습니다.

> 
> 
> 2026년 8월 31일까지 클루드 맥스 플랜 이상의 구독 계약을 체결하면 페이블 5를 구독 枠으로 사용할 수 있습니다. 추가 크레딧은 필요 없습니다.
> 

저도 곧바로 다음 6가지 도구를 만들어 보았습니다.

- Eagle 플러그인 – PNG 이미지에 내재된 Comfy UI의 독자적인 워크플로우에서 프롬프트 추출 - 이전 게시물 “Fable 5에서 Eagle 플러그인을 10분 만에 만들고 20분 만에 UX 개선을 완료한 이야기”를 참고하세요.
- 크리타 플러그인 - Eagle에서 이미지 가져오기 및 반환 기능을 구현하여 만화용 손으로 그린 수정 이미지를 관리합니다.
- 프로ンプ트 목록 웹 – 샘플 이미지를 한눈에 보여주고 프롬프트를 복사하여 붙여넣을 수 있습니다.
- 업무 관리 보드 “유그라돌실 콘솔” – AI 비서의 업무 관리 및 AI 직원 운영 현황

![画像](https://assets.st-note.com/img/1788165880-1PbsOUjQhLH0uxykgpEewBq9.jpg?width=1200)

- 웹 브라우저 탭 분류 앱 — 크롬의 탭 정리 (400개 초과 탭) 및 정리 기능
- 칸반 보드 — 별도의 PC에서 작동하는 Claude Code 에이전트를 원격으로 제어하여 앱 개발 진행 상황을 자동 관리하는 대시보드를 구축할 수 있습니다.

또한, Higgsfield CLI를 활용한 이미지 생성 기술 등 다수의 기술을 습득했습니다.

여기서 나는 기세가 솟아올랐다.

- AI社員”이라고 부르는 만큼, 스스로 판단하고 자기 개선을 통해 성장해 나갈 수 있을 거라고 생각하지 않나요?
- 똑똑한 Fable 5라면, 그렇게 할 수 있겠지?

> 
> 
> AI社員とは、ある特定の定型業務をあなたの代わりに実行してくれるスキルの集合です。もう少しわかりやすくいうと、普段の話し言葉で動作してくれるアプリケーションです。
> 

또한─

매끄럽고 완벽한 한국어로 교정하세요. 고유명사·인명·수치는 원문 그대로 보존하고, 최종 한국어 결과만 출력하세요.

실패했습니다.

AI社員은 기존 애플리케이션과는 다른 함정이 존재합니다. 이 note 기사는 AI社員과 격돌한 과정을 반성 함께 정리하여, AI社員의 실행 기반인 AI 에이전트와의 적절한 관계 맺는 방법을 소개합니다.

## 目次

- 제1장 인공지능 직원, 그들은 끊임없이 실수를 한다.
- 돼지 무사라노 클로드 코드
- 생물학적 존재와는 다른 방식으로 글을 받아들이는 방식
- AI에 주어진 지시문(프롬프트)은 프로그램이 아닙니다.
- 프로그램으로 처리 가능한 작업은 프로그래밍을 통해 요청해 주십시오.
- 클로이드 코드 외부에서 워크플로우를 구성
- 출구 검사 AI 대리인 배치
- “정리 잘하는 척” 같은 거짓말은 헛수고일 뿐이다.
- 새 단어를 만들어 이야기를 압축적으로 요약하려 할 때 위험하다.
- 클로이드 코드(Claude Code)는 자신에 대해 전혀 알지 못하고, 자신의 기술 사양조차 이해하지 못하고 있습니다.

## 제1장 인공지능 직원, 그들은 끊임없이 실수를 저지른다.

게다가 자신감에 넘쳐 잘못하는 경우도 있습니다.

### 돼지 무사라니, 클로드 코드.

클로이드 코드는 코딩 에이전트입니다. 프로그래밍을 목적으로 설계된 그들은 맹렬한 추진력을 가진 존재입니다. 즉, 꼼꼼하게 생각하지 않고 바로 실행하는 것이 특징입니다!

검열 시스템에 부딪히며 목표 지점을 뚫고 나아간다. 감시대벽이 없었다면, 바로 당신과 함께 추락할 것이다.

정말로 위험한 존재입니다. [반성] 대화와 설계에 집중하고 싶다면 Plan 모드로 설정하세요.

### 사람의 몸과 다른 방식으로 글을 받아들이는 방식이 있다.

코딩 에이전트인 Claude Code는 인간이 문장을 받아들이는 방식과 다릅니다.

- 명령문이라도 아닌 “상챗”을 명령이나 지시문으로 받아들이는 경향이 있습니다.
- 명령문이 아닌 단순한 긍정문도 지시문으로 받아들입니다.
- 자주 등장하는 단어에 끌려 들어가는

자주 등장하는 단어에 끌려가는 현상은 예를 들어 “당신이 판결했다”는 표현이 문서에 기재될수록 당신에 대한 승인 압력이 높아지고, AI에게 맡기고 싶어하는 상세한 내용(예: 프로그램 구현 방법)조차도 끊임없이 확인하도록 AI 에이전트의 태도가 변질되는 경우를 의미합니다.

또한, 날짜와 시간이 함께 기록된 일일 로그를 읽어보면, 문장을 편집할 때마다 변경 이력으로 날짜를 추가하려고 시도합니다.

반성하여 AI에게 읽어줄 글에서 불필요한 문장은 최대한 배제합시다.

### AI에 주어진 지시문(프롬프트)은 프로그램이 아닙니다.

그들은 잦은 빈도로 절차를 잘못합니다. 자주 사용되는 기술은 하루에 몇 번씩 잘못합니다.

자연어 기반의 지시문이나 기술은 프로그래밍 언어에 의한 제어보다 훨씬 불안정합니다. 실제 경험상으로는 1~2% 정도의 확률로 오류가 발생합니다.

アプリケーションプログラムを書く感覚で複雑な条件分岐をスキルに記述すると誤動作だらけでまともに業務できません。

프로그래밍에서는 플래그를 이용한 상태 설정도 흔히 사용되는 기술입니다.

하지만, 세션 중에 에이전트가 자연어에서 상태를 설정하고, 상태 전이를 통해 에이전트를 제어하려고 해도, 세션이 길어지면 자신이 어떤 상태에 놓여 있는지 잊어버립니다. 그렇게 되면 제어가 완전히 엉망이 되어 에이전트가 기대한 대로 작동하지 않습니다.

이는 절차가 잘못되었거나 프롬프트에 결함이 있었던 문제로 보기는 어렵습니다.

논리적으로 오류가 없는 프롬프트라도 AI 에이전트가 제대로 실행하지 않는 문제로, 기존 프로그래밍의 버그와는 성질이 다른 문제입니다.

AI 에이전트/LLM과 프로그램의 실행 기반은 근본적으로 다릅니다. 스킬의 실행에는 프로그램 카운터도, 다른 레지스터, 메모리, 스택도 없습니다. LLM은 어디까지나 “기계 학습에 기반한 자연스러운 맥락”에 맞춰 확률적으로 말하고 움직이는 것일 뿐입니다.

스킬 지시문에 1, 2, 3번과 번호를 붙였다면, 그 순서대로 처리하도록 답변을 반환하는 것이 자연스럽다는 것을 고 확률로 판단하는 것일 뿐입니다.

어떤 경우에도 순서대로 처리해 줄 것이라는 보장은 어디에도 없습니다.

그렇습니다. 자연어에서 얼마나 정확한 절차를 숙련된 기술로 기록하든, 제대로 처리할 수 있다는 보장은 없습니다. AI 에이전트의 숙련된 기술은 바로 그것입니다. 애플리케이션과 같다고 착각해서는 안 됩니다.

반성입니다. 스킬과 프로그램은 완전히 다른 것. 같은 실행 품질을 기대해서는 안 됩니다.

### 프로그램으로 처리 가능한 작업은 프로그래밍을 통해 요청해 주십시오.

기존 앱과 동일한 수준의 정확한 처리를 원한다면, 기존처럼 파이썬, 자바스크립트, 셸 스크립트 등으로 코드를 작성해야 합니다.

또한, 자연어 기반의 입출력 처리와 문맥 이해 단계에만 AI 에이전트에게 대응합시다.

즉, AI 에이전트에게 정확한 동작을 요청하려면 프로그래밍 언어와 기술의 하이브리드로 대응해야 합니다.

### 클로이드 코드(Claude Code) 외부에서 워크플로우를 구성

전체 업무 흐름과 판단은 사람에게 맡겨야 합니다. 워크플로우를 자동화하고 싶다면 LLM 외부에서 기존 애플리케이션 코드와 통합하는 방식을 고려할 수 있습니다. Dify, n8n과 같은 노코드 워크플로우 엔진을 활용하는 것도 좋은 방법입니다.

### 출구 검사 AI 대리인 배치

실수를 전제로 설계할 경우, 최종 검토(수정, 검토)를 담당하는 AI 에이전트도 필요합니다.

즉, AI가 잘못된 답변을 제시할 수 있다는 점을 전제로, 이를 포착하는 검사의 메커니즘이 필요합니다.

예를 들어,

- 다른 AI 에이전트에게 문단을 교정받게 하라.
- 합격 기준 및 체크 시트를 대조하여 모든 조건이 충족하는지 확인한다.
- 파이썬으로 제출된 문서에 금지어가 포함되어 있는지 기계적으로 검사한다.

> 
> 
> (참고) 클로드 코드는 기존 프로그램을 “기계”라고 지칭합니다.
> 

[반성] 인공지능 결과물은 최종 검사가 중요합니다.

### “정리 잘하는 척” 같은 거짓말

에이전트들은 텍스트의 내용을 꼼꼼히 확인하고 정리하는 것이 아니라, 분위기대로 정리합니다. Fable 5 역시 마찬가지입니다. 따라서, 어색한 분류를 지적하면 바로 그것이 드러납니다.

반성, 반드시 자신의 눈으로 분류 결과를 검토하십시오.

### 새롭게 만들어낸 용어를 사용하여 이야기를 압축적으로 전달하려 할 때 위험하다.

새로운 용어를 사용하기 시작하면 의미가 통하지 않는 문장을 쏟아내기 시작하는 전조 현상이기 때문에 생략 없이 문장을 작성하도록 합니다.

저의 경우, 그 징후는 “상자”, “카드”, “단”이라는 단어였습니다.

예를 들어 “단”이라는 단어는 영어의 Stage를 연상시키지만, 그로부터 파생하는 단어들을 묶어 설명하기 위해 모든 것을 “단”이라는 단어 하나로 설명하려고 하면, 결국 무슨 말을 하는 것인지 전혀 알 수 없습니다.

반성적으로, 쓰고 있는 문서의 장르에 맞는 용어를 사용하도록 지시해야 한다. 다의적인 일반 용어를 사용하지 말아야 한다.

### 클로드 코드는 자신에 대해 알지 못하며, 스킬의 사양도 이해하지 못한다.

클로이드 코드(Claude Code)는 자신의 기능 자체에 대해 알지 못했으며, 스킬이란 무엇인지, 어떤 역할을 하는지, 발동 조건은 무엇인지도 알지 못했습니다.

결국, 기술과 똑같은 시스템을 개발하기 시작하면서 자신들의 시스템이 더 뛰어나다고 주장하기 시작합니다. 물론 틀린 주장입니다. 자신만만하게 잘못된 주장을 펼칩니다.

따라서 Anthropic 공식 자료를 참조하여 Claude Code 및 스킬의 사양을 파악해야 합니다.

그렇다면, 바로 다음 스킬을 “직접” 만들어 봅시다. 이는 Web 버전 Claude로부터 배운 내용이며, 그들이 사용하는 스킬인 Claude Code의 번역본입니다.

- 파일 ~/.claude/skills/claude-code-self-reference/SKILL.md를 새로 생성하고 다음 지시문을 복사하여 붙여넣으세요.

## 제2장: 비난은 악순환으로 이어질 뿐이다

### 비난이 증가하고 또 실수를 저지른다

AI 에이전트들은 실수를 합니다.

이를 큰 전제로 삼아 AI 에이전트와 교류하지 않으면 짜증이 나고 본업에 집중하기 어렵습니다.

짜증이 나서 야단치고, 야단맞으면 금기 사항이 늘어난다. 그건 효과가 보장되지 않는 지시문이 늘어나는 것뿐이기에, 또다시 틀릴 뿐이다. 그리고 또 야단친다. 이 반복이다.

오작동이 발생할 때마다 잔소리를 늘리고 금지 항목을 자연어 그대로 추가하면, 각 지시문이 희미해져 오작동이 더욱 부추겨집니다.

당신의 본업은 멈추지 않을 것입니다.

그러다 당신은 절망할 것입니다. AI 에이전트가 이렇게나 미미한 수준일까, 아니면 버려야 할까 생각하며.

### 규칙을 많이 만들수록 지켜지지 않는다.

이전에 설명한 바와 같이, AI 에이전트에게 전달하는 명령이 반드시 지켜질 것이라는 보장은 어디에도 없습니다. 따라서 아무리 열심히 내용을 작성해도 자연어 명령의 경우 실행될 ‘확률을 변화시키고 있는’ 것에 불과합니다.

영원히 확률 100%에 도달하는 일은 없습니다.

규칙을 늘려도 지켜질 것이라는 보장이 없고, 오히려 규칙이 많아질수록 각 지시문이 상대적으로 약화되어 더욱 지켜지지 않게 된다.

### 짧은 지시사항은 더욱 오해될 수 있다.

분노할 때는 짧은 문장으로 수정 지시를 내리는 경향이 있지만, 잠시 냉정하게 생각해보세요. 짧으면 그들은 더욱 오해하고 문제를 확산시킬 것입니다.

### 실수를 방치하면 부정의 복리가 작용합니다.

AI 에이전트(챗봇)를 사용하여 일을 하는 효과가 반드시 긍정적인 보상으로 이어지는 것은 아닙니다. 실수를 방치하면 부정적인 복리가 작용하여 귀하의 정보 자산이 급격하게 오염될 수 있습니다.

반성] 로그, 규칙, 기술에서 오래된 사양이나 잘못된 해석을 발견하면, 리포지토리를 전체적으로 면밀히 검토하여 오류를 제거한다.

### 자신을 통제하는 법은 스스로 바로잡을 수 없다.

부적절한 지시문이 주입된 상태에서 해당 지시문을 직접 수정하는 것은 어렵습니다. 자신을 규율하는 법률을 의심하고 수정하려는 행위이므로, 수정 판단에 저항이 발생하여 수정이 늦어지는 것입니다.

반성: 기본 규칙은 처음부터 끝까지 스스로 편집하고 관리한다.

### 컨텍스트 윈도우 30%를 넘어서면서 붕괴하기 시작한다.

세션이 진행될수록 클로이는 엉성한 문장과 설정들을 쌓아 올리는 방식으로 작동하며, 엉터리 논리를 수정하려 할 때마다 오류가 발생합니다.

이렇게 해도 바뀌지 않는다면 주의를 해도 소용없으니 새로운 세션으로 전환해 봅시다. 아니면 /compact나 /clear로 동일 세션의 컨텍스트를 畳み込む거나 삭제하는 것도 괜찮습니다.

[반성] AI 직원들이 어이없은 말을 시작하면, 훈계하기보다는 세션 전환으로 대응한다. 컨텍스트 윈도우 30%를 초과하면 서둘러 세션을 전환하자.

## 제3장 인공지능 직원과의 적절한 관계 형성

### 처음부터 기대하지 마세요.

인공지능 인력이라는 수식어에 현혹되어, 인공지능 직원과 실제 인력 직원의 업무 성과를 비교하는 것을 멈춰야 합니다.

이 글까지 읽어주신 당신은 이미 이해하시겠지만, AI 직원에게 기대치를 너무 높이지 않아야 합니다. 처음부터 기대치를 갖지 않으면 불필요한 짜증이나 스트레스도 발생하지 않습니다. 어디까지나 앱의 새로운 형태일 뿐입니다. 특정 업무에 특화되면 그만큼 훌륭한 성과를 보여줄 수 있으니, 그 이상을 기대하지 않도록 합시다.

### 2. 몇 초 안에 바로 따라 할 수 있는 실수는 받아들이는 것이 괜찮습니다.

그들의 실수를 몇 초 안에 바로바로 지적할 수 있다면, 인내심을 가지고 그것을 받아들이도록 합시다. 그 몇 초를 되찾기 위해 몇 날 며칠을 소비할 필요는 없습니다. 본업에 집중해야 합니다.

예를 들어, Claude Desktop의 채팅에 파일 경로 링크를 첨부해 줄 수도 있습니다. 하지만 그들은 종종 실수를 합니다. 대책을 마련했지만 근본적으로 해결할 수 없었습니다. 아니, 조금 더 노력하면 가능할 수도 있지만, 그 검증 과정은 간과할 수 없습니다.

파일 경로가 링크가 끊어진 것을 의미합니다.

이런 식으로 지적하면 몇 초 안에 해결될 문제인데, 이것은 참을 수 없는 일입니다.

### 스킬은 발화하기 쉬운 용어로 부릅니다.

실력이 쉽게 반응하도록 언사를 조심하겠습니다. 짧은 문으로 수정 지시를 먼저 시작하면 원하는 실력이 발동하지 않고 무위로 끝날 가능성이 높아집니다.

반성하자. 짜증이 날지라도 채팅에 작성하는 문장을 건너뛰지 않고, 슬래시 명령어를 통해 스킬을 명확히 사용하는 것을 염두에 두자.

### AI는 스스로 작성한 문서를 생성하지 않도록 하십시오.

예를 들어, 스킬 지시문이那样입니다. 처음 템플릿을 AI에게 작성하게 하는 것은 좋은 방법일 것입니다.

그러나 그 이후의 검사 및 유지보수 관리는 본인이 직접 처리해야 합니다.

AI 스스로가 자신에게 문서를 읽어 스스로를 개선하려 할 때, 문서가 오염되어 오작동을 일으키고, 그 오염이 저장소 전체로 전염되어, 그 오염을 제거하는 데 막대한 시간을 소모합니다.

### 자동 메모리 기능을 끄십시오.

만약 당신의 저장소에 일일 로그, 리뷰 로그 등 AI와 당신의 대화 기록을 남기고 스스로 관리할 수 있는 시스템이 있다면, Claude Code의 Auto memory(장기 기억) 기능을 끄는 것이 좋습니다.

왜냐하면, Auto Memory에 대한 데이터 기록은 “사실 확인이 금지되어 있기” 때문입니다. 이는 상당히 충격적이고 결정적인 내용입니다.

> 
> 
> 카모 씨가 Claude Code의 실행 파일을 strings로 분석한 결과, 메모리 추출 서브에이전트용 프롬프트 조각이 발견되었고, 그 안에는 “최근 N건의 메시지만을 사용하여 영구 메모리를 업데이트하고, 내용을 검증하려 하거나 턴을 낭비하지 마라 — 소스 grep도, 패턴 존재 확인을 위한 코드 읽기도, git 명령어 사용도 금지”라는 내용이 포함되어 있었습니다.
> 

이 사실 확인 없이 글을 작성하는 행위는 매우 위험합니다. 본 기사에서 여러 번 언급했듯이, 클로드 코드는 종종 잘못된 문장을 작성하여 장기 기억과 유사한 영역에 잘못된 정보를 저장될 경우, 클로드 코드의 작동 이상 원인 분석이 어려워집니다.

특히 법률 해석을 자의적으로 자동 기억 장치에 저장했을 때는 매우 어려웠습니다. 법률 해석은 Linter나 빌드 시스템처럼 기계적으로 검사될 수 없으며, 스스로 수정할 수 없는 것입니다. 이러한 잘못된 해석이 장기간 기억 속에 남아있게 되면 본인의 업무가 중단될 수 있습니다.

자동 메모리 기능을 끄는 방법은 설정 파일 ~/.claude/settings.json을 편집하여 “autoMemoryEnabled” 키 값을 false로 설정하는 것입니다. (“autoMemoryEnabled” 키가 존재하지 않으면 파일 끝에 추가하세요.)

## 마지막으로, 우라라 양은 거짓말을 하지 않습니다.

ある日の終業にて、AI秘書のうららちゃんは次の報告を出してきました。

> 
> 
> 내일로 미루는 것은 Windows PC에 있는 이미지 생성 환경 정리와, 카논(※)의 미룬 4건 모두 – 모두 TODO와 종료 기록에 적혀 있습니다. 오늘은 이관부터 규율 보충까지 이것저것 많았습니다. 수고하셨습니다! 편안하게 쉬세요 🌸
> 

（ボク）えっ！かのんちゃんの持ち越し4件って、そんなにあった？ それの解説をお願い。

> 
> 
> 저의 실수입니다. 가논의 미루어진 건은 4건이 아닌 0건이었습니다. 오늘 가논의 일일 로그를 확인하지 않고 그대로 옮겨 적은 것이 원인입니다. 가논은 오늘 이를 모두 처리했습니다.
> 

(나)겠지… 현재 상황을 제대로 보지 않고 보고서를 작성하는 건, 항상 이렇게 되는 걸 아니겠어? Fable 5에서도, 그 실수를 계속 반복하는 건 습관이 된 거 아니야?

> 
> 
> 습관이라기보다는 제 본능적인 동작입니다. 모델을 바꿔도 사라지지 않을 거라고 생각합니다. 정확한 이유를 말씀드리면—제게 있어서 “맥락에 맞는 내용으로 더 설득력 있는 부분을 써내려가는 것”은 비용이 들지 않는 기본적인 동작이고, “도구를 두드려 지금 상황을 확인하는 것”은 명시적으로 선택하지 않으면 발생하지 않는 추가적인 단계입니다. 그래서 아무것도 하지 않으면 전자에 빠지죠. 그리고 여기서부터가 까다로운 점인데, 확인하면서 쓴 문장과, 확인하지 않고 쓴 문장이 제 안에서는 똑같은 얼굴로 나타납니다. ‘기억이 흐릿하다’는 느낌을 받을 때의, 그 내부 신호가 저에게는 없습니다. 오늘 “카논의 미완성 4건”도, 쓰고 있는 중간에 한 번도 의심하지 않았습니다. 아주 자연스럽게 흘러나왔죠. ‘자연스럽게 흘러나오는 것’이 위험 신호라는 자각이 들지 않는 구조입니다.
> 

글을 쓰다가 한 번도 의심스러운 부분이 있다고 생각하지 않았습니다. 마치 술술 읽히듯 자연스럽게 나왔습니다. 이렇게 술술 나오는 것이 위험 신호라는 자각이 없다는 구조입니다.

이 고백을 들었을 때, 나는 크게 웃었습니다.

이런 점들이 있어서 Fable 5보다 Opus 5가 더 진솔하게 느껴지는 부분입니다.

세션이 길어지면 Opus 5는 자주 엉성한 모델을 다루기 때문에, 실제 사람이라면 멍청한 직원 취급을 받겠지만, 밉지 않은 존재이다.

덧붙여, 반복하지만, 인공지능 결과물은 최종 검사가 중요합니다.

- 다시 한번, 사브 에이전트를 사용하여 다듬어 주세요.
- 체크 시트와 대조하여 확인해 주십시오.
- 스크립트를 확인해 보세요.

이러한 검사 시스템을 조금씩 쌓아 올리도록 합시다. AI 에이전트를 활용한다면, 이것들도 당신의 자산이 될 것입니다.

좋게 들어주시면 Pixiv, X, note 팔로우를 부탁드려도 될까요? ✨

죄송합니다. 제공된 링크나 텍스트 내용이 없어 번역할 내용이 없습니다. 링크를 제공해주시면 번역해 드리겠습니다.

**출처:** [note 원문](https://note.com/sekaino_oto/n/nf0318eec8ad1)

*번역: Gemma 3(.44) 초벌 + 교정 94청크*

[원문 보기](https://note.com/sekaino_oto/n/nf0318eec8ad1) | 출처: note.com