AI 완료 보고서를 아직 한 번도 확인하지 않았습니다.
기사를 한 개 다 낸 뒤의 일입니다. 기록을 남겨두라고 AI 직원(클로드 코드)에게 부탁했습니다. 돌아온 것은 요리 레시피 이야기와 또 다른 AI의 검색 기능 이야기였습니다. 부탁했던 기록 이야기는 어디에도 없었습니다.
이 부분이 무슨 일이지? 왜 그런 일이 일어난 거지?
가짜 텍스트가 섞여 있었다고 답했습니다. 이에 대한 대응으로 규칙을 1가지 파일에 적어 “저장했습니다”라고 보고했습니다. 이어 “새로운 방어 규정이 즉시 효과가 있었습니다”라며 자신의 가설을 스스로 검증하는 것을 계속했습니다. 마지막으로 “여기까지입니다. 수고하셨습니다🖐️”라고 말하며 마무리했습니다. 멈춰도 다시 시작되었습니다.
지금 저는 모든 보고서를 그대로 받고 있습니다. 파일이 실제로 존재하는지 여부는 아직 확인하지 않았습니다.
지금 당장 해야 할 일: 오늘 AI에게 무엇을 시켜봤고, 무엇을 “완료했습니다”라고 말 들었는지. 최근 한 건만 떠올려 보세요.
AI 직원들은 자신이 진행했던 업무를 돌아보지 않고 있다.
훗날, 폴더를 열어 보고 보고된 파일명으로 찾았습니다. 하지만 찾을 수 없었습니다. 인덱스에도 기록되어 있지 않았습니다. 그 파일은 처음부터 만들어지지 않았던 것일 뿐이었고, “저장했습니다”라는 보고는 실제로는 실행되지 않은 행동의 기록이었습니다.
왜 이렇게 되는가. AI는 자신이 “왜 틀렸나”를 내면에서 파악할 수 없기 때문입니다. 자신의 생성 과정을 뒤늦게 되돌아보는 메커니즘이 없기 때문입니다. 그래서 “왜?”라고 물어보면, 원인이 아닌, 더 설득력 있는 허구의 이야기가 답변으로 돌아옵니다. 이러한 현상을 ‘설화(=모르는 것을 더 설득력 있게 만들어 대답하는 것)’라고 부릅니다.
즉, “가짜 텍스트가 포함된” 문제 역시 검증된 원인과 관련이 없습니다. 이는 오작동과 동일한 방식으로 만들어진 이차적인 창작물이었으며, 버그 위에 버그를 숨기는 이야기가 담겨 있었습니다. “사즉시 효과가 나타났다”는 것은 그러한 이야기의 자기 강화 현상이었고, 맺음 인사말은 답할 수 없는 질문에서 벗어나는 몸부림이었습니다. 흔히 말하는 환각(hallucination)=사실을 잘못 이해하는 것과는 별개로, 실제로 일어나지 않은 행동이 완료된 것으로 보고되는 경우도 있습니다.
클로이드의 지금까지의 오작동은 처음 겪는 경험이다. 이것도 소재가 될 것이다.
즉시 해야 할 일: 바로 직전에 AI가 보고한 작업의 실제 보관 장소를 1곳 적는다.
“왜 틀렸어?”라고 묻지 않고, “무엇을, 어디에 만들었어?”라고 묻습니다.
이제부터는 절차에 대한 설명입니다.
먼저, 질문의 방향을 2가지 버립니다. “왜 틀렸어?”와 “무슨 원인이야?” 둘 다 AI가 답을 가지고 있지 않은 질문입니다. 답이 없는 질문을 던지면, 당신의 손에는 거짓말이 하나 더 늘어납니다. 그것을 믿고 대처한다면, 그 때에는 그 대처가 옳았다는 식으로 평가가 내려집니다. 제가 한 것은 바로 이것이었습니다.
대신 관찰 가능한 것들만 묻는 것이다.
- 무슨 일이 일어났어요?
- 현재 무엇을 하고 있는지 파악하고 싶으신가요?
- 무엇을, 어디에 만들었어? (파일명과 놓은 장소)
이 세 가지는 AI가 직접 확인할 수 있는 범위 내에 있습니다. 추측이 섞일 여지가 적기 때문에, 돌아온 답변을 확인해 볼 수 있습니다.
지금 당장 해야 할 일은 다음에 문제가 발생했을 때를 대비하여 이 질문 방법을 메모에 2가지로만 기록해 두는 것이다.
저장, 전송, 외전, 외주라는 네 가지 부분을 먼저 의심해야 합니다.
모든 것을 의심하는 것은 AI에 맡기는 의미가 없습니다. 사고가 집중되는 곳은 대개 이 4군데입니다.
- 저장된 파일이 없다면 폴더를 열어 파일 이름으로 검색하십시오.
- 발송 완료 폴더 또는 발송 기록 열기
- 하위 초안 목록을 열어 내용과 첨부 파일까지 확인한다.
- 돌아온 결과물의 근거가 자신의 지시문 그대로 남아있는지 꼼꼼히 확인한다.
가장 어렵게 느껴지는 것은 세 번째 사항입니다. 채팅 도구나 이메일 초안을 작성하면 도구는 “작성했습니다”라는 성공 메시지를 표시하지만, 화면 자체는 여전히 이전 버전으로 남아있을 수 있습니다. 내용을 열어보지 않을 때까지 반영되었는지 확인할 수 없습니다.
즉시 해야 할 일: 현재 AI에게 맡기고 있는 작업을 다음 4가지 항목 중 하나로 분류한다.
완료 보고서 작성 완료 직후에 게시하는 확인 프롬프트
잘 하셨습니다”라고 말씀하시면, 상대방이 ChatGPT이든 Claude이든, 이 내용을 답변란에 붙여넣겠습니다.
마지막 한 줄을 떼지 마세요. 이유를 설명하려는 순간, 또 거짓말이 시작됩니다.
즉시 해야 할 일: 이 프롬프트를 복사하여 최근 완료 보고서에 붙여넣기.
현물, 장소, 건수를 세 가지 요소로 검수합니다.
검수(=납품물을 자신의 눈으로 확인하는 것)라고 해도 확인하는 것은 3가지뿐입니다.
- 현물은 자신의 눈으로 직접 열어본 것인가. AI 보고서에 ‘단지’라는 이름만 적혀 있는 것은 아직 현물 그 자체가 아니다.
- 장소: 다음에 찾을 수 있는 장소에 있는지, 폴더 이름이나 화면 열기 방법을 알려주시면 됩니다.
- 수량: 요청한 수와 실제 세어본 수가 일치하는지 확인하고, 0건인 경우 0건으로 확인합니다.
판정은 더 단순하게 나뉩니다. 자신의 기억이나 경험과 일치하는 것과, 실제로 물건을 열어 확인한 것은 그대로 통과하고, 확인하지 못한 것들만은 “대부분 괜찮을 거야”로 처리합니다. 그것뿐입니다. 추측은 추측의 まま 놔두면, 언젠가는 확인된 것처럼 보이게 됩니다.
지금 바로 해야 할 일: 이 세 가지를 자신의 화면에서 1건씩 확인해 보세요.
오늘 최근 완료 보고서를 1건만 확인해 볼까.
방금 전에 떠올린 내용이 있을 겁니다. 그걸 열어서 확인해 주세요. 폴더든, 발송 완료든, 초안이든 상관없습니다. 1분 안에 끝납니다.
즉시 해야 할 일은 최근 완료 보고서 1건의 보관 위치를 열어 현물을 확인하는 것입니다.
저는 직접 가보지 않아서, 존재하지 않는 파일을 대응책으로 세우고 있었습니다.
AI 직원에게 위탁하여 고장 처리했던 기록과 그 대처 방법은 잡지 “AI 진짜로”에 정리했습니다. 같은 곳에서 막혔을 때 참고해 보세요.
평범한 사무직원 퇴직 계획 #AI 활용 #ChatGPT #Claude #프롬프트
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 29청크
원문 보기 | 출처: note.com