클로이드 옵스 5.5가 나온 이후로, X의 타임라인에 애니메이션이 갑자기 늘어났다.
Anthropic 공식도 “초기 시제품”들을 스레드에서 나열했다. 수박이 주연인 단편, 아폴로 8호가 지구의 모습을 담은 순간을 재현한 작품이다. 개인 작품 예시도 많았다. “컴퓨터에 5분 동안 이야기했더니, Claude가 12시간 일하고, 아침에 이것을 완성했다”라는 캡션이 달린 영상에는 약 1,700개의 ‘좋아요’가 달렸다.
모두 “한 방으로 만들어졌다”라고 적혀 있다. 정말 그런 걸까. 내가 직접 해 보았다.
결론적으로 “한 번의 노력”으로 해결되지는 않았습니다. 다만, 예상했던 곳이 아니어서 시간과 노력이 소요되었습니다.
여기 X 동영상을 삽입합니다: 아래 “X 동영상 URL”을 복사하여 붙여넣고 Enter를 누르세요.
무엇을 만들었습니까?
제작된 것은 20초 분량의 세로형 영상이다.
평가기관 인공 분석에서 9월 24일에 발표한 모델 비교 결과는 다음과 같았다. 상위 모델인 Opus 5.5(가장 높은 사고량)는 지능 지수가 58점이었고, 1 작업당 5.98달러(1달러 159엔 환산 시 약 950엔)의 비용이 발생했다. OpenAI의 GPT-6 Luna(동일)는 37점으로, 0.068달러(약 11엔)였다.
지능이 약 1.6배나 높아졌지만, 비용은 약 88배나 차이 난다. 이 차이를 20초 안에 체험할 수 있는 영상을 만들고 싶었다.
사용한 것은 Claude Code상의 Opus 5.5 모델 하나뿐입니다. 영상 생성 AI는 사용하지 않았습니다. Claude가 프로그램으로 1コマ씩 그림을 그리고, 이를 영상 파일로 만드는 방식입니다. 현재 출시되고 있는 샘플 영상 대부분도 이 “코드 기반으로 그리는” 방식입니다.
먼저 조사한 성공적인 사람들의 공통점
만들기 전에, 예시와 설명을 꼼꼼히 검토했다. 성공한 사람들의 방법에는 공통점이 5가지 있었다.
대본과 밑그림은 클로드에게 맡기고 있으며, 전달되는 것은 오직 주제와 조건뿐이다. “밑그림을 먼저 작성하고 나서 제작해달라”는 식으로 진행되는 경우가 많다.
첫 번째 결과는 평범했고, 다음 세 가지 조건을 더하여 다시 제작하고 있습니다. 해외 음악 영상 제작 크리에이터들은 첫 번째 결과가 “꽤 평범했다”고 언급했습니다.
- 문자는 최소화한다 (클로드는 건물이나 화면에 의미 없는 글자를 덧붙이는 습관이 있다).
- 어떤 장면에도 눈에 띄는 움직임을 하나라도 넣어주세요. 그렇지 않으면 캐릭터가 화면에 나와 춤만 추는 것처럼 될 수 있습니다.
- 장면 전환을 부드럽게 일치시킨다
피하고 싶은 외형은 다음과 같이 구체적으로 나열한다. 이는 Anthropic 공식 가이드에 나오는 내용이다. “AI 같은 모습을 피해서”라고 쓰면 또 다른 흔한 외형으로 대체될 뿐이다. 피하고 싶은 패턴을 구체적으로 적고 결과물을 목록에 추가해 나간다.
4. 사양은 숫자로 명시합니다. 해상도, 시간(초), 색상 수, 등장하는 대상의 수를 의미합니다. 숫자는 형용사보다 더 효과적입니다.
5. 긴 작업은 위임할 수 있습니다. 다만, 작업 목록을 파일에 보관하고 중간에 “보고를 중단하는” 상황을 방지하기 위해 지시를 추가합니다.
클로이드 코드 개발팀 멤버들은 X에서 “한 번에 만들어졌다”는 작품의 프롬프트가 실제로는 1만 자나 되었다고 밝혔습니다. 한 번의 결과 뒤에는 긴 지시서가 있었던 것입니다.
실제로 전달한 지시
이 5가지 항목을 모두 포함한 지시서를 클로드 스스로 작성하게 했다. 내용은 약 2,800자 분량의 영어 원문이다. 내용은 다음과 같은 구성으로 되어 있다.
- 만들기: 20초 분량의 1080×1920 해상도, 30fps 설명 애니메이션을 코드만으로 제작
- 사실: 4개의 모델 점수와 1개의 작업 비용만 사용하고 나머지는 만들지 않는다.
- 제안 사항: 그림 콘테, 템포, 외모, 카메라 워크
- 규칙: 문자는 최소화하고 / 각 장면마다 움직임을 추가하며 / 연결성을 유지하고 / 네온, 보라색 그라데이션, 유리 조각 효과가 있는 카드, AI와 유사한 뇌 이미지 등은 사용하지 않습니다.
- 자기 점검: 1초 1프레임의 이미지 목록(접촉 시트)을 만들어 스스로 확인하고, 결점을 파악하여 수정한다. 이 과정을 2회 이상 반복한다.
- 환경: 추가적인 소프트웨어는 설치하지 않습니다. Chrome과 ffmpeg(비디오 변환 소프트)만 사용하여 직접 내보냅니다.
지시서에서 고정된 것은 주제, 숫자, 환경뿐입니다. 대본과 그림은 맡겼습니다.
덧붙여 이 지시서를 작성하고 실행한 것도 모두 같은 클로드와의 대화 속에서 이루어진 것입니다. 조사한 내용을 인지한 상태로 만들어졌기 때문에 “백지 상태의 클로드에게 1장의 지시서를 건넨” 실험과 다른 점을 분명히 밝힙니다.
첫 번째 시도에서 7분 만에 정확한 그래프가 완성되었습니다.
클루드(Claude)는 먼저 5개의 장면 콘티를 작성했다. 색상 구성은 직접 결정했으며, 종이처럼 보이는 기본 색상에 묵색, Opus는 진홍색, Luna는 깊은 청록색을 사용했다.
그로부터 본체 프로그램(약 290줄)과 출력용 스크립트(약 100줄)를 작성했다. 600コマ의 출력을 한 번에 약 8초가 소요되었다.
흥미로웠던 부분은 여기서부터였어. 클루드는 자신이 작성한 영상 목록 이미지를 직접 보고, 단점을 지적하며 수정했어.
- 첫 번째 단점: 끈이 흩어져 선 찌꺼기처럼 흩뿌려져 보이고 / 마지막 3초가 멈춰있는 상태 / 가로형 화면의 밑 절반이 비어있다.
- 두 번째 단점: 마지막으로 화면을 확대하는 연출에서 숫자가 오른쪽 끝까지 밀려 나와 강조 링이 다른 요소와 겹쳐 혼잡하게 됨.
3번 촬영했으며(수정은 2번 함), 숫자는 모두 정확하고, 여백도 흐르지 않는 영상이 되었다. 총 7분 정도 소요되었으며, 사람의 수정 지시가 0회이다.
그 순간, 깨달았다. 맞다. 그런데도, 굉장하지 않은가.
사람 한 마디로 만들어진
그러게, 클루드에게 한마디 말했다.
정신이 오싹하지 않고, 강약의 대비를 강조하고 그래프뿐만 아니라 애니메이션이나 인물까지 활용하여 단순히 잘 만든 것을 넘어 정말 굉장한 것을 만들어내는 데까지 이어갈 수 있기를 바란다.
클루드(Claude)는 스토리보드(絵コンテ)를 수정하여 다시 작성했다. 제시된 아이디어는 다음과 같다.
- 오퍼스와 루나는 눈과 발이 있는 콩 모양 캐릭터로 제작하기로 했다.
- 지혜는 높이뛰기 대회 바에서 보이는 높이(58과 37)처럼 드러나는 것이다.
- 비용은 하늘에서 떨어지는 가격표로 제시된다. Opus에는 5.98달러의 가격표가 뚝 떨어졌고, Luna에는 0.068달러의 가격표가 흩날리며 내려온다.
- 고비는 “같은 5.98달러”로 루나가 1→2→4→8… 식으로 분열하여 88체로 화면을 가득 채우는 장면이었다.
- 때가 튀어 떨어지는 착지, 화면 흔들림, 일순간의 흰 빛으로 강약 조절
데이터는 하나도 변하지 않았습니다. 같은 숫자를 표시하는 방식만 바꾼 것뿐이어서 완전히 다른 결과물이 되었습니다. 재작업에 걸린 시간은 약 9분입니다.
눈으로는 보지 못하는 결점을 기계가 찾아냈다.
캐릭터 버전에서도 클루디는 동일하게 목록 이미지를 보면서 수정했다. 착지한 캐릭터들이 부딪히거나, 카드 글자가 겹치는 등의 단점이다.
그 외에도 총 600コマ를 기계로 점검받았으며, 화면의 가장자리에 몇 픽셀의 여백이 있는지, 1초 이상 정지된 구간이 없는지 각 コマ마다 측정했다.
이것은 제가 놓친 결점 세 가지를 발견한 것입니다.
- 떨어지는 값札이 흔들리면서 흔들림의 폭만큼 오른쪽 끝에서 벗어난다 (4.7초).
- 점프 직전, 구부린 캐릭터의 팔이 왼쪽 끝에 닿았다 (1.4초).
- 크게 튀어나간 다음 줄어드는 제목이 1컷에서 왼쪽으로 튀어나와 있습니다 (6.3초).
모든 것은 한순간일 뿐이다. 1초에 1コマ의 목록 이미지에서는 그 순간이 우연히 포착되지 않는다. 눈으로 확인하고 기계로 측정하는 확인에서는 서로 다른 결함이 발견되었다.
알아낸 것
“한 번에 만들어내는” 것은 보여주는 문제였다. 실제로는 조사하고, 지시서를 작성하고, 만들고, 보고 수정하는 등의 과정을 거쳤다. 단, 그 과정의 대부분을 클로드(Claude)가 스스로 수행했으며, 사람이 한 것은 주제를 선택하고 한 마디 대답하는 것뿐이었다.
AI가 결점을 보완하고, 사람은 훌륭함을 더한다. Claude의 자가 검토는 중복이나 겹침을 제거하는 데 강점을 보였지만, 반면 “더 놀라운” 결과를 만들어내는 방향에는 스스로 나아가지 않았다. 그래프 형태 그대로 “완성”이라고 말했다. 훌륭함의 기준을 제시한 것은 사람 한 사람의 한 마디였다.
확인은 눈과 기계를 모두 사용하여 진행하며, 목록 이미지로 전체 흐름을 확인하고 기계로 모든 프레임의 끝과 정지를 측정합니다. 눈과 기계 중 하나만으로는 허점이 발생합니다.
바로 쓸 수 있는 템플릿
직접 시도해 보십시오. 지침서에 다음 여섯 가지를 포함해 두시기 바랍니다.
- 제시하고자 하는 것(시간, 가로, 세로, 페이지 수)과 사용 가능한 사실만을 제시합니다. 사실은 만들어내지 않습니다.
- 스케치(絵コンテ)는 먼저 작성하게 합니다. 대본과 겉모습은 맡깁니다.
- 문자는 최소화하고, 모든 장면에는 움직임이 있어야 하며, 연결을 맞춰야 합니다.
- 피하고 싶은 외모를 구체적으로 나열한다.
- 1초 1コマ의 모든 이미지 목록을 만들게 하고, 직접 보고 수정하는 과정을 (2회 이상) 반복한다.
- 마무리 단계에서 모든 페이지의 기계 검사(여백 및 정지 구간)를 실시했습니다.
맞는 말이지만 정말 대단하지 않으세요?는 사람만이 할 수 있는 말이다.
이 검증에 대해
이 글은 Claude Code(Opus 5.5, 사고량 설정은 xhigh)를 사용하여 실제로 제작한 기록을 바탕으로 작성되었습니다. 사용한 자료는 작업 로그, 각 버전의 목록 이미지, 텍스트로 추출한 영상, 검토 결과입니다. 소요 시간은 작업 로그의 실측으로, 그래프 버전은 약 7분, 캐릭터 버전은 약 9분입니다(대기 시간은 제외). 비용은 구독 범위 내에서 발생했으며, 개별 요금은 발생하지 않았습니다. 문장 작성에도 Claude를 사용하고 있습니다.
검토한 사례 중 “12시간 근무했다” 등의 주장은 게시자의 설명에 불과하며, 재현을 시도하지 않았습니다.
다음으로 읽는 AI가 만든 것을 어디까지·어떻게 확실하게 평가할 것인지, 이번에는 “기계의 체크가 눈사고를 픽업했다”는 이야기의 그 다음 기록이다.
정보의 홍수는 멈추지 않는다. 증류도 멈추지 않는다. 스키는 다음 주에 연료가 되며, 유료 매거진 ‘AI 증류소’가 심화된다.
AI, 생성 AI, 클로드, 클로드코드, AI 활용
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 61청크
원문 보기 | 출처: note.com