안녕하세요, 후지입니다.
이 노트에서는 해외 AI 트렌드와 최신 정보 등 차세대 기술을 주제로 다루고 있습니다.
오퍼스 5.5 × GPT 이미지 2.5 × 젬미니 3.8 플래시 TTS를 결합하여 촬영 0부터 소재 0에서 단편 영상 제작 시스템을 구축하게 되었습니다.
- 짧은 동영상을 찍고 싶지만, 매번 촬영하는 게 너무 힘들어요.
- 긴 길이의 컷팅은 짧은 컷으로는 템포가 좋지 않다.
- AI로 영상을 제작하면, 모두 비슷한 결과물이 나옵니다.
이런 고민을 가지고 있는 분들이 많지 않을까요. 저 또한 그렇게 생각했습니다.
오늘은 Gemini 3.8 Flash TTS의 보이스 클론을 사용하여 짧은 영상을 AI에게 완벽하게 제작하도록 하는 시스템에 대해 설명하겠습니다.
오사카 오프에서 느꼈던 현실의 가치
본론에 들어가기 전에 잠시 상황을 말씀드리겠습니다. 이번 주말에는 2일 동안 오사카에 다녀왔습니다.
오늘 토요일에는 현재 협업하고 있는 서비스의 오프라인 모임이 있었습니다. Zoom이나 온라인으로만 만났던 많은 분들과 직접 대화할 수 있었던 것은 정말 좋았습니다. 특히 영상 편집 업계의 분들도 제 콘텐츠를 보시고 계시는 것 같아 감사드립니다.
나에게는 도달할 수 없는 영역이 분명히 존재합니다. 그 부분은 협력하면서, 제가 할 수 있는 일은 최선을 다해 해나갈 것입니다. 이러한 자세는 앞으로도 계속 이어가고 싶습니다.
최근 일주일 동안 도쿄, 나고야, 가나자와, 오사카를 거쳐 쉴 새 없이 일정을 소화했지만, 이상하게 피곤하지 않네요. 다양한 분들과 이야기를 나누면서 에너지를 얻은 것이 큰 도움이 되었습니다.
AI 시대이기 때문에 현실적인 만남의 가치는 오히려 높아지고 있다. 올해 들어 오프라인 모임이나 실제 행사에 적극적으로 참여하면서 이러한 방식이 틀렸다는 확신을 얻었다.
오퍼스 5.5의 디자인 감각이 훌륭하다.
자, 이제부터 본격적으로 다루겠습니다. 금요일까지 상당히 많은 부분을 검증했기 때문에, 그 내용을 설명하겠습니다.
최근 X(엑스)에서 유행한 것이 해외에서 화제가 되고 있는 Opus 5.5로 모션 그래픽을 디자인하는 프롬프트입니다. 놀라울 정도로 짧은 프롬프트인데, 실제로 실행해보면 “와, 이렇게 결과물이 나오는 건가요?” 하는 수준의 결과물이 만들어집니다.
이 프롬프트 정말 훌륭하다. 한 방에 이렇게 결과가 나왔다. 프롬프트는 아래에 있다 👇 https://t.co/9fqiqR4Etm
실제로 시켜보신 분들이 많지 않으실까요? 간단한 프롬프트로도 이렇게 놀라운 결과물이 나온다는 것은 Opus 5.5의 잠재력이 그만큼 높다는 것을 의미합니다.
멋진 것을 만드는 능력은 이미 가지고 있습니다. 남은 것은 단순히 세세한 부분을 어떻게 표현하고 전달할지를 결정하는 것뿐입니다. 디자인 감각이 뛰어난 AI인데다가 비용도 엄청나게 저렴한 것이, 바로 이것이 이번 Opus 5.5의 놀라움입니다.
영상 편집은 Opus 5.5로 거의 수정이 필요 없는 수준입니다.
저 역시 영상 관련하여 상당한 수준의 검증을 진행하고 있지만, 저의 발신 내용에 대해서는 영상 편집은 Opus 5.5를 전부 담당할 수 있습니다. 충분히 가능하며, 퀄리티가 매우 높습니다.
수정 작업을 여러 번 거듭하여 거의 수정이 필요 없는 수준까지 끌어올렸습니다. 그래서 제가 할 일은 촬영하고 자료를 투입하는 것뿐입니다. 그 외에 “편집해 줘”라고 하면 시스템이 전부 움직여서 마무리해 줍니다.
그럼에도 불구하고, 이렇게까지 오기까지는 여러 번의 교환이 있었습니다.
효과음의 불일치는 명확하게 전달하면 바로 수정될 수 있다.
첫 시도에 나오는 것은 “어느 정도 괜찮은 느낌”인데, 세세한 부분에서 어긋나는 경우가 있습니다. 예를 들어 효과음의 경우죠.
효과음은 음에 따라 가장 큰 임팩트가 오는 위치가 다릅니다. 클립의 머리에 오는 것, 가운데 오는 것, 마지막 부분에 오는 것을 제대로 인식하고 배치시키는 데 어려움을 겪었습니다. “여기 삐뚤어져서 고쳐줘”라고 말해도 전혀 귀 기울여 주지 않으셨습니다.
그러다가 틀린 부분을 전부 다 짚어내어 “여기랑, 여기랑, 여기가 안 맞는 거예요”라고 정확하게 알려드렸습니다. 그러면 전부 꼼꼼하게 맞춰주셨습니다.
그러므로, 수정 능력은 충분히 있습니다. 다만, 스스로 오류를 발견하는 능력이 아직 조금 부족한 것입니다. 음향 부분은 여전히 강점 분야가 아닐 수도 있습니다.
Fable 5.5를 기다리는 것이 과연 의미가 있을까요? 최근 Fable 5 업데이트에 대한 논의가 있었고, 많은 사람들이 5.5 버전 출시 전까지 기다리는 것이 과연 가치가 있는지 궁금해하고 있습니다. 5.5 버전은 게임의 핵심적인 개선 사항과 새로운 콘텐츠를 제공할 것으로 예상되지만, 현재까지 공개된 정보가 제한적이어서 기다리는 것이 낭비될 수 있다는 우려도 있습니다. 따라서 Fable 5.5를 기다릴지, 현재 버전으로 게임을 즐길지는 개인의 판단에 달려 있습니다. 하지만 5.5 버전이 출시되면 게임의 재미를 더욱 높일 수 있을 것이라는 기대감을 가지고 기다리는 것도 좋은 선택이 될 수 있습니다.
파벨 5.5가 출시되면 이 지역은 더 좋아질 거라고 생각합니다. 다만, Opus 5.5의 수준에서 이미 이렇게 많은 결과물이 만들어진다면, 최초의 시스템만 구축해 버린다면 Opus로 충분하다고 생각합니다.
대량 생산을 전제로 한다면 Fable과 Opus 사이에 그렇게 큰 차이는 없을 것입니다. “다소 Fable이 더 좋지?” 정도의 차이 정도로 개선될 거라고 생각되지만, 그렇게 높은 수준의 완성도를 끌어올리는 것이 정말 필요한지에 대한 논의가 이어질 것입니다.
영상 편집은 토큰 소비량이 매우 큽니다. 그래서 비용을 절감하면서 얼마나 많은 콘텐츠를 생성할 수 있는지가 중요해집니다. 그 의미에서 Opus 5.5는 영상 편집에 매우 적합한 모델이라고 생각합니다.
짧은 동영상은 다시 촬영하는 것보다 “처음부터 제작하도록 하는” 것이 더 효과적입니다.
그리고 여기서 오늘 이야기의 핵심입니다. 짧은 영상도 AI가 만들어줬는데, 이게 놀랍게도 잘 나가고 있습니다. 실제로 약간의 성장도 보이고 있습니다.
제 팟캐스트와 유튜브 채널은 같은 주제라도 카메라 앞에서 처음부터 다시 녹화합니다. 게다가 둘 다 대본이 없습니다. 주제만 정하고, 나머지는 당일에 이야기합니다.
만약 이것을 짧게 수평으로 펼칠 수 있다면 가장 좋겠지만, 쇼트는 더욱 촘촘하게 압축해야 합니다. 쇼트 자체로 처음부터 제작하는 것이 더 나은 결론이 나왔습니다.
단순히 짧은 영상용 대본을 제작하고, 녹음하고, 편집하는 시스템은 이미 존재하지만, 솔직히 말씀드리면 번거로운 일입니다. 유튜브와 팟캐스트에 더해 녹음이 추가되는 것은 상당히 어렵습니다.
이걸 전부 AI로 할 수 있을지 여러 가지를 검증해 보던 중, Opus 5.5와 조합했을 때 답이 나타났습니다.
Opus 5.5 × GPT Image 2.5 × 3.8 TTS 단편 영상 제작 시스템 제작 방법: 영상 생성 AI 및 성우 불필요. 게다가 비용이 매우 저렴하다. 제작 과정 워크플로우는 다음과 같다 👇 ①Opus 5.5에 리서치를 시키고 ②대본을 작성하게 하고 ③Gemini 3.8 Flash TTS로 음성 클론 생성 ④대본을 바탕으로 TTSs로 음성화 ⑤GPT Image… pic.twitter.com/BeUdJMGTwB— Fujin🌪AI 자동화의 사람 (@Fujin_Metaverse) 2026년 9월 26일
현재 사용하고 있는 것은 Opus 5.5, GPT Image 2.5, Gemini 3.8, Flash TTS입니다.
사용하고 있는 도구는 3가지입니다.
- 오퍼스 5.5 대본 제작, 영상 편집 및 전체 제어
- GPT 이미지 2.5 그림 해설 및 시각 생성에 대한 내용입니다.
GPT 이미지 2.5는 이미지 생성 모델의 작동 방식을 시각적으로 설명하는 자료입니다. 특히, 이미지 생성 과정에서 사용되는 다양한 기술과 개념을 그림과 함께 쉽게 이해할 수 있도록 구성되어 있습니다.
본 자료는 다음과 같은 내용을 다룹니다.
* **이미지 생성 모델의 기본 구조:** 텍스트 프롬프트를 입력받아 이미지를 생성하는 과정에서 사용되는 주요 구성 요소들을 설명합니다.
* **VAE(Variational Autoencoder)와 GAN(Generative Adversarial Network)의 비교:** 이미지 생성 모델의 두 가지 주요 아키텍처인 VAE와 GAN의 차이점을 그림을 통해 비교하고, 각 모델의 특징과 장단점을 설명합니다.
* **이미지 생성 과정의 단계별 시각화:** 텍스트 프롬프트가 이미지로 변환되는 과정을 단계별로 시각화하여 보여줍니다. 각 단계에서 사용되는 기술과 알고리즘을 간략하게 설명합니다.
* **이미지 생성 모델의 활용 사례:** GPT 이미지 2.5를 활용하여 다양한 분야에서 이미지를 생성하는 사례들을 소개합니다. 예를 들어, 광고, 디자인, 예술 등 다양한 분야에서 GPT 이미지 2.5가 어떻게 활용될 수 있는지 보여줍니다.
이 자료는 이미지 생성 모델에 대한 이해를 높이고, 실제 이미지 생성 프로젝트에 활용하는 데 도움이 될 것입니다. 특히, 기술적인 배경 지식이 부족한 사람들도 쉽게 이해할 수 있도록 그림과 함께 설명되어 있습니다.
- Gemini 3.8 Flash TTS 타본의 음성화(보이스 클론)
이 중에서 최근에 나온 것이 Gemini 3.8 Flash TTS입니다. 최근에 나온 음성 변환 AI인데, 상당히 괜찮습니다. 3.8 Flash에서 보이스 클론을 만들 수 있게 되었거든요. 아마 그 이전에는できなかった 것으로 보입니다.
그럼에도 불구하고 제 목소리를 만들어 보았습니다.
## Gemini 3.8 Flash TTS로 보이스 클론 만들기 절차
**1. 준비물**
* Gemini 3.8 Flash TTS (유료)
* AI 보이스 클론 생성 서비스 (예: MurAI, Voiced.ai 등)
* 생성할 목소리의 음성 데이터 (최소 30초 이상, 고품질 권장)
**2. Gemini 3.8 Flash TTS 설정**
1. Gemini 3.8 Flash TTS를 실행하고, 원하는 목소리 모델을 선택합니다. (다양한 목소리 모델이 제공됩니다.)
2. 음성 데이터를 Gemini 3.8 Flash TTS에 업로드합니다.
3. 업로드된 음성 데이터를 기반으로 Gemini 3.8 Flash TTS가 목소리 모델을 학습합니다. (학습 시간은 데이터 양에 따라 달라집니다.)
**3. AI 보이스 클론 생성 서비스 활용**
1. AI 보이스 클론 생성 서비스에 가입하고 로그인합니다.
2. 서비스에서 제공하는 지침에 따라 Gemini 3.8 Flash TTS에서 학습된 목소리 모델을 가져옵니다.
3. 가져온 목소리 모델을 기반으로 텍스트를 입력하면, 해당 목소리로 텍스트를 읽어주는 보이스 클론이 생성됩니다.
4. 생성된 보이스 클론의 음성을 필요에 따라 편집하거나, 다양한 방식으로 활용합니다.
**4. 추가 팁**
* 음성 데이터의 품질이 보이스 클론의 품질에 큰 영향을 미치므로, 고품질의 음성 데이터를 확보하는 것이 중요합니다.
* Gemini 3.8 Flash TTS와 AI 보이스 클론 생성 서비스의 사용법을 충분히 숙지하고, 다양한 설정을 실험하여 최적의 결과를 얻도록 노력하십시오.
* 보이스 클론을 생성하는 데 필요한 비용을 고려하여, 적절한 서비스를 선택하십시오.
**참고:** 본 절차는 예시이며, AI 보이스 클론 생성 서비스의 기능 및 사용법에 따라 다소 차이가 있을 수 있습니다. 각 서비스의 공식 문서를 참고하여 정확한 절차를 확인하십시오.
만드는 방법은 간단합니다.
1단계: Google AI Studio를 엽니다.
단계 ②에서 모델 목록에서 Gemini 3.8 Flash TTS를 선택합니다.
3단계: 새로운 음성을 만드는 모드로 들어가 표시되는 영어 문장을 직접 읽어 들여 녹음합니다.
이렇게 녹음된 음성을 바탕으로 보이스가 제작됩니다.
정확도는 “거의 맞지만 약간 다른” 수준입니다.
실제로 만들어 보았는데, 제 목소리와 완전히 일치하지는 않았습니다. 거의 비슷했지만, 어느 정도 ‘보통’ 수준이었습니다. 영어로 녹음하고 있어서 그런 건지는 확실하지 않습니다. 일본 모드는 아마 없을 겁니다.
솔직히 보이스 클론의 정확성만 놓고 보면 다른 서비스들이 더 나을 것 같습니다. 하지만 Gemini 3.8 Flash TTS가 좋은 이유는 표현력이 높다고 평가받는다는 점입니다.
굳이 자신의 보이스 클론을 만들어 보지 않아도 처음부터 제공되는 목소리 종류 중에서 선택하는 것으로도 충분합니다. 하지만 한 번쯤 자신의 목소리를 만들어 보는 것은 재미있을 것 같습니다.
자료가 없는 상태에서 영상을 만드는 과정
먼저, 영상의 콘셉트를 명확하게 해야 합니다. 어떤 영상을 만들고 싶은지, 타겟층은 누구인지, 전달하고 싶은 메시지는 무엇인지 구체적으로 정의하는 것이 중요합니다.
다음으로, 필요한 자료를 모읍니다. 영상 자료, 음악, 효과음, 자막 등 영상에 필요한 요소를 목록으로 정리하고 각각을 준비합니다. 자료의 저작권에 충분히 주의하고 이용 약관을 확인하도록 합니다.
자료가 모이게 되면, 영상 편집 소프트웨어로 영상을 만듭니다. 영상 편집 소프트웨어에는 다양한 기능이 탑재되어 있어, 자료의 컷, 자막의 삽입, 음악의 추가, 효과의 적용 등 영상을 편집하기 위한 다양한 조작이 가능합니다.
영상 구성에 대해서는, 스토리를 의식하는 것이 중요합니다. 발단, 전개, 위기, 결말을 의식하고 시청자의 흥미를 유발하여 끝까지 볼 수 있도록 구성하는 것이 좋습니다.
영상 길이는, 콘텐츠의 내용에 따라 다르지만, 일반적으로 3분에서 5분 정도가 적합합니다. 너무 길면 시청자의 집중력이 끊어질 수 있으므로, 핵심을 絞어서 간결하게 요약하는 것이 중요합니다.
영상을 완성したら, 반드시 프리뷰에서 확인하고, 문제가 없는지 체크합니다. 색상, 음량, 자막의 표시 등 세부 사항까지 확인함으로써, 더욱 완성도 높은 영상을 만들 수 있습니다.
마지막으로, 영상을 업로드할 때는, 적절한 제목, 설명문, 태그를 설정합니다. 제목은, 영상의 내용을 간결하게 나타내는 것으로, 검색되기 쉬운 키워드를 포함하는 것이 중요합니다. 설명문은, 영상의 내용을 자세하게 설명하고, 시청자에게 영상을 보여주도록 유도하는 내용을 담는 것이 좋습니다. 태그는, 영상의 분류에 사용되며, 검색 결과에 표시될 때 도움이 됩니다.
뒷면에서 진행하고 있는 일들을 정리하면 다음과 같습니다.
- 오퍼스 5.5가 대본을 제작한다.
- Gemini 3.8 Flash TTS가 클론 보이스로 읽어줍니다.
- 음성 및 대본이 준비되면 Opus 5.5가 편집에 착수할 것입니다.
핵심은 원본 영상 자료가 전혀 없다는 점입니다. 따라서 영상은 전부 AI에게 처음부터 제작해 달라고 요청하고 있습니다. 그림 설명은 GPT Image 2.5를 활용하여 이해를 돕도록 이미지를 생성하고 있습니다.
저장소에는 제 Obsidian 폴더를 전부 연결해 놨습니다. 오랫동안 축적해 온 메모와 기사들을 바탕으로 대본이 만들어지기 때문에 내용이 얇지 않죠. 리서치도 가능해서 정확도도 상당히 높습니다.
후진의 아이콘을 애니메이션으로 움직였습니다.
또 다른 차별점은 제 캐릭터였습니다. 아이콘에 사용하고 있는 Fujin의 캐릭터, 있죠. 그것을 제대로 캐릭터로서 움직이고 싶었습니다.
다양한 검증 결과를 토대로 애니메이션 형식을 채택하게 되었습니다. 음성과 함께 눈과 입이 움직이며, 여러 종류의 포즈를 준비하여 내용에 따라 포즈가 전환되는 시스템입니다.
유튜브에서는 제 얼굴 부분에 후진의 얼굴을 얹어 놓았습니다. 하지만 짧은 영상으로 그것을 하는 것은 어색하다고 생각했습니다. 몸만 보이는 건, 제 것이 아니어도 괜찮지 않을까요? 그러면 후진의 아이콘을 완전히 움직이고 싶었습니다. 그래서 이번에야 그것이 가능해졌습니다.
솔직히 이렇게 좋은 결과물을 만들 줄은 상상도 못했습니다. 거의 한 번에 “이걸로 충분히 괜찮잖아”라는 결과물이 나왔거든요. 약간의 수정은 가미했지만, 정말 놀랐습니다. 이 짧은 영상은 앞으로 매일 업로드할 예정입니다.
비용은 1분 음성으로 몇 원 수준입니다.
이 정도의 일을 해냈는데, 비용이 거의 들지 않았습니다.
오퍼스 5.5의 토큰 소비는 크게 높지 않으며, GPT 이미지 2.5는 ChatGPT 구독 범위 내에서 생성합니다. Gemini 3.8 Flash TTS는 1분 정도의 음성으로 2~3円 정도입니다. 정말 그 정도 수준이죠.
또한 제 경우에는 Google AI Studio API 크레딧이 20만 엔 정도 남아있고, 내년 2월에서 3월쯤까지 사용할 수 있습니다. 어쩔 수 없이 계속 만들어야겠죠.
지금까지는 외주를 통해 하고 싶었던 일들입니다. 제가 직접 닿을 수 없었던 계층을 위한 콘텐츠 제작을 AI가 스스로 해 くれる 것이죠. 게다가 비용은 거의 들지 않습니다. 돌려놓을 이유가 전혀 없습니다.
영상 강의도 이 시스템으로 만들 수 있습니다.
이 시스템을 활용할 수 있다는 것은, 영상 강의를 훌륭하게 많이 만들 수 있다는 의미입니다.
예를 들어, AI 초보자들을 위해 Claude Code 사용법, Codex 사용법, Opus 5.5가 무엇인지 설명하는 영상들을 충분히 제작할 수 있습니다.
단지 AI에 맡겨서는 아무 의미가 없습니다. 제가 콘텐츠로서 가치 있는 것으로 만들기 위해 무엇을 해야 하는지를 고민한 결과, 이번 형식이 도출되었습니다.
급하게 만들기 정도라면 Opus 5.5에 의존해도 누구나 할 수 있습니다. 거기서 더 나아가 인스타그램, 틱톡, 유튜브 쇼츠에서 실제로 유행하고 있는 콘텐츠 형식으로까지 만들 수 있게 되었기에 퀄리티에는 만족합니다.
완성되는 순간, 정말 “이게 된다고? 믿기지 않아!”라는 생각이 들었습니다. 제 안에서는 꽤 혁명적인 일이었죠. 아직 미세한 부분은 다듬고 싶은 부분이 있지만, 이렇게 한 번에 결과물이 나올 수 있다는 사실에 정말 놀랐습니다. Opus 5.5가 출시되면서, 영상 콘텐츠에 대해서는 거의 무엇이든 할 수 있게 되었습니다.
다음으로 등장할 것은 AI VTuber입니다.
앞으로 일어날 일에 대해선, 저는 Opus 5.5에서 AI VTuber는 절대 가능하다 생각합니다.
예를 들어, Claude의 Max 플랜(200달러)의 1개의 계정을 Opus 5.5 고정으로 돌리고, AI VTuber에게 하루 1시간 스트리밍을 받도록 하는 것입니다. 짧은 형식의 플랫폼도 유튜브의 긴 형식의 영상도 모두 동시에 스트리밍을 받도록 하는 것을 고려하고 있습니다.
게다가 좋은 점은 제가 만든 게임을 할 수 있다는 거예요.
뒷면에서 게임을 플레이하는 것은 Jev에게 맡기고, 이를 실시간으로 중계하는 것은 Opus 5.5입니다. 화면을 보면서 “이렇게 되고 있네”라고 중계하도록 지시합니다. 분명히 가능합니다.
단지, 뒤쪽에서 계속 움직이는 데는 어느 정도의 PC 사양이 필요합니다. 그래서 저는 지금 맥 스튜디오를 기다리는 상태입니다. 이걸로 뒤에서 계속 돌려갈 수 있으니, 진지하게 또 다른 하나를 사도 괜찮을까 생각하고 있습니다.
게임 개발에 대해서는 지난달부터 “11월부터 본격적으로 할 계획”이라고 말씀하셨습니다. 이번 주가 마지막 3일 정도 남았는데, OpenAI의 DevDay가 있습니다. 매년 한 번 대규모 이벤트이기 때문에 여기서 뭔가 발표를 하실 거라고 예상됩니다. 그러면 다른 회사들도 뒤를 따르고 게임 개발도 점점 쉬워질 것입니다. 그 시기가 11월쯤이라고 예상했던 것이 거의 정확히 들어맞고 있습니다. 지금은 게임을 완전히 망쳐놓을 정도로 열심히 만들고 있습니다.
게임을 낼 때는 영상 콘텐츠도 확실히 준비하는 것이 좋다. 영상 생성 AI를 마음껏 사용하는 것도 좋지만, 비용은 낮아졌다고 하지만 여전히 비용이 발생한다. 필요 없는 부분까지 영상 생성 AI에 의존하면 나중에 수정하기 어렵다. 그래서 이번처럼 효율적인 제작 방식을 검증해 왔다. 바탕은 상당히 정돈되어 왔다.
애프터 이펙트를 사용하는 이유
애프터 이펙트는 2D 및 3D 그래픽을 편집하는 데 사용되는 강력한 소프트웨어입니다. 특히 영상 편집 분야에서 그 효용성이 매우 높습니다.
애프터 이펙트를 사용하는 이유는 다음과 같습니다.
* 다양한 기능: 애프터 이펙트는 텍스트 애니메이션, 트랜지션, 효과 등 다양한 기능을 제공하여 영상에 생동감을 더할 수 있습니다.
* 유연성: 애프터 이펙트는 2D 및 3D 그래픽을 모두 지원하여 다양한 영상 제작 스타일에 적합합니다.
* 확장성: 애프터 이펙트는 플러그인 및 템플릿을 통해 기능을 확장할 수 있어, 사용자의 필요에 맞게 맞춤형으로 사용할 수 있습니다.
* 전문가들의 선호: 많은 영상 전문가들이 애프터 이펙트를 사용하여 고품질의 영상을 제작하고 있습니다.
* 학습 자료의 풍부함: 애프터 이펙트를 배우기 위한 다양한 튜토리얼 및 자료들이 온라인에 존재하여, 초보자도 쉽게 접근할 수 있습니다.
애프터 이펙트는 단순한 영상 편집 도구를 넘어, 영상 제작의 창의성을 높여주는 핵심적인 도구라고 할 수 있습니다.
덧붙여서, 제 짧은 영상 편집에는 애프터 이펙트를 사용하고 있습니다.
이유는 간단합니다. 작성 시작이 빠르고, 나중에 수정하기도 용이하기 때문입니다. Adobe 소프트웨어를 전혀 사용하지 않고도 할 수 있는 방법이 있기 때문에, 어떤 접근 방식을 선택할지는 상황에 따라 달라집니다. 자신의 목적에 맞는 방법을 선택하는 것이 가장 좋을 것 같습니다.
다음 달에 AI 영상 편집 교재를 출판합니다.
지난 달부터 “영상 편집 소프트를 만들고 있다”고 말씀하셨지만, 지금になって 제작하신 결과물이 확정되었습니다. AI 영상 편집 교재, AI 영상 편집 완전 공략 로드맵과 같은 형태입니다.
짧은 영상 콘텐츠의 경우 이 방법, 유튜브 긴 형식 영상의 경우 이 방법, 촬영 없이 0부터 유튜브 긴 형식 영상을 만드는 경우 이 방법을 활용하는 것이 좋습니다. 제가 하고 있는 모든 것을 사례별로 상세하게 설명하고, 그 시스템도 제공할 예정입니다.
시스템을 전달받았지만 사용법만 알려주는 경우, “이건 어떻게 커스터마이징해야 하는 걸까요?”라는 질문이 나올 수밖에 없습니다. 자신이 원하는 대로 바꾸고 싶은 때에 어떻게 해야 할지 모르는 것이죠. 그래서 툴은 그대로 사용할 수 있는 것은 당연하지만, “이런 식으로 하고 싶은데 어떻게 접근해야 할까요?”라는 생각이 들 때까지 모든 것을 명확하게 설명해 드립니다.
툴과 학습 콘텐츠를 결합한 형태입니다. 영상 학습 콘텐츠도 포함하여 다음 달에 출시할 예정입니다. 툴을 엄청나게 만들어 놨기 때문에, 저에게 최적화된 것과 여러분들이 사용하기 편리하도록 특화된 것을 모두 담을 예정입니다. 솔직히 말씀드리면, 상당한 양이 될 것입니다.
기본적으로는 AI로 완결되는 것을 중심으로 하고, 하이레벨 버전으로서 애프터 이펙트를 활용한 영상 제작 방법을 제공할 예정입니다. 기대해 주시기 바랍니다.
앞으로 영상 편집은 인공지능이 전제 조건이 될 것입니다.
앞으로 영상 편집은 인공지능을 사용하지 않으면 상당히 어려울 것입니다.
지금부터 영상 편집을 처음부터 배우는 것은 솔직히 가격 대비 성능이 너무 나쁩니다. AI가 할 수 있는 것은 배우지 않아도 되거든요. 왜냐하면 AI가 할 수 있는 것だから요. 우선 AI로 어떻게 하는지 배우고, 그 위에 올라서 AI가 할 수 없는 부분을 어떻게 보완할지 배우는 것이 정말 중요합니다.
저는 원래 영상 편집이나 영상 제작 분야는 아니었지만, AI 분야를 전공합니다. 그래서 영상 제작 분야 사람들과 접근 방식이 완전히 다릅니다. 하지만 영상과 AI 영상 편집을 모두 할 수 있다면, 만들 수 있는 콘텐츠의 폭은 확실히 넓어질 것입니다.
제가 지금까지 해본 것들 중 가장 잘한 일은 유튜브입니다. X와 팟캐스트도 좋았지만, 유튜브는 역시 강력합니다. 다만, 콘텐츠를 만드는 것이 정말로 힘든 거죠. 이걸 AI로 최대한 쉽게 만드는 방법이 분명히 있을 거라 생각하고, 그것을 검증해 왔고 지금도 실시간으로 검증하고 있습니다.
지금 제작 중인 콘텐츠는 영상 편집 경험이 전무한 분들을 위한 것입니다. 0부터 영상 편집을 배우지 않아도 괜찮습니다. 이 하나만 있으면 AI로 모든 것을 할 수 있습니다. 외주를 줄 필요도, 배우는 필요도 없이 그렇게 활용하고 있습니다. 클라이언트 워크를 하시는 분들을 위해 또 다른 서비스로 제공하고 있습니다.
“해리 포터와 그림자 사자의 서”를 읽은 감상을 몇 가지 소개합니다.
첫째, 이 작품의 주제인 ‘어둠’에 대해 이야기하겠습니다. 어둠은 단순한 악이 아니며, 인간 내면에 잠재된 가능성이나 지식 탐구의 위험성을 상징한다고 생각했습니다. 특히 볼드모트 경의 존재는 인간의 어두운 마음이 자아를 파괴하게 만들 수 있다는 경고로 해석했습니다.
또한, 이 작품의 매력은 마법이라는 판타지 요소에 더해 우정, 용기, 자기 희생과 같은 보편적인 주제가 그려지고 있다는 점입니다. 해리, 론, 헤르미오니의 세 사람의 우정은 어려움에 맞서는 데 큰 힘이 되며 독자에게 용기를 줍니다.
더욱이, 이 작품은 마법 학교라는 배경 설정 속에서 성장해가는 젊은이들의 갈등과 도전을 그리고 있다는 점 또한 훌륭합니다. 마법 훈련과 수업을 통해 그들은 자신의 능력을 갈고닦고 성장합니다. 이 과정은 독자에게 공감하기 쉬운 요소가 되어 작품에 몰입감을 깊게 해줍니다.
특히 볼드모트 경과의 최종 결전은 해리가 자신의 내면의 어둠과 마주하고 승리를 쟁취하는 모습이 감동적이었었습니다. 이 싸움은 단순한 마법의 싸움이 아니라 인간으로서의 성장과 결의를 보여주는 것이라고 느꼈습니다.
“해리 포터와 그림자 사자의 서”는 읽고 난 후에도 그 세계관에 깊이 빠져들게 하고 깊이 생각하게 만드는 작품입니다. 이 작품을 통해 어둠과 마주하고 자신 안의 빛을 찾는 것이 얼마나 중요한지를 배울 수 있을 것입니다.
- 오퍼스 5.5는 영상 편집뿐 아니라 디자인 작업도 가능한, 가격 대비 성능이 뛰어난 모델입니다.
- 효과음 지연 등의 문제점을 명확히 지적하면 즉시 수정해 주신다.
- Gemini 3.8 Flash TTS는 Google AI Studio에서 보이스 클론을 생성할 수 있습니다.
- Opus 5.5 x GPT 이미지 2.5 x Gemini 3.8 Flash TTS로 촬영한 0초 쇼트 영상이 제작 가능하다.
- 후진의 캐릭터는 애니메이션 형식으로 눈, 입, 포즈를 움직이고 있다.
- 음성 비용은 1분당 수십 엔 정도입니다.
- 다음으로 AI VTuber를 하고, 그리고 다음 달에는 AI 영상 편집 교재를 출판할 예정입니다.
촬영하지 않아도, 자료가 없어도 AI로 짧은 영상은 만들 수 있는 시대가 되었습니다. 먼저 Gemini 3.8 Flash TTS로 자신의 목소리를 만들어 보는 것부터 꼭 한번 시도해 보세요.
푸진 AI 대학교
AI를 진심으로 활용하여 업무와 수익에도 연결하고 싶다. 하지만 체계적으로 배울 수 있고, 함께 꾸준히 할 수 있는 곳은 흔하지 않다. 그래서, 나의 AI 활용법을 전부 공개하는 장소로 Fujin AI 대학을 2026년 10월부터 시작한다. 영상 강의, 팟캐스트, 부가 콘텐츠, 커뮤니티에서 학습할 수 있다.
아래 링크에서 사전 안내를 받아보실 수 있으니, 관심 있으신 분들은 참고해 주십시오. 👇
그렇다면, 이번에는 이 정도로 마무리하겠습니다.
다음 회 방송에서 뵙겠습니다. 안녕히 계세요.
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 71청크
원문 보기 | 출처: note.com