안녕하세요. 하루 만에 모든 것을 해결하려니, 뇌가 먼저 소음을 내는 아세우스입니다.
영상 생성 AI를 자신의 제작 환경에 도입하는 것이 실질적인 의미가 있는지, 그것을 판단하기 위해 조사해 보기 시작했습니다.
시작은 타임라인을 엿보면서 떠오른 의문이었습니다. 수익화에 대한 명확하고 구체적인 제안이 없는데, 왜 SNS에서는 이것저것 이렇게 흥분하고 있는 걸까요? 예시들은 매일 흘러오는데, 그것으로 먹고 사는 사람들의 이야기가 전혀 나오지 않는 것이 답답해서, 모델의 성능이 아닌 돈의 흐름을 먼저 막아가는 방향으로 해결책을 찾기로 했습니다.
판단에 걸린 시간은 1일이나 2일이나. SNS에서 정보가 흘러와 Opus를 기점으로 검토하고, Fable 5와의 주고받기로 확정시켰다.
먼저 결론을 말씀드리겠습니다. 예상했던 판매 대상은 거의 전멸했고, 증거를 통해 남은 것은 단 하나뿐입니다. 흥미를 유발하는 대상은 시청자 수요가 아니었습니다. 그리고 마지막으로, 이 기사에서 가장 하고 싶은 결론이 있습니다. VRAM 16GB로 실행될 수 있는지와, 그 환경에서 하는 가치가 있는지에 대한 이야기는 또 다른 문제입니다.
전반부는 실제 측정 데이터와 죽은 전선의 목록이다. 후반부에는 살아남은 한 선과 흥겨운 지갑 이야기를 담는다.
외한 전제는 VRAM 16GB
발단은 ‘MiniMax H3’입니다. 2026년 8월 3일에 오픈웨이트화되면서 시간의 흐름이 순식간에 혼란스러워졌습니다.
저는 이것을 “흥미는 있지만 VRAM 16GB 그래픽 카드로서는 당분간 작동하지 않는 것으로 판단하고 있었습니다. 제 손에는 RTX 4070 Ti SUPER로 VRAM 16GB를 갖추고 있으며, H3의 공식 구성은 42GB급입니다. 작동하더라도 시스템 메모리를 대량으로 늘어놓은 환경의 이론치에 가까울 것이라고 생각하고 있었습니다.”
2026년 현재 VRAM 16GB 탑재 GPU는 RTX 5070 Ti이며, 권장 사양은 RTX 5090입니다.
그러므로 도입 대상에는 ‘완 2.2’를 선택했습니다.
결정적인 부분은 VRAM 16GB로 작동할 수 있다는 점이며, 이 한 가지 점입니다. 14B의 GGUF 양자화 버전으로, 라이선스는 Apache 2.0이며 상업적 이용에도 제한이 없습니다. 화제의 중심에서 벗어나는 선택이었지만, 기기의 조건이 충족되지 않는 모델을 고려하는 것은 의미가 없습니다.
그 두 날 이후, H3가 VRAM 16GB급으로 작동했다는 실제 측정 보고서가 발표되었다.
AI 업계에는 흔한 일입니다. 하나의 전제를 설정하고 움직이기 시작하면, 그 전제와 함께 사라지는 경우가 많습니다. 두 세 일이 지나면 상황은 변하고, 변한 일에 처음으로 눈치채는 것은 대부분 자신이 마지막입니다.
그 시점에서는 더 이상 되돌아갈 수 없는 지점에 이르렀습니다. 결국, 양쪽을 모두 포함하여 직접 측정하기로 했습니다.
VRAM 16GB 실제 측정: Wan 2.2와 MiniMax H3
돌려보낸 것은 햄스터가 회전목마를 달리는 5초 분량의 영상입니다. 회전 운동, 얇은 금 mesh, 작은 동물들의 빠른 사지, 영상 생성하기 어려운 요소들을 의도적으로 모았습니다.
완 2.2 (Q5 양자화) 832x480 / 5.06초 → 884.7초
MiniMax H3(int8) 864×480 / 5.17초 → 354.5초
영상 1초당으로 계산하면 Wan은 175초에서 185초, H3는 69초에서 71초로 늘어났습니다. H3가 Wan보다 2.5배에서 2.7배 더 빠른 결과였습니다. 또한 H3는 24fps로 음성까지 동시에 출력되며, Wan은 16fps로 음성 없이 재생됩니다.
H3 오디오는 환경음, 배경음악, 사람의 목소리 3가지 패턴으로 지정하여 출력했습니다. 듣기 쉽고 퀄리티가 좋은 소리가 나옵니다. 배경음악과 효과음을 별 과정에서 준비하는 번거로움이 완전히 사라지는 만큼, 속도 차이보다 더 효과적인 차이일 것입니다.
속도 차이의 이유는 모델 크기가 아니었습니다. Wan은 추론을 매 단계마다 2번 실행하고, 2개의 모델을 전환하며 생성합니다. H3는 한 번으로 처리됩니다. 동일한 20단계에서도 실제 계산량이 2배 정도 차이 납니다.
VRAM 점유량은 둘 다 15GB 전후로 줄어들었습니다. 하지만 멈추는 문제는 바로 거기서가 아니었습니다.
시스템 메모리가 먼저 한계에 도달한 것입니다. 완(Wan)의 고품질 버전을 실행할 때, 64GB를 저장한 메모리의 여유가 0.1GB까지 줄어들었습니다. 생성 과정 중에는 영상 편집 소프트웨어조차 실행할 수 없습니다. VRAM과 메모리가 100%를 완전히 사용했을 때, 검증에 사용하던 AI 어시스턴트가 한 번 멈춘 것만큼의 부하가 있었습니다.
양자화를 한 단락으로 줄이면 빈 공간이 13.45GB까지 회복되고, 속도에 거의 차이가 없습니다. VRAM 16GB 환경에서 실제 측정 결과, 고정밀 버전보다 한 단락을 줄인 버전이 더 적합했습니다.
지역선 1건 2.1엔, API선 77엔
전기 요금도 지불했습니다. GPU 단체의 실측값에서 계산했을 때 5초 분량의 영상 1개당 약 2.1원입니다. 같은 5초를 클라우드 API로 만들 경우 Veo 3.1 Lite로는 23엔에서 38엔, Sora 2로는 약 77엔, Kling 3.0으로는 69엔에서 108엔 정도입니다.
금액만 놓고 보면 10배에서 50배의 차이가 있습니다. 하지만 지역의 경우 1개당 6분에서 15분까지 대기해야 하며, 그 동안 컴퓨터가 다른 작업에 사용될 수 없습니다. 결정의 기준은 “15분 대기할 수 있는지”에 있었고, 금액은 거의 논점 자체가 되지 않았습니다.
죽은 전선 목록
할 수 있는 것과 팔 수 있는 것은 다르므로, 장소를 꼼꼼히 확인했습니다.
저희는 무라카미 하루키의 작품과 카호의 출연이 담긴 고품질 스톡 자료를 판매합니다.
저희 자료는 광고, 홍보, 마케팅 등 다양한 용도로 활용될 수 있도록 제작되었습니다.
무라카미 하루키의 작품과 카호의 이미지를 활용하여 더욱 효과적인 콘텐츠를 제작해보세요.
저희는 고객님의 성공적인 콘텐츠 제작을 위해 최선을 다해 지원하겠습니다.
PIXTA는 2026년 4월 20일 기준으로 AI 소재의 신규 접수를 종료하고, 5월 22일에 판매를 중단한다.
Shutterstock는 AI 생성 콘텐츠의 게시 자체를 허용하지 않습니다.
・『어도비 스톡』은 수용 중이지만, 보상률은 35%, 실매출 보고 후 1개당 8.43달러, 승인률은 약 10%입니다. 전체의 47.85%가 이미 AI 소재로 구성되어 있습니다.
세 자본 집단 중 두 개가 문을 닫았고, 남은 하나 역시 공급 과잉으로 인해 단가가 하락하고 있었습니다.
재생수 광고 수익
유튜브는 2025년 7월 15일 파트너 프로그램 개정에서 “비물질적 콘텐츠”의 대우를 명확화하고, AI 양산 채널의 수익화 정지가 실제로 발생하고 있습니다. 틱톡의 크리에이터 보상 프로그램 또한 완전히 AI로 생성한 영상은 대상에서 제외된다고 명시되어 있습니다.
수익액까지 검증 가능한 성공 사례는 찾아봐도 발견되지 않았습니다. 참고치로, AI고양이 영상은 8개월 동안 5억 4800만 회 재생되어 수익이 100달러에서 3000달러였습니다. 재생수의 규모에 비해 금액이 전혀 부합하지 않습니다.
툴 설명 상품 안내
브레인에서 “클링” 12건, “영상 생성 AI” 13건이 검색되었지만 모두 리뷰 0건이었습니다. 판매가 되지 않았다는 의미입니다. 게다가 ‘소라’는 2026년 3월 25일에 서비스 종료가 발표되었고, 4월 26일에 앱이 중단되었습니다. 그 도구의 설명형 상품을 보유했던 사람은 자산 가치와 함께 잃게 되었습니다.
클라우드 의존 노하우는 6개월에서 1년 사이에 쓸모 없어지는 현상이 발생한다. 이는 그 좋은 예라고 할 수 있다.
솔직히 이 시점에서 “포기하는 게 좋을까…”라는 생각에 빠지게 되었다. 영상 생성 AI로 돈을 벌기로 들었을 때 가장 먼저 떠오르는 세 가지 이유는 각각 다른 이유로 막혀 있는 것이다. 진입 시장이 없다는 결론이다.
하지만, 게시물로서의 가치는 포기하지 않았습니다. 수익을 낼 수 없다는 것을 깨달은 것 자체가, 아직 아무도 쓰지 않은 정보가 되었습니다.
그리고 가장 큰 의문이 여전히 남아 있다. 매각 대상이 이렇게 막혀 있는데, 왜 기대감만 계속 가속화되고 있는 것인가?
출처: note 원문
번역: Gemma 3(.44) 초벌 + 교정 32청크
원문 보기 | 출처: note.com